最新

全部文章,按抓取时间从新到旧排列。

Cards List

突破 DeepSeek-V4-Pro 服务极限(28分钟阅读时间)

TLDR AI · 21小时前 缓存

本文介绍了一种优化 DeepSeek-V4-Pro(一个1.6万亿参数的 MoE 模型)在 H20 GPU 上服务的方法,通过场景特定的配置和优化实现了显著的性能提升。

0 人收藏 0 人点赞

什么是监管人工智能的正确平衡?(阅读时间47分钟)

TLDR AI · 21小时前 缓存

与精通技术的政治候选人 Bethany Andres-Beck 的访谈探讨了人工智能监管的平衡,讨论了机器人税、责任制度以及防止人工智能公司垄断等话题。

0 人收藏 0 人点赞

Replit 推出 Free Mode(4分钟阅读)

TLDR AI · 21小时前 缓存

Replit 推出 Free Mode,这是一项由 OpenAI 的 GPT-5.6 Luna 驱动的新订阅功能,允许用户通过其月度计划创建多达 30 倍的内容,并为 AI 辅助开发提供更快的用户体验。

0 人收藏 0 人点赞

路由器(网站)

TLDR AI · 21小时前 缓存

Ramp公司推出的Router工具可通过将请求路由至满足性能需求的最低成本模型,最高降低40%的AI推理成本,并为多模型提供单一接入点。

0 人收藏 0 人点赞

Meta的Muse Video模型早期输出(3分钟阅读)

TLDR AI · 21小时前 缓存

Meta正在测试其Muse Video模型,该模型展示了生成带有原生音频支持的高质量10秒视频的先进能力。

0 人收藏 0 人点赞

关于在仅使用相同参数调用时包装可调用对象到Lambda中的问题

The Old New Thing (Raymond Chen) · 昨天 缓存

文章解释了当内部Lambda可以直接使用时,将可调用对象包装在Lambda中是不必要的,强调C++中的Lambda只是具有函数调用操作符的类的语法糖。

0 人收藏 0 人点赞

在树莓派上使用Steam Deck LCD

Jeff Geerling · 7小时前 缓存

本文介绍如何使用Scandent开发的开源HAT设计和Linux内核驱动,将Steam Deck的液晶屏幕与树莓派连接,并强调该液晶屏的优越规格和实惠价格。

0 人收藏 0 人点赞

@LangChain: 生产环境中的对话可以揭示原始代理未设计处理的客户需求。@LATAMAirlines 发现 …

X AI KOLs Following · 8小时前 缓存

LATAM Airlines 和其他客户体验团队正在通过分析生产对话、减少范围外消息并使用 LangSmith 等工具来改进 AI 客户体验代理的性能。

0 人收藏 0 人点赞

@FinanceYF5: 今晚少看一部剧,把这堂2小时34分钟的Stanford课程看完。 它从Tokenization、BPE一路讲到Transformer、预训练、RLHF、DPO和逐Token生成,完整拆解ChatGPT、Claude这类大模型是如何构建出来…

X AI KOLs Following · 18小时前 缓存

推荐斯坦福大学的一门AI课程,详细讲解大语言模型的构建原理,包括Tokenization、BPE、Transformer、预训练、RLHF和DPO。

0 人收藏 0 人点赞

@cline: 感谢 @OpenAI 在 Cline 平台的 GPT 降价。GPT-5.6 Sol 五折,GPT-5.6 Terra 八折,GPT-5.6 Luna 二折…

X AI KOLs Following · 昨天 缓存

OpenAI 宣布在 Cline 平台对 GPT-5.6 模型变体降价,其中 Luna 的折扣高达 80%,而 Sol 现在比 Fable 便宜超过三倍。

0 人收藏 0 人点赞

@maximelabonne:我在韩国最大的AI会议现场。这是我第一次签这么多书。感谢所有前来的朋友…

X AI KOLs Following · 11小时前 缓存

Maxime Labonne 参加了韩国最大的AI会议,签署了书籍,并会见了《LLM Engineer’s Handbook》韩语版的译者。

0 人收藏 0 人点赞

@TheAhmadOsman: 本地LLM与GPU

X AI KOLs Following · 7小时前 缓存

一条推文,分享了关于使用GPU部署本地大语言模型的信息或资源。

0 人收藏 0 人点赞

@rohanpaul_ai: Zhipu创始人Tang Jie的精彩文章。AI扩展正在超越参数增长。“有多少参数?”正变得……

X AI KOLs Following · 9小时前 缓存

Zhipu创始人Tang Jie讨论了AI扩展如何超越参数数量,涵盖训练数据、每次前向传播的计算量以及后训练等因素,并以GLM-5.3为例。

0 人收藏 0 人点赞

我为代理计时了一天。它实际上只运行了大约四分之一的时间,其余时间都在等待我点击批准

Reddit r/AI_Agents · 10小时前

作者报告了对AI代理活动的计时,发现由于等待批准提示,在8小时的一天中只活跃了大约2.5小时,并讨论了使用MiniMax Code通过手机批准来管理远离时的编码任务。

0 人收藏 0 人点赞

AI 智能体只有在人类能中途接管运行时才算是生产就绪的

Reddit r/AI_Agents · 7小时前

文章主张,AI 智能体在未允许人类中途干预前不算生产就绪,强调了清晰状态、有界权限和恢复路径的重要性,而非追求完全自主。

0 人收藏 0 人点赞

@kentcdodds: 我创建了一个 Kody Discord 服务器。然后我将 Kody 连接起来管理它,天哪,让代理在 Discord 中做事比在 UI 上点击好太多了 …

X AI KOLs Timeline · 16小时前 缓存

Kent C. Dodds 分享了他为 Kody 创建 Discord 服务器并使用 AI 代理管理它的经验,发现这比手动 UI 交互更高效。

0 人收藏 0 人点赞

@tom_doerr: 用轻量级桌面客户端编辑RAW图像,适用于Windows、macOS、Linux和Android。 https://github.com…

X AI KOLs Timeline · 8小时前 缓存

RapidRAW 是一款轻量级、GPU加速的RAW图像编辑器,使用Rust、Tauri和React构建,为Windows、macOS、Linux和Android提供快速而美观的编辑体验。

0 人收藏 0 人点赞

@0xMortyx: 几乎每个人都在谈论NVIDIA的供应问题,但几乎没有人讨论这些GPU在实际部署后的使用效率如何…

X AI KOLs Timeline · 14小时前 缓存

一条推文讨论了部署后GPU效率被忽视的问题,并提到一家初创公司通过虚拟化筹集了1300万美元来解决GPU闲置时间的问题。

0 人收藏 0 人点赞

@rauchg: http://fx.sh 是 6.3MB。它启动时间在 10 微秒¹。它是一个 Zig 编译的静态 ELF 二进制文件,或者一个更小的 𝚕𝚒𝚋𝚏𝚡.𝚠𝚊…

X AI KOLs Timeline · 20小时前 缓存

一款名为 fx 的新型开源编码代理工具,使用 Zig 编译,具有微小的 6.3MB 二进制文件、10 微秒的即时启动以及 WebAssembly 支持,以实现优化性能和可嵌入性。

0 人收藏 0 人点赞

@GKev1n: 兄弟们,可以睡觉了!相信 Tibo,明早我们可以看到GPT 6 或者更聪明的模型 外加重置!

X AI KOLs Timeline · 8小时前 缓存

该推文推测明早可能看到GPT 6或更智能的模型,并提及重置,表达了对模型发布的期待。

0 人收藏 0 人点赞
← 上一页
下一页 →
← 返回首页

提交意见反馈