全部文章,按抓取时间从新到旧排列。
本文介绍了一种优化 DeepSeek-V4-Pro(一个1.6万亿参数的 MoE 模型)在 H20 GPU 上服务的方法,通过场景特定的配置和优化实现了显著的性能提升。
与精通技术的政治候选人 Bethany Andres-Beck 的访谈探讨了人工智能监管的平衡,讨论了机器人税、责任制度以及防止人工智能公司垄断等话题。
Replit 推出 Free Mode,这是一项由 OpenAI 的 GPT-5.6 Luna 驱动的新订阅功能,允许用户通过其月度计划创建多达 30 倍的内容,并为 AI 辅助开发提供更快的用户体验。
文章解释了当内部Lambda可以直接使用时,将可调用对象包装在Lambda中是不必要的,强调C++中的Lambda只是具有函数调用操作符的类的语法糖。
本文介绍如何使用Scandent开发的开源HAT设计和Linux内核驱动,将Steam Deck的液晶屏幕与树莓派连接,并强调该液晶屏的优越规格和实惠价格。
LATAM Airlines 和其他客户体验团队正在通过分析生产对话、减少范围外消息并使用 LangSmith 等工具来改进 AI 客户体验代理的性能。
推荐斯坦福大学的一门AI课程,详细讲解大语言模型的构建原理,包括Tokenization、BPE、Transformer、预训练、RLHF和DPO。
OpenAI 宣布在 Cline 平台对 GPT-5.6 模型变体降价,其中 Luna 的折扣高达 80%,而 Sol 现在比 Fable 便宜超过三倍。
Maxime Labonne 参加了韩国最大的AI会议,签署了书籍,并会见了《LLM Engineer’s Handbook》韩语版的译者。
Zhipu创始人Tang Jie讨论了AI扩展如何超越参数数量,涵盖训练数据、每次前向传播的计算量以及后训练等因素,并以GLM-5.3为例。
作者报告了对AI代理活动的计时,发现由于等待批准提示,在8小时的一天中只活跃了大约2.5小时,并讨论了使用MiniMax Code通过手机批准来管理远离时的编码任务。
文章主张,AI 智能体在未允许人类中途干预前不算生产就绪,强调了清晰状态、有界权限和恢复路径的重要性,而非追求完全自主。
Kent C. Dodds 分享了他为 Kody 创建 Discord 服务器并使用 AI 代理管理它的经验,发现这比手动 UI 交互更高效。
RapidRAW 是一款轻量级、GPU加速的RAW图像编辑器,使用Rust、Tauri和React构建,为Windows、macOS、Linux和Android提供快速而美观的编辑体验。
一条推文讨论了部署后GPU效率被忽视的问题,并提到一家初创公司通过虚拟化筹集了1300万美元来解决GPU闲置时间的问题。
一款名为 fx 的新型开源编码代理工具,使用 Zig 编译,具有微小的 6.3MB 二进制文件、10 微秒的即时启动以及 WebAssembly 支持,以实现优化性能和可嵌入性。
该推文推测明早可能看到GPT 6或更智能的模型,并提及重置,表达了对模型发布的期待。