有传言称,Demis Hassabis 曾想和 Dean 一起离开谷歌,但被说服留下,因为担心股价崩盘。未经证实,但可能对 AI 领导层产生重大影响。
一位开发者抱怨 OpenAI Codex CLI 在一个游戏项目上几分钟内消耗了 150 万 token,质疑如何负担得起地使用 AI 编码工具,并寻求建议。
一位开发者回顾了六个月来使用AI进行代码审查的经历,发现模糊的提示会产生看似合理但毫无用处的反馈。解决办法是将审查视为一个带门控的流水线,包含明确的上下文、分范围的检查、验证清单和对抗性自我批评。
通过打补丁的驱动和vLLM环境变量为消费级Nvidia GPU启用PCI-E点对点(P2P),如基准测试所示,可免费获得约25%的预填充吞吐量提升。
一条推文分享了一个关于 AI 代理信任层的 Google 视频和博客文章,使用基于角色的架构和可验证凭证来强制执行停止条件,防止代理进行未经授权的购买。
一位开发者测试了一个 GitHub 热门项目,该项目针对上下文压缩后的智能体恢复问题;结果发现,在对话记录之外保留持久化账本是有帮助的,但仍需要更严格的验收测试,以确认确切的交付步骤和用户约束得以保留。
亚马逊计划在得克萨斯州建设的数据中心可能成为美国最大的气候污染源,其现场天然气发电厂获准每年排放3300万吨二氧化碳。报告强调,围绕人工智能基础设施和亚马逊碳排放的环境问题日益凸显,尽管亚马逊作出气候承诺,其碳排放去年仍上升了16%。
X 正在终止其收入分成计划,并将于9月8日推出新的 Original Content Rewards 计划,要求拥有500名已验证粉丝和50万次展示,报酬将基于原创内容的合格展示次数。
Ahmad Osman 认为,像 Qwen 27B 这样的密集模型在 NVIDIA DGX Spark 等统一内存系统上表现不佳,并提出 MoE 模型更为合适;他还称,RTX PRO 6000 等独立 GPU 在智能体工作负载上能提供远为更好的性能。
埃隆·马斯克表示,在长途航班上使用星链是提升生产力的重大变革,并引用美国联合航空公司的报告称,咨询顾问们专门预订配备星链的航班,以便在旅途中工作。
一位用户正在寻求构建预算型家用 AI 服务器(32-48GB 显存)的建议,正在 AMD RX 9060 XT 和 Nvidia RTX 5060 Ti GPU 之间犹豫,并纠结于使用 AM5 还是二手 EPYC 平台来进行本地 LLM 推理和大型 MoE 模型卸载。
作者描述了连续七天使用 AI 模型 GPT 5.6 Sol 和 Fable 5 解决无线通信理论中一个 25 年悬而未决的问题,并指出验证是最大的瓶颈。
OpenAI 已收购演示文稿初创公司 NextSlide,其团队将加入 ChatGPT 工作,继续构建帮助人们创作和沟通的 AI 产品。
英国儿童报告称,自己的露骨深度伪造内容数量激增。2026年上半年,Report Remove收到420份相关报告,已超过2025年全年总数。监督机构警告称,人工智能使这类内容的制作更加容易,并呼吁加强安全保护措施。
一位非数学家使用 ChatGPT 识别出两篇最近发表的黎曼猜想论文中的归一化错误,且作者在收到联系后确认了该问题。这个故事凸显了 AI 在辅助数学研究方面日益增长的作用。
一条推文,概述了通过阅读超大规模云厂商的AI云收益来做空 Nebius (NBIS) 的周末指南,并做多 Lululemon (LULU) 作为对冲。
一位开发者通过在 4070 Ti + 32GB 内存上利用 GPT-OSS 120B 的 MoE 架构,将冷专家从 NVMe 流式加载、热专家缓存在 GPU 上,并采用 top-1 近似,最终达到了 21 tok/s 的本地运行速度。