Pathway是否刚刚揭示了Andrew Curran预测的架构突破?其150M模型树立了ARC-AGI-1成本效率新前沿
摘要
Pathway的150M参数BDH-CQ模型在ARC-AGI-1上达到29.5%的准确率,每个任务成本仅为0.0007美元,创下新低,采用循环记忆和潜在推理,而非长token链。该架构或许正是Andrew Curran预告的突破,OpenAI研究员Lukasz Kaiser担任投资者和顾问。
Andrew Curran最近暗示了一项重大的内存效率架构突破,并非来自大型AI实验室,而是来自一个与OpenAI有关联的团队:https://x.com/AndrewCurran_/status/2072076893730349409 Pathway现已发布BDH-CQ:一个150M参数的后Transformer模型,在ARC-AGI-1上获得29.5%的分数,计算成本仅为每个任务0.0007美元,确立了新的成本效率前沿。它使用循环记忆和潜在推理,而不是基于长token的思维链。这其中的联系异常紧密:一种新的内存高效架构,在大型实验室之外开发,而OpenAI研究员、Transformer联合作者Lukasz Kaiser既是投资者又是顾问。这是否就是Curran所暗示的公告?
相似文章
单张4090上11.67% ARC-AGI-2本地评估:TOPAS递归架构
作者介绍了TOPAS,一种递归AI架构,在单张RTX 4090上达到了ARC-AGI-2的11.67%,旨在证明架构效率可以超越原始计算能力。
@reach_vb: luna-maxxing,成本降低80%!
ARC Prize在价格下调80%后重新测试了OpenAI的GPT-5.6 Luna在ARC-AGI上的表现,确认其在每项任务成本大幅降低的情况下性能相似。
构建丰裕智能
OpenAI 讨论了其实现丰裕智能的战略,重点介绍了 GPT-5.6 模型的重大降价以及降低服务成本、提升性能的效率改进。
@rohanpaul_ai: GLM-5.2在ARC-AGI-2上获得22.8%,每任务$0.25。值得注意的是,2025年5月左右,经过验证的最佳模型在ARC-AGI-2上只有…
GLM-5.2在ARC-AGI-2上取得22.8%的成绩,在ARC-AGI-1上取得77%的成绩,每任务成本仅0.25美元,比2025年5月的最佳前沿得分提高了7.6倍。
也许下一个模型的胜利在于降低智能体工作流的消耗
文章讨论了下一个重要的模型进步可能在于降低智能体工作流的成本,重点介绍了蚂蚁集团的 Ling-2.6-1T,这是一个万亿参数模型,旨在以低计算开销实现高效推理和任务执行。