每美元智能是新的扩展定律:一个小型推理模型在Arc-AGI 1上突破现有成本-精度帕累托前沿
摘要
Chart Pathway的BDH-CQ,一个150M参数的推理模型,在ARC-AGI-1上达到了29.5%的准确率,每任务成本远低于像GPT-5.6 Luna这样的大型模型,展示了成本-精度权衡的改进。
Chart Pathway,一个构建后变换器架构和模型的人工智能实验室,发布了BDH-CQ的基准测试结果,这是一个150M参数的推理模型。BDH-CQ在公开的ARC-AGI-1评估集上获得了29.5%的pass@2成绩,计算推理成本为每任务0.0007美元。它的每任务运行成本大约是GPT 5.6 Luna (Low)的11分之一,即使在考虑了OpenAI于7月30日对5.6 Luna进行的80%降价之后。Luna得分34.2%,对比BDH-CQ的29.5%,这是一个在成本11倍的情况下获得的适度精度提升。他们还报告了从1B到600B参数的早期预训练实验,同时保留了BDH-CQ特有的潜在推理能力。它通过结合上下文学习和循环潜在推理来实现,而不是将每个中间结果语言化。
相似文章
150M参数循环模型以每任务0.0007美元的成本在ARC-AGI-1上取得29.5%的成绩
本文介绍了BDH-CQ,一个150M参数的循环模型,它结合了上下文学习和潜在推理,以每任务0.0007美元的成本在ARC-AGI-1上取得了29.5%的成绩,为成本效率树立了新标准。
Pathway是否刚刚揭示了Andrew Curran预测的架构突破?其150M模型树立了ARC-AGI-1成本效率新前沿
Pathway的150M参数BDH-CQ模型在ARC-AGI-1上达到29.5%的准确率,每个任务成本仅为0.0007美元,创下新低,采用循环记忆和潜在推理,而非长token链。该架构或许正是Andrew Curran预告的突破,OpenAI研究员Lukasz Kaiser担任投资者和顾问。
@cerebras: https://x.com/cerebras/status/2067357992929153268
关于AI推理模型的经济性和性能影响的分析,表明启用推理可以将准确率提高10-20%,但消耗的token数量增加5-10倍,并讨论了不同的推理类型及其应用。
新型AI使用全新的推理方法——研究人员表示,其运行成本比领先的OpenAI模型低多达11倍
来自Pathway的一个新AI模型使用非语言推理,将成本降低多达11倍,与领先的OpenAI模型相比,这在arXiv上的一篇研究论文中有详细说明。
BDH-CQ:结合循环潜在推理的上下文学习
本文介绍了BDH-CQ,一个150M参数规模的推理模型,它将上下文学习与循环潜在推理相结合,在ARC-AGI-1上以极低的推理成本实现了29.5%的pass@2,确立了新的成本-精度前沿。