ARC-AGI-4 将针对自主发明:“解锁技术各领域进步的元技能”
摘要
ARC-AGI-4 是一个针对自主开放式创新的基准测试,强调开源协作以推进 AGI 研究,并针对发明这一元技能。
ARC-AGI-4 将是一个自主开放式创新的基准测试。它将继续我们对开源的承诺,为研究界提供一个共享的进步目标,造福全人类。尽管模型进步迅速,人类在开放式发明方面仍然显著优于 AI。这就是解锁技术各领域进步的元技能。能够进行科学创新的先进 AI 将带来巨大的新技术、新知识和新理解。这是一个正和未来。我们致力于推进它。开源是这一进步的基础。前沿 AI 背后的知识,而不仅仅是技术本身,应广泛分布在研究人员、学者和组织之间。AI 行业任何降低开放性或集中前沿 AI 访问权的协调努力都将破坏那个正和未来。我们致力于推进一个每个人都能贡献并受益于 AI 进步的未来。https://x.com/arcprize/status/2098849962754978152 这可能是最后一个 ARC-AGI。如果这个被饱和,它可能是 AGI 的明确证明。
相似文章
AutoResearchClaw:自我强化的自主研究与人机协作
AutoResearchClaw是一个多智能体自主研究系统,通过结构化辩论、自我修复执行和人机协作来改进科学发现,在ARC-Bench基准上比之前的系统高出54.7%。
为 AGI 及其未来做好准备
OpenAI 阐述了为 AGI 做准备的战略,强调通过真实世界反馈循环进行渐进式部署,随着系统接近 AGI 能力而提高谨慎程度,以及开发更好的对齐技术以确保 AI 系统保持可控和安全。
@AIatMeta:作为对我们推进AI研究前沿进展的检验,今年6月,我们派出了下一代自主……
Meta的自主AI研究系统AIRA₃在一场由NVIDIA主办的Kaggle竞赛中排名第8(约4000支参赛队伍),赢得金牌。该竞赛旨在对300亿参数的Nemotron模型进行微调,AIRA₃的表现优于拥有相同工具访问权限的人类竞争者。
@charliejhills:研究人员刚刚发布了一篇重新定义AGI实际含义的论文。它并非大多数人想的那样。论文开篇…
一篇新论文将AGI重新定义为在限制条件(计算、内存、能源)下的适应能力,并提出了一个“人工科学家基准”,专注于自主发现因果关系,而不是在固定任务上达到人类水平的表现。
@rohanpaul_ai: Meta、斯坦福、谷歌等多家顶级实验室的新论文提出了AutoResearchClaw。表明自动化研究改进…
来自Meta、斯坦福和谷歌的一篇新论文提出了AutoResearchClaw,该方法通过整合故障恢复、辩论和选择性人工输入来改进自动化研究。它在ARC-Bench上以54.7%的优势超越了AI Scientist v2,并揭示了当受到过程约束而非无限自由时,自主性会得到增强。