@LinusEkenstam:就在睡觉前。让我睡吧。拜托 95.5% 通过 ARC-AGI-3(“如果属实将意义重大”)

X AI KOLs Timeline 工具

摘要

Linus Ekenstam 强调 Prime Intellect 发布了 Prime Agent,这是一个用于编码和长期自主任务的自改进框架,据报道在 ARC-AGI-3 上得分 95.5%,高于人类基线。

就在睡觉前。让我睡吧。拜托 ARC-AGI-3 上 95.5% 🤯 (“如果属实,那将非常重大”)
查看原文
查看缓存全文

缓存时间: 2026/08/06 02:31

临睡前看到这个。让我睡吧。求你了

ARC-AGI-3 上达到 95.5% 🤯

(“如果属实,意义重大”)

MTS (@MTSlive): 检测到状况:Prime Intellect 正在发布 Prime Agent,一个用于编码和长期自主任务的自我改进框架。

团队报告在 ARC-AGI-3 上达到 95.5%,高于人类基线,并表示这一增益并非针对特定基准。

相似文章

@latkins: 哟

X AI KOLs Following

Prime Intellect 推出了 Prime Agent,一个用于编程和长期自主任务的自我改进型 RLM 框架,具备程序化工具调用、将上下文作为变量、多智能体消息传递以及可自我修改的框架状态等特点。

PrimeIntellect-ai/prime-agent

GitHub Trending (daily)

Prime Agent 是 Prime Intellect 推出的开源编码与研究代理,结合了持久化 Python 环境、稳定的运行框架、子代理以及自我改进能力,适用于长时间运行的自主任务。

Prime Agent:一个自我改进的RLM智能体

Hacker News Top

Prime Intellect 推出 Prime Agent,这是一个完全开源、自我改进的编码工具(harness),围绕递归语言模型(RLM)和 Continual Harness 抽象构建,通过基于 REPL 的接口实现持久子智能体和动态工具。

Prime Agent: 一个自我改进的RLM框架

Hugging Face Daily Papers

Prime Agent 是一个开源框架,它使用递归子代理和持久化计算来扩展语言模型在编码和推理任务中的长期能力,显著提高了在ARC-AGI-3等基准测试上的性能。