Prime Agent: 一个自我改进的RLM框架
摘要
Prime Agent 是一个开源框架,它使用递归子代理和持久化计算来扩展语言模型在编码和推理任务中的长期能力,显著提高了在ARC-AGI-3等基准测试上的性能。
查看缓存全文
缓存时间: 2026/08/25 04:33
论文页面 - Prime Agent:一个自我改进的RLM运行框架
来源:https://huggingface.co/papers/2608.23552 作者:
,
,
,
,
,
,
,
,
,
摘要
Prime Agent 是一个开源框架,它利用递归子代理、持久化计算和代理间协调,来扩展语言模型在编码和推理任务上的长期能力。
语言模型是顺序处理器,但长期的代理行为需要超出模型权重和活动上下文的外部信息和计算。Prime Agent 是一个用于长期评估和编码代理工作流的开源框架。一个持久化的 IPython REPL 遵循递归语言模型(https://huggingface.co/papers?q=Recursive%20Language%20Model)的抽象,用于编程化上下文处理和测试时计算(https://huggingface.co/papers?q=test-time%20compute),而持续运行框架则在轨迹之间保存历史、记忆、技能、提示词和子代理规范。递归子代理(https://huggingface.co/papers?q=subagents)通过直接的代理间通信(https://huggingface.co/papers?q=agent-to-agent%20communication)进行协调,“代理视图”功能允许人类检查和管理基于守护进程的会话(https://huggingface.co/papers?q=daemon-backed%20sessions)。Prime Agent 标准化了执行、恢复、验证和资源记账,同时将策略构建留给模型本身。这个低摩擦、表现力强的屏障防止了框架故障演变为模型故障,并将测量推向模型真正的潜在最大能力。Prime Agent 将 ARC-AGI-3(https://huggingface.co/papers?q=ARC-AGI-3)的 RHAE Best@1 指标从 30% 提升至 95.5%,并在长上下文编码(https://huggingface.co/papers?q=long-context%20coding)、GPU 内核生成(https://huggingface.co/papers?q=GPU-kernel%20generation)、模拟器构建以及自主 nanoGPT(https://huggingface.co/papers?q=nanoGPT)速通挑战中,匹配或超越了原生及流行的框架。在 Factorio 游戏中,我们发现允许持续的优化可以带来技术的持续进步,而专用的子代理(https://huggingface.co/papers?q=subagents)则能实现并行化工作。代码可在 https://github.com/PrimeIntellect-ai/prime-agent 获取。
查看 arXiv 页面 (https://arxiv.org/abs/2608.23552)查看 PDF (https://arxiv.org/pdf/2608.23552)项目页面 (https://www.primeintellect.ai/blog/prime-agent)GitHub 18.2k (https://github.com/PrimeIntellect-ai/prime-agent)添加到收藏夹 (https://huggingface.co/login?next=%2Fpapers%2F2608.23552)
在您的代理中获取此论文:
hf papers read 2608.23552
没有最新的 CLI?curl -LsSf https://hf.co/cli/install.sh | bash
引用此论文的模型 0
没有模型链接此论文
在模型 README.md 中引用 arxiv.org/abs/2608.23552 以从此页面链接它。
引用此论文的数据集 0
没有数据集链接此论文
在数据集 README.md 中引用 arxiv.org/abs/2608.23552 以从此页面链接它。
引用此论文的 Space 0
没有 Space 链接此论文
在 Space README.md 中引用 arxiv.org/abs/2608.23552 以从此页面链接它。
包含此论文的收藏夹 0
没有收藏夹包含此论文
将此论文添加到收藏夹 (https://huggingface.co/new-collection) 以从此页面链接它。
相似文章
Prime Agent:一个自我改进的RLM智能体
Prime Intellect 推出 Prime Agent,这是一个完全开源、自我改进的编码工具(harness),围绕递归语言模型(RLM)和 Continual Harness 抽象构建,通过基于 REPL 的接口实现持久子智能体和动态工具。
Prime Agent —— 超越 Codex/CC/PI 的新型编码框架
Prime Agent 是一个开源编码与研究框架,性能超越专有框架,在 ARC-AGI-3 上得分 95.5%,并在多个基准测试中提升模型表现。
@latkins: 哟
Prime Intellect 推出了 Prime Agent,一个用于编程和长期自主任务的自我改进型 RLM 框架,具备程序化工具调用、将上下文作为变量、多智能体消息传递以及可自我修改的框架状态等特点。
Prime Agent
Prime Agent 是一个能够优化自身工具链的编程代理,已在 Product Hunt 上发布。
PrimeIntellect-ai/prime-agent
Prime Agent 是 Prime Intellect 推出的开源编码与研究代理,结合了持久化 Python 环境、稳定的运行框架、子代理以及自我改进能力,适用于长时间运行的自主任务。