@0xNoryxx: 斯坦福大学花费2年时间和9,842个任务证明:循环工程+图记忆是构建智能体的唯一途径……
摘要
一项涵盖9,842个任务的斯坦福研究表明,将循环工程与图记忆相结合,可生成比标准智能体性能高出38.6%的AI智能体,不必要的工具调用减少24.1%,延迟降低21.7%。
查看缓存全文
缓存时间: 2026/07/21 14:43
斯坦福耗时2年、用9,842个任务证明:只有“循环工程+图谱记忆“才能构建不崩溃的智能体
采用该架构的智能体性能超出标准方案38.6%——不必要工具调用减少24.1%——延迟降低21.7%
循环 → 图谱 → 循环 → 图谱
每一轮循环智能体都在变得更聪明,每个任务都建立在其已掌握的所有知识之上
缺少图谱,智能体每次都会从零开始;缺少循环,智能体永远无法自我纠错
9,842个真实任务——编码、研究、数据——每一次结果都相同
收藏本条内容,将论文粘贴到Claude Code中——你会看到“遗忘型智能体“与“累积型智能体“的天壤之别
相似文章
@Sprytixl: 斯坦福和Anthropic花费310万美元证明你的智能体表现比应有水平差42%——并找到了解决方案 大多数智能体…
斯坦福和Anthropic的研究表明,采用基于图记忆的AI智能体比未采用的智能体性能提升42%,代码准确率提高36%,研究效率提高45%。
@ShenSeanChen: I dug into graph engineering because @steipete asked one question on July 18 and the entire AI agent space spent two we…
Sean Chen discusses loop-based vs graph-based AI agent architectures and releases waku-agent, an open-source local-first AI assistant harness with memory, eval, and a ~95-line loop.
@0xMovez:别浪费两年时间去搞懂AI代理实际上是如何工作的。例如,Anthropic和Google的工程师在斯坦福刚刚发布了…
一则推文重点介绍了Anthropic和Google工程师在斯坦福的讲座,内容涵盖自我改进的AI代理、代理循环模式以及生成器-验证器差距。
@akshay_pachaar: Andrej Karpathy:“别让自己成为瓶颈。最大化你的杠杆效应。投入极少的令牌,却能收获巨大的成果……”
对AI代理的循环工程的详细解析:从手动代理监督转向具有触发器、制造器、检查器和持久状态的自主循环。推荐使用Zep的Graphiti进行时序知识图谱,以及Comet的Opik进行可观测性,以构建可靠的无人值守代理系统。
@shmidtqq: https://x.com/shmidtqq/status/2068704187492221405
一份关于AI编程代理循环工程的深入指南,解释了如何构建自动循环来重复提示代理、验证结果并避免失控成本,并通过一位工程师一个月内提交259个拉取请求的案例研究加以说明。