@UnTalNixon_exe: 多智能体系统中最常见的错误并非你所想的那样。不是选择错误的模型,也不是提示工程……
摘要
本文讨论了一篇斯坦福论文,该论文指出信息在交接过程中的丢失是多智能体系统中最常见的错误,并介绍了架构和一个标准循环,包括共享内存、消息模式、可观察性和防护机制,以提升性能。
查看缓存全文
缓存时间: 2026/08/14 17:42
多智能体系统中最常见的错误 并非你以为的那个
不是选错了模型。 也不是提示词工程。
而在于不理解每次交接时上下文是如何衰减的。
每当一个智能体将任务传递给另一个, 信息就在流失。 一个令牌接着一个令牌。
直到整个系统在复杂任务中彻底崩溃。
斯坦福大学刚发表了一篇关于多智能体协调的最清晰论文:
四种真实架构: → 路由器模式 → 规划者-工作者模式 → 监督者模式 → 层级模式
以及本应成为标准的工作循环: 接收 → 规划 → 执行 → 合并 → 评估
多数框架卖的是“协调能力”。 这篇论文揭示了它在生产环境中为何失效,以及你真正需要的是:
共享记忆 + 消息规范 + 可观测性 + 防护栏。
如果你正在构建智能体却还未领悟这点,那你就是在沙上建楼。
相似文章
@alex_prompter:多智能体 AI 系统会在四个环节出问题。路由误触发,并行永不发生,交接丢失上下文,以及覆盖…
多智能体AI系统通常会在路由、并行、交接和覆盖方面出问题。本文推荐使用分派矩阵、并行执行、结构化交接和带日志的兜底后备方案来修复这些问题。
在实践中,我们的多智能体失败几乎从来不是模型的问题——而是交接环节的问题。MAST数据是否符合您的观察?
对多智能体LLM流水线失败的分析,引用伯克利MAST论文,该论文将大多数失败归因于协调问题(规范、智能体间不一致)而非模型能力,并建议使用专用验证智能体作为解决方案。
停止构建多智能体系统
一篇观点文章认为,向系统中添加更多智能体通常是解决可靠性问题的错误方法,而一个精心设计的、具有更好上下文、工具、护栏和评估的单一智能体通常更优。
我在构建多智能体系统时犯了这5个错误,你可能也会犯
作者分享了构建客户支持多智能体系统的经验,认为检索和落地失败(而非提示词或模型)是智能体产生幻觉的主要原因。作者列出了五项落地检查,并指出禁止无依据回答使升级率降低了40%。
@no_stp_on_snek: 如果你构建 multi-agent 或 mixture-of-agents 系统,请阅读 @dangerm00se 的文章。让我印象深刻的一个发现:甚至…
一位用户强调了 Hugh Madden 关于 multi-agent 系统的文章中的一个发现:即使是强大的仲裁者(GPT-5.5),如果先看到较弱代理的输出,也会产生偏差,从约 98% 的单独准确率下降到 7/9。