@Leechael: The new generation of models should no longer use subagents. Subagents aren't as effective as having sessions exchange …
摘要
The article discusses the inefficiency of using subagents in AI models, suggesting that direct message exchange between sessions might be more effective, based on observations about GPT-6 Astra's token usage in Codex.
查看缓存全文
缓存时间: 2026/09/10 12:30
The new generation of models should no longer use subagents. Subagents aren’t as effective as having sessions exchange messages with each other for synchronization.
Gangqiang Yao (@yaogangqiang): 一直感觉 GPT-6 Astra 用 subagent 额度掉得特别快,就去翻了下 Codex 源码。
发现一个有问题的地方:主 agent 等 subagent 的时候,默认每 30 秒醒一次问「好了没」,没好就再睡。每问一次都是一次模型请求,有些浪费。
有点像 leader
相似文章
@jonasgeiping:我们训练模型的方式错了,这都是因为ChatGPT。即使日常使用的现代编码代理仍采用基于消息的…
一篇新论文提出具有多并行流的LLM,以克服编码代理和聊天模型中基于单流消息交互的瓶颈,实现同时阅读、写作和推理。
@rohanpaul_ai: 阿里巴巴字节跳动的新论文表明,AI代理不能再像普通LLM请求那样提供服务。因为大部分的th…
这篇论文介绍了AgentSysBench,并发现模型推理在AI代理系统中往往不是主要瓶颈,从而提出了通过同时调度模型、工具、内存和通信来优化服务系统的建议。
@_avichawla: https://x.com/_avichawla/status/2063548691353629040
阐述了传统后端如何增加AI代理的token使用量,并展示了一种上下文工程方法,该方法无需更改模型或提示词即可将Claude Code会话成本降低2.5倍。
@yoheinakajima: 更多人现在正在尝试这种通过共享状态进行通信的智能体方法(而非彼此对话)
Azalia Mirhoseini 强调 DeLM,一种去中心化语言模型方法,其中智能体通过共享状态通信,在SWE-bench Verified上使用Gemini-3 Flash实现了约10%的提升,且成本不到一半。
子代理在长代理运行中占据大部分Token成本:实际可将使用量降低70%至90%的修复方法
本文分析了 Bai 等人 2026 年的论文,该论文表明,子代理和上下文膨胀导致长代理运行中的Token成本比普通聊天高出约1000倍,并提出了三种实用的修复方法(PLAN.md、读取预算、带外备注),可将Token使用量减少70-90%。