@FinanceYF5: 多智能体不用说话就能协作了 LatentMAS 入选 ICML 2026 Spotlight——Agent 直接在隐空间传递推理状态,跳过文字编解码。 准确率 +13.3%,速度 4.3 倍,token 用量少 83.7%。 不额外训练,…
摘要
LatentMAS 是一种多智能体协作新方法,智能体在隐空间直接传递推理状态,无需文字编解码,实现准确率提升13.3%、速度4.3倍、token用量减少83.7%,无需额外训练即可插入现有LLM,已入选ICML 2026 Spotlight。
查看缓存全文
缓存时间: 2026/06/25 07:15
多智能体不用说话就能协作了 🧠
LatentMAS 入选 ICML 2026 Spotlight——Agent 直接在隐空间传递推理状态,跳过文字编解码。
准确率 +13.3%,速度 4.3 倍,token 用量少 83.7%。
不额外训练,插进现有 LLM 直接用。
这个方向你们觉得会成主流吗? https://t.co/6rc9RAgZHC
相似文章
@FinanceYF5: 论文:
本文介绍了 LatentMAS,一种用于多智能体系统的无需训练框架,使大语言模型智能体能够通过共享潜在工作记忆在连续潜在空间中直接协作,实现了高达 14.6% 的准确率提升和 4 倍的推理速度提升,同时将 Token 使用量减少超过 70%。
@FinanceYF5: 大家都在吹百万token上下文,但Prime Intellect一位工程师说了句大实话: GPT-5.5在256k时检索准确率80%,拉到一百万直接掉到36%。模型不是装不下,是装进去了推理不动——所谓的context rot。 为什么更…
Prime Intellect工程师指出,大语言模型如GPT-5.5在百万token上下文时检索准确率从256k时的80%降至36%,表明存在“context rot”问题,即模型能容纳但无法有效推理长上下文,对Agent应用构成挑战。
@FinanceYF5: 下一 token 预测是短视的。那如果 Transformer 学会预测自己的下一个隐状态呢? Jayden Teoh提出 Next-Latent Prediction(NextLat):一种自监督学习方法,教 Transformer 形…
Jayden Teoh提出Next-Latent Prediction(NextLat),一种自监督学习方法,教Transformer学习预测下一个隐状态,从而形成紧凑的世界模型,用于推理和规划,并通过自推测解码将推理速度提升3.3倍。
@JulieKallini: Fast Byte Latent Transformer 被 ICML 2026 接收!字节级语言模型有望摆脱子词分词器,但解码……
快速字节潜在变换器(BLT-D)已被 ICML 2026 接收,它引入了一种文本扩散方法,用于并行字节级解码,以克服传统字节级语言模型的速度限制。
@MaxForAI: 一个残酷的事实,AI的数学能力已经超过这个世界上99%的人类了。 @MenloVentures 合伙人,曾投资了Anthropic、OpenRouter的Deedy @deedydas 进行了一次测试。 他用刚结束的2026 年国际数学奥…
AI模型Fable、Sol、K3和Axiom在2026年国际数学奥林匹克竞赛中全部取得满分42/42的成绩,首次完全解决了该竞赛,且成本低廉。其中Claude Fable 5速度最快,GPT 5.6 Sol成本最低。