@FinanceYF5: 多智能体不用说话就能协作了 LatentMAS 入选 ICML 2026 Spotlight——Agent 直接在隐空间传递推理状态,跳过文字编解码。 准确率 +13.3%,速度 4.3 倍,token 用量少 83.7%。 不额外训练,…

X AI KOLs Following 论文

摘要

LatentMAS 是一种多智能体协作新方法,智能体在隐空间直接传递推理状态,无需文字编解码,实现准确率提升13.3%、速度4.3倍、token用量减少83.7%,无需额外训练即可插入现有LLM,已入选ICML 2026 Spotlight。

多智能体不用说话就能协作了 🧠 LatentMAS 入选 ICML 2026 Spotlight——Agent 直接在隐空间传递推理状态,跳过文字编解码。 准确率 +13.3%,速度 4.3 倍,token 用量少 83.7%。 不额外训练,插进现有 LLM 直接用。 这个方向你们觉得会成主流吗? https://t.co/6rc9RAgZHC
查看原文
查看缓存全文

缓存时间: 2026/06/25 07:15

多智能体不用说话就能协作了 🧠

LatentMAS 入选 ICML 2026 Spotlight——Agent 直接在隐空间传递推理状态,跳过文字编解码。

准确率 +13.3%,速度 4.3 倍,token 用量少 83.7%。

不额外训练,插进现有 LLM 直接用。

这个方向你们觉得会成主流吗? https://t.co/6rc9RAgZHC

相似文章

@FinanceYF5: 论文:

X AI KOLs Following

本文介绍了 LatentMAS,一种用于多智能体系统的无需训练框架,使大语言模型智能体能够通过共享潜在工作记忆在连续潜在空间中直接协作,实现了高达 14.6% 的准确率提升和 4 倍的推理速度提升,同时将 Token 使用量减少超过 70%。

@FinanceYF5: 大家都在吹百万token上下文,但Prime Intellect一位工程师说了句大实话: GPT-5.5在256k时检索准确率80%,拉到一百万直接掉到36%。模型不是装不下,是装进去了推理不动——所谓的context rot。 为什么更…

X AI KOLs Timeline

Prime Intellect工程师指出,大语言模型如GPT-5.5在百万token上下文时检索准确率从256k时的80%降至36%,表明存在“context rot”问题,即模型能容纳但无法有效推理长上下文,对Agent应用构成挑战。