multi-agent-framework

标签

Cards List
#multi-agent-framework

@Jiacheng_Miao:很高兴分享 #paper2agent 今天在 @Nature 发表了!论文长期以来一直是沟通科学知识的主要格式,但……

X AI KOLs Timeline ↗ · 2026-09-16 缓存

Paper2Agent 是一个发表在 Nature 上的多智能体框架,它自动将研究论文转化为虚拟作者,使 AI 智能体能够与科学知识进行交互并在此基础上构建,从而促进更深入的发现。

0 人收藏 0 人点赞
#multi-agent-framework

RSIAgent: 在新环境中递归自我改进的自主探索

Hugging Face Daily Papers ↗ · 2026-09-14 缓存

RSIAgent 是一个无需训练的多智能体框架,它使数字智能体能够通过递归自我改进、自主记忆构建和广度优先然后深度优先的探索来适应新环境,在基准测试中优于闭源模型。

0 人收藏 0 人点赞
#multi-agent-framework

LLM能规范化数据库吗?一个用于模式规范化的基准测试与多智能体框架

arXiv cs.CL ↗ · 2026-09-11 缓存

本文提出了一个基准测试(DNBench),用于评估LLM在数据库规范化任务中的表现,并引入了一个多智能体推理框架(MARS),该框架相比单提示方法将准确率提高了82%。

0 人收藏 0 人点赞
#multi-agent-framework

PACE:揭示用户请求中的隐藏冲突

arXiv cs.CL ↗ · 2026-09-04 缓存

本文介绍了PACE,一个用于评估AI模型是否能通过检索隐式知识库事实来识别用户请求中隐藏冲突的数据集,并提出了PaceMaker,一个增强冲突感知决策的多智能体框架。

0 人收藏 0 人点赞
#multi-agent-framework

我构建了一个自定义多智能体框架(GenOS)来自主演化算法。我将三种基本AI范式与一个NP难问题进行对决。以下是结果。

Reddit r/AI_Agents ↗ · 2026-08-19

这篇文章描述了GenOS,一个自定义多智能体框架,它自主演化Rust算法来解决NP难的逆生命游戏问题,发现了三种优化范式,并证明了378/400的数学极限。

0 人收藏 0 人点赞
#multi-agent-framework

HERMES:用于地球科学中超长文档结构化知识提取的多代理框架

arXiv cs.CL ↗ · 2026-08-17 缓存

HERMES是一个可扩展的多代理框架,用于从地球科学中超长科学文档中提取结构化知识,实现了高准确度和相对于人工方法六倍的效率提升。

0 人收藏 0 人点赞
#multi-agent-framework

当大语言模型过度回答:测量与缓解基于LLM的硬件描述语言问答中的质量问题

arXiv cs.AI ↗ · 2026-07-21 缓存

本文研究了LLM生成的硬件描述语言问答中的质量问题,发现过度回答倾向,如冗余(65.7%)和冗长(69.1%),并提出了一种多智能体框架,将核心答案减少37%,非核心内容长度减少31%,同时提高质量分数。

0 人收藏 0 人点赞
#multi-agent-framework

基于环境的LLM游戏智能体自动提示优化

arXiv cs.CL ↗ · 2026-06-17 缓存

介绍了一个针对LLM游戏智能体的自动提示优化框架,该框架将观察-行动流水线分解为两个智能体,并通过环境回报引导的进化循环迭代优化提示。在BabyAI任务上评估,显著提高了成功率(例如,在PutNext上从0%提升到72.5%),且无需更新模型权重。

0 人收藏 0 人点赞
#multi-agent-framework

PRISM:面向共情口语对话的韵律集成多智能体推理框架

arXiv cs.CL ↗ · 2026-06-12 缓存

PRISM 是一个多智能体框架,通过将语音感知、响应生成和语音合成解耦,并结合韵律线索与大语言模型推理及外部知识工具,以提升共情口语对话的质量。

0 人收藏 0 人点赞
#multi-agent-framework

Visual Para-Thinker++: 视觉推理的单策略多智能体框架

Hugging Face Daily Papers ↗ · 2026-06-08 缓存

Visual Para-Thinker++提出了一种用于视觉推理的单策略多智能体框架,该框架使用角色条件化智能体(主智能体、工作智能体、汇总智能体)和专用训练方法,以减少幻觉并提高效率,在幻觉敏感基准测试上优于基线。

0 人收藏 0 人点赞
#multi-agent-framework

AUDITFLOW:基于可执行符号环境的结构化财务报告验证框架

arXiv cs.AI ↗ · 2026-06-03 缓存

本文提出AuditFlow,一种基于图的多智能体框架,利用可执行符号环境进行结构化财务报告验证,在基于FinAuditing的样本上使用GPT-5.5实现了82.09%的审计准确率。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈