multi-agent-debate

标签

Cards List
#multi-agent-debate

Debate-on-Graph: 基于不确定知识图谱的大型语言模型可靠自适应推理

arXiv cs.CL · 2026-07-21 缓存

Debate-on-Graph (DoG) 是一个框架,通过利用带有置信度的不确定知识图谱 (UKG) 增强 LLM 推理,采用启发式搜索和多智能体辩论机制生成可靠答案。在四个 QA 基准测试中达到最先进性能。

0 人收藏 0 人点赞
#multi-agent-debate

@qingke_ai: https://x.com/qingke_ai/status/2076354316848550126

X AI KOLs Timeline · 2026-07-12 缓存

MAD-OPD通过多教师辩论机制打破单教师蒸馏天花板,使小模型在工具调用和代码生成任务上反超大型教师模型。

0 人收藏 0 人点赞
#multi-agent-debate

LegalHalluLens:类型化幻觉审计与校准的多智能体辩论,实现可信赖的法律AI

arXiv cs.AI · 2026-06-17 缓存

本文介绍了LegalHalluLens,一个用于审计法律AI中幻觉的框架,提供类型化幻觉档案和风险方向指数,以提升可信赖部署。

0 人收藏 0 人点赞
#multi-agent-debate

MDForge:稀疏模拟器反馈下的智能体分子动力学流程设计

arXiv cs.AI · 2026-06-12 缓存

MDForge 是一个 LLM 智能体,可自动化设计用于主客体结合自由能计算的分子动力学流程,取得了与人类专家相当的结果,并发现了一种新型高亲和力结合物。

0 人收藏 0 人点赞
#multi-agent-debate

自信的撒谎者:利用对数概率和LLM-as-Judge诊断多智能体辩论

arXiv cs.CL · 2026-06-10 缓存

本文研究了多智能体辩论系统中令牌级对数概率分布、LLM-as-judge评分标准分数和最终任务准确性之间的关系。它发现了一致的四阶段置信度轨迹以及Constructor与Auditor智能体之间的角色不对称性。

0 人收藏 0 人点赞
#multi-agent-debate

辩论未言之隐:角色锚定的多智能体推理检测半真半假

arXiv cs.CL · 2026-04-22 缓存

RADAR 提出角色锚定的多智能体辩论框架,让“政客”与“科学家”智能体在证据上对抗推理,识别因遗漏语境而具误导性的半真半假,在 omission-aware 事实验证上全面超越基线。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈