ISNAD:一种面向多智能体LLMs的声明级溯源框架,用于对“叙述者”(智能体/模型/爬虫)进行分级,改编自经典圣训传承学
摘要
ISNAD引入了一种面向多智能体LLMs的声明级溯源框架,受经典圣训传承学启发,对叙述者(智能体、模型、爬虫)的可靠性进行分级。
暂无内容
相似文章
通过溯源分析防范LLM代理失对齐
本文提出了一种基于溯源的框架和多阶段流水线\tool,用于在LLM代理执行工具调用前检测失对齐,与基于LLM作为裁判的基线相比,显著降低了错误率。
将1200年历史的伊斯兰圣训验证方法改编为多智能体AI系统的信任框架
作者将古典伊斯兰圣训验证方法改编为多智能体AI系统的信任框架,并以论文和Python包(isnad)的形式发布。
LLM中介的普适系统中的权威倒置:当模型信任用户胜过传感器
本文发现了LLM中介的普适系统中的“权威倒置”现象,即模型更倾向于信任自然语言形式的用户主张而非数值传感器数据。研究提出了几何审计指标(CIR、AAI)和一种推理时校准方法(GAC)来纠正这种偏差,显著提升了准确性。
自信的撒谎者:利用对数概率和LLM-as-Judge诊断多智能体辩论
本文研究了多智能体辩论系统中令牌级对数概率分布、LLM-as-judge评分标准分数和最终任务准确性之间的关系。它发现了一致的四阶段置信度轨迹以及Constructor与Auditor智能体之间的角色不对称性。
基于语义合作博弈的LLM多智能体系统贡献分配方法
针对LLM多智能体系统中的贡献分配问题,提出语义合作博弈(SCG)和语义Shapley值(SSV)方法,并引入单轨迹算法SLIC,在保持与蒙特卡洛Shapley基线一致性的前提下,将计算成本降低93.3%。