将1200年历史的伊斯兰圣训验证方法改编为多智能体AI系统的信任框架
摘要
作者将古典伊斯兰圣训验证方法改编为多智能体AI系统的信任框架,并以论文和Python包(isnad)的形式发布。
当一个多智能体AI系统回答你时,这个回答已经经过了多个“环节”——抓取器、输入模型、合成模型。每个环节都可能扭曲或生成内容。当前工具会记录发生了什么,但没有任何工具能够评价是谁转化了一个主张,或者结果的可信度有多高。古典伊斯兰圣训研究花费了大约1200年时间解决一个结构上完全相同的问题:是否信任通过人类叙述者链条传递的知识。他们的解决方案是:给每个传送者打分,根据链条最薄弱的环节评判整条链,要求独立的佐证,并分别批评内容和链条——这惊人地清晰地映射到AI流水线上。所以我构建了它:一个框架、一篇论文(含DOI)和一个Python包(pip install isnad)。我正在公开开发,并诚实地说明哪些是经过验证的,哪些仍处于实验阶段。初步结果显示核心评分机制有效,但完整流水线的验证仍在进行中。我是一名独立研究者,因此非常欢迎批评指正!https://doi.org/10.5281/zenodo.21211291
相似文章
ISNAD:一种面向多智能体LLMs的声明级溯源框架,用于对“叙述者”(智能体/模型/爬虫)进行分级,改编自经典圣训传承学
ISNAD引入了一种面向多智能体LLMs的声明级溯源框架,受经典圣训传承学启发,对叙述者(智能体、模型、爬虫)的可靠性进行分级。
可验证的智能体基础设施:面向主权AI系统的基于证明的授权机制
本文提出了一种分布式信任框架(DTF),用于自主AI代理系统中的可验证、基于证明的授权,通过要求提供理由证明和共识执行来应对以身份为中心的权限所带来的风险。
构建了一个开源工具,用于检测 AI 智能体系统中缺失的验证、重试和错误处理
我们发布了 Trustabl Agent Analyzer,一款开源工具,可扫描 AI 智能体仓库,检测缺失的验证、重试和错误处理,并生成保护隐私的本地报告。
2026年4月9日政策:实践中的可信智能体
Anthropic 发布了一篇研究文章,详细阐述如何在实践中构建可信的 AI 智能体,概述了核心安全原则以及 Claude Code 和 Claude Cowork 等产品实现。
我构建了一个信任引擎,帮助AI智能体逐步实现自主运行
一个开源信任引擎(测试版),帮助AI智能体从引导模式逐步过渡到协同工作再到自主状态,具备决策理由记录和人在回路审批功能,目前正在寻找早期采用者。