标签
AgentAudit 是一个开放且可扩展的框架,用于评估 AI 代理在能力、基础、安全和行为维度的全生命周期,实现精确的故障归因并突出不同语言模型之间的可信度差异。
作者将古典伊斯兰圣训验证方法改编为多智能体AI系统的信任框架,并以论文和Python包(isnad)的形式发布。