标签
提出了Causal-Audit框架,该框架通过目标感知因果图构建和路径级证据聚合,实现大语言模型中显式且可审计的因果推理,在多个基准测试上优于现有方法。
FirstResearch 引入了一个结构化框架,用于LLM科学发现代理,该框架生成一份研究问题证书,包含原始定义、假设、机制、可证伪假设和失败更新规则,使得所提出的研究问题在执行前可被审查。使用LLM评估者的初步评估表明,以证书为中心的方法在可审计性和得分方面优于基线系统。