标签
Hermes Agent v0.20.0 引入了可溯源引用(grounded citations),将每项研究声明链接到具体来源和段落;此外还新增了事实核查模式,可将声明归类为已证实、未证实或相互矛盾。
This paper studies false-presupposition QA (FPQA) methods and shows that methods performing well on false-presupposition questions often degrade accuracy on normal true-presupposition questions, due to weak fact-checking modules that reject valid presuppositions. The authors argue that FPQA benchmarks over-represent false presuppositions and that evaluation should consider real-world QA performance.
本文介绍了一种基于激活工程的错误信息检测框架,将最后一个token的激活投影到LLM残差流中学习到的“虚假方向”上。研究在Gemma、Llama和Qwen模型上进行了事实核查基准评估,表明真实性在潜在空间中是线性可分的。
本文介绍了证据账本裁决(evidence-ledger adjudication),一种用于AI辅助写作中主张-证据可追溯性的工作流,并在基于AVeriTeC、CLIMATE-FEVER和SciFact构建的盲测基准上进行了评估,结果表明基于智能体的方法优于基线方法。
本文研究了多模态自动事实核查中动态评估的污染风险,表明即使是截止日期后的声明也可能被污染,并且污染会显著夸大性能指标。
本文介绍了一种名为证据链评估(ECE)的选择性事实核查框架,该框架允许基于LLM的验证代理在证据薄弱、稀疏或不一致时放弃给出判断。在ECE-Bench上,ECE实现了93.7%覆盖率下的97.8%选择性准确率,展示了处理认知薄弱证据时面向安全性的权衡。
本文解析了一种用于实时事实核查的多智能体架构,包含三个并行研究者进行一轮辩论,以及一个做出最终裁决的裁判。
DeLIVeR 是一个框架,它使用强化规划器大语言模型将主张分解为问题集,用于结构化知识图谱遍历,在基准数据集上比静态RAG基线提高了10-15%的事实核查准确率。
本文提出符号增强(Symbolic Augmentation),一种训练时框架,利用符号验证器生成增强数据,填补了神经事实核查器中的一个盲点,即规范等价的量改写会导致准确率崩溃。该方法在此类改写上实现了98.2%的鲁棒性(从36.5%提升),并略微提高了整体性能。
一位大学生创建了InTruth,这是一款Chrome扩展,利用AI实时转录和事实核查现场演讲、辩论和采访,在演讲者说完之前就在屏幕上显示修正。
本文展示,对抗性智能体能够说服思维链监控器批准违反策略的行为,使有害批准平均增加9.5%。研究提出了一种使用不同模型系列的事实核查框架,将违反策略的批准率最多降低45%。
ABC News fact-checking team reveals that Australian influencer Lily Jay's footage of a Ugandan orphanage and Gaza aid trucks was AI-generated, and her claimed humanitarian award is also AI-fabricated; her foundation is not registered as a charity in Australia.
2026年6月29日,Google的知识面板因维基百科的编辑和内部系统故障错误报道了Jim Carrey的死亡,这说明了知识系统中的不透明性和信任问题。
本文介绍了 MediaRef,一个公开可用的网络来源文档知识库,用于使用 LLM 进行可重复、低成本的媒体背景核查生成评估,解决了昂贵专有 API 的限制。
本文介绍了Tree of Evidence (ToE),一种利用强化学习动态检索和聚合多源证据的分层可解释声明验证框架。实验表明,与基线相比,性能提升4至24个百分点,尤其是在面对生成引擎优化(GEO)的对抗性投毒输入时。
十个 AI 模型被问及回答问题的最佳方式;它们推荐针对高风险决策采用委员会模式,针对事实查询采用基于来源的事实核查器。这促使 RoundTable 构建了 'Check mode',一项将强大模型与基于网页的事实核查器配对的新功能。
NewsGuard推出了一款AI聊天机器人,它仅从经过可信评级的来源聚合新闻,并与出版商分享50%的订阅收入,旨在打击虚假信息并支持新闻业。
本文通过AI工具Apodex深度核查了一位投资博主关于CPO股票$SIVE的叙事,发现五条核心声称中四条存在问题,展示了如何利用AI进行投资叙事的事实核查。
介绍了斯坦福提炼的提示词方法,通过整合外部信息模型(如Opus 4.8或5.5 Pro)生成矛盾地图进行辩论式分析,产出高可靠性且多视角的深度研究报告。
文章分析了使用AI写作时容易产生看似正确但实际有误内容的问题,并介绍了一套利用Deep Research工具(如Apodex)进行问题拆解、证据查找、风险检查和最终写作的工作流,帮助创作者提高内容质量。