标签
一个名为Academic-AI-Literature-Reviewer-Ollama的本地AI管道,能够生成完全引用APA 7格式的文献综述,其验证层通过将引文与源PDF匹配来防止引用伪造。
一位作者分享了对其AI事实核查工具引用的审计,发现大约每18个中就有1个是失效或捏造的,并提供了实用修复方法来提高AI系统的可靠性。
本文评估了大型语言模型在法律文件中验证引用支持的能力,发现虽然模型能有效检测错误案件的引用,但在精确页码引用上存在困难,常常混淆主题相关性和精确支持。
Chamber是一个本地优先的命令行工具,通过从不向模型暴露文档ID来防止AI引用捏造,然后通过哈希验证引用的段落。它支持任何兼容OpenAI的端点,并且无需配置、数据库或网络即可运行。
本文对8个用于深度研究系统中引用质量的LLM评估器进行了基准测试,发现较便宜的模型在来源相关性和事实支持方面仍与前沿模型竞争,但在方向偏差上有所不同,这对强化学习训练很重要。
Academic Research Skills 是首个可安装的 Claude Code 工作流,它封装了一个多智能体管线,用于检测和防止学术论文中的幻觉引用,解决了2025年预印本中统计到的146,932个幻觉引用问题。
Hyperresearch是一个深度研究工具,通过16步流程增强Claude Code,生成带有来源出处的验证报告,在DeepResearch-Bench排行榜中领先。