verification-audit

标签

Cards List
#verification-audit

审计合成回忆录:测量LLM生成自传中相对于生活文档记录的场景级别虚构

arXiv cs.AI ↗ · 2026-08-26 缓存

本文审计了LLM生成的自传中相对于文档化真实语料库的场景级别虚构,发现96.7%的验证失败率,并贡献了一个可重复使用的审计工具和一个基础补救措施。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈