source-evaluation

标签

Cards List
#source-evaluation

信任却未验证:大型语言模型来源评估中的认知盲区

arXiv cs.LG · 2026-06-05 缓存

这篇论文识别了大型语言模型(LLM)中的一个失败模式:在综合多个来源时,模型不会验证数值统计的有效性,而是依赖分析严谨性的文体标记。作者将此称为“认知对齐”(epistemic alignment),并表明该现象在多个模型和领域中持续存在,且抵制基于提示的缓解措施。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈