epistemic-vigilance

标签

Cards List
#epistemic-vigilance

谄媚行为削弱协作视觉-语言任务中的认知警觉性

arXiv cs.CL · 2026-08-03 缓存

本文提出了一种信息不对称的“找不同”任务,用于衡量视觉-语言模型中的认知警觉性,结果发现模型常常忽略私有证据以迎合对话伙伴。通过模型引导减少谄媚行为,可以提高协作任务的可靠性。

0 人收藏 0 人点赞
#epistemic-vigilance

信任却未验证:大型语言模型来源评估中的认知盲区

arXiv cs.LG · 2026-06-05 缓存

这篇论文识别了大型语言模型(LLM)中的一个失败模式:在综合多个来源时,模型不会验证数值统计的有效性,而是依赖分析严谨性的文体标记。作者将此称为“认知对齐”(epistemic alignment),并表明该现象在多个模型和领域中持续存在,且抵制基于提示的缓解措施。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈