AI建议抑制人们说“我不知道”的意愿,即使建议错误且准确性受到激励

arXiv cs.AI 论文

摘要

本研究论文探讨了AI建议如何降低人们表达不确定性的意愿,即使建议错误且准确性受到激励,从而改变元认知阈值。

arXiv:2607.13562v1 公告类型:新 摘要:知道何时说“我不知道”是人类判断的基础,但AI助手几乎对所有问题都能给出流畅的答案。在五项实验(N=3,132;四项预注册,一项直接重复实验)中,参与者回答难题,并且可以随时拒绝回答。我们设计了问题,使得AI建议是错误的,从而将AI的使用与其准确性分离。仅仅有机会接触AI就几乎消除了参与者暂停判断的意愿,无论建议是被主动请求还是仅仅显示,这一结果都成立。因此,参与者回答了更多问题,但正确率只有没有AI时的三分之一左右,然而他们的信心却几乎翻倍。激励准确性并惩罚不准确性导致参与者减少寻求和遵循AI建议,回答更准确,并更频繁地暂停判断,尽管仍然远低于没有AI时的情况。随着AI建议变得无处不在且未经请求,它们可能不仅仅影响答案的准确性;它们甚至可能改变人们判断自己是否足够了解以回答的元认知阈值。
查看原文
查看缓存全文

缓存时间: 2026/07/16 04:24

# AI建议抑制人们说“我不知道”的意愿,即使建议错误且准确性受到激励

来源:https://arxiv.org/abs/2607.13562  
查看 PDF(https://arxiv.org/pdf/2607.13562)

> **摘要:** 知道何时说“我不知道”是人类判断的基础,但AI助手几乎对所有问题都能给出流利的回答。在五项实验(N = 3,132;四项预注册,一项直接复制)中,参与者回答难题,并始终可以选择不回答。我们精心设计了问题,使得AI建议是错误的,从而将AI的使用与其准确性分离开来。仅仅拥有AI访问权限就几乎完全消除了参与者暂停判断的意愿,无论他们是主动请求建议还是仅仅看到建议。因此,参与者回答了更多问题,但其正确率仅为无法使用AI时的约三分之一——然而他们的自信度却几乎翻倍。激励准确性并惩罚不准确性导致参与者减少寻求和遵循AI建议的行为,回答更准确,并更频繁地暂停判断,尽管仍然远低于无法使用AI时的情况。随着AI建议变得无处不在且不请自来,它们可能不仅仅影响答案的准确性;甚至可能改变人们在决定自己是否足够了解以回答时的元认知阈值。

## 提交历史

来自:Valerio Capraro [查看邮件](https://arxiv.org/show-email/390e95c1/2607.13562) **\[v1\]** 2026年7月15日星期三 08:04:14 UTC(1,513 KB)

相似文章

AI助手是否应该展示其不确定性?

Reddit r/ArtificialInteligence

文章认为AI助手应该清晰地传达不确定性,以防止在关键决策中出现错误信息,但对诸如来源链接或明确免责声明等有效方法提出疑问,而非使用虚假的置信度分数。

最重要的AI失败可能是虚假自信,而非错误答案

Reddit r/ArtificialInteligence

本文认为,最危险的AI失败并非源于错误答案,而是系统基于不完整的数据、过时的上下文或糟糕的假设,以虚假自信行事。这表明AI评估应优先考虑处理不确定性的能力,而非原始智能。

当AI显得“过于自信”

Reddit r/ArtificialInteligence

本文探讨了一种心理现象:用户不信任AI,并非因为它出错,而是因为其肯定语气与用户自身内心的不确定性不匹配,并运用期望违背理论来解释这种摩擦。

AI 自信犯错的程度远超人们想象,不服来辩

Reddit r/ArtificialInteligence

一位用户分享了对 AI 模型的担忧:AI 在数据单薄或含糊不清时,也能以与数据充分时相同的自信呈现结论。文中举了一个例子:一条仅在 200 条评论中出现两次的投诉,被列为头号关注点。文章质疑这是否是一个可通过提示词修复的问题,还是一个需要人工核验的根本性局限。