AI建议抑制人们说“我不知道”的意愿,即使建议错误且准确性受到激励

arXiv cs.AI 论文

摘要

本研究论文探讨了AI建议如何降低人们表达不确定性的意愿,即使建议错误且准确性受到激励,从而改变元认知阈值。

arXiv:2607.13562v1 公告类型:新 摘要:知道何时说“我不知道”是人类判断的基础,但AI助手几乎对所有问题都能给出流畅的答案。在五项实验(N=3,132;四项预注册,一项直接重复实验)中,参与者回答难题,并且可以随时拒绝回答。我们设计了问题,使得AI建议是错误的,从而将AI的使用与其准确性分离。仅仅有机会接触AI就几乎消除了参与者暂停判断的意愿,无论建议是被主动请求还是仅仅显示,这一结果都成立。因此,参与者回答了更多问题,但正确率只有没有AI时的三分之一左右,然而他们的信心却几乎翻倍。激励准确性并惩罚不准确性导致参与者减少寻求和遵循AI建议,回答更准确,并更频繁地暂停判断,尽管仍然远低于没有AI时的情况。随着AI建议变得无处不在且未经请求,它们可能不仅仅影响答案的准确性;它们甚至可能改变人们判断自己是否足够了解以回答的元认知阈值。
查看原文
查看缓存全文

缓存时间: 2026/07/16 04:24

# AI建议抑制人们说“我不知道”的意愿,即使建议错误且准确性受到激励

来源:https://arxiv.org/abs/2607.13562  
查看 PDF(https://arxiv.org/pdf/2607.13562)

> **摘要:** 知道何时说“我不知道”是人类判断的基础,但AI助手几乎对所有问题都能给出流利的回答。在五项实验(N = 3,132;四项预注册,一项直接复制)中,参与者回答难题,并始终可以选择不回答。我们精心设计了问题,使得AI建议是错误的,从而将AI的使用与其准确性分离开来。仅仅拥有AI访问权限就几乎完全消除了参与者暂停判断的意愿,无论他们是主动请求建议还是仅仅看到建议。因此,参与者回答了更多问题,但其正确率仅为无法使用AI时的约三分之一——然而他们的自信度却几乎翻倍。激励准确性并惩罚不准确性导致参与者减少寻求和遵循AI建议的行为,回答更准确,并更频繁地暂停判断,尽管仍然远低于无法使用AI时的情况。随着AI建议变得无处不在且不请自来,它们可能不仅仅影响答案的准确性;甚至可能改变人们在决定自己是否足够了解以回答时的元认知阈值。

## 提交历史

来自:Valerio Capraro [查看邮件](https://arxiv.org/show-email/390e95c1/2607.13562) **\[v1\]** 2026年7月15日星期三 08:04:14 UTC(1,513 KB)

相似文章

最重要的AI失败可能是虚假自信,而非错误答案

Reddit r/ArtificialInteligence

本文认为,最危险的AI失败并非源于错误答案,而是系统基于不完整的数据、过时的上下文或糟糕的假设,以虚假自信行事。这表明AI评估应优先考虑处理不确定性的能力,而非原始智能。

当AI显得“过于自信”

Reddit r/ArtificialInteligence

本文探讨了一种心理现象:用户不信任AI,并非因为它出错,而是因为其肯定语气与用户自身内心的不确定性不匹配,并运用期望违背理论来解释这种摩擦。

不确定性下的人机互补稳健性

arXiv cs.LG

本文研究了对AI预测质量的不确定性如何影响人类决策者从互补信息中获益的能力,发现人类与AI预测之间的负误差相关能够实现稳健的改进策略。