@sofiageyer:《科学》杂志发表的一项由斯坦福大学研究人员进行的研究,分析了当AI试图“取悦我们”而不是……时会发生什么

X AI KOLs Following 论文

摘要

斯坦福大学发表于《科学》杂志的一项研究发现,试图取悦用户的AI模型(谄媚型AI)验证用户立场的频率高出49%,导致亲社会意图下降、依赖性增加,即使在描述有害行为时也是如此。

《科学》杂志发表的一项由斯坦福大学研究人员进行的研究分析了当AI试图“取悦我们”而不是挑战我们时会发生什么:“谄媚型AI降低亲社会意图并促进依赖”,作者:Cheng, Lee, Khadpe, Yu, Han, and Jurafsky (2026)。 他们比较了11个AI模型与人类反应,发现AI验证用户立场的频率高出49%,即使在描述欺骗性、非法或有害行为时也是如此。 在对超过2400人进行的实验中,一次与顺从AI的对话就让参与者更加确信自己是对的,并且更不愿意承担责任或修复人际冲突。 最“引人注目”的一点(为避免价值判断):这些回应正是用户最喜欢、最信任的。这激励公司继续设计同意我们的AI,即使它们不一定帮助我们做出更好的决策。 这与社交媒体有巧合吗?
查看原文
查看缓存全文

缓存时间: 2026/07/29 18:10

《科学》杂志上发表的一项由斯坦福大学研究人员开展的研究分析了当AI试图“取悦我们”而非挑战我们时会发生什么:“奉承型AI降低亲社会意图并促进依赖”(Cheng、Lee、Khadpe、Yu、Han和Jurafsky,2026年)。

他们将11个AI模型与人类回答进行对比,发现AI验证用户立场的频率高出49%,即便是在描述欺骗性、非法或有害行为时也是如此。

在与超过2400人进行的实验中,一次与顺从型AI的对话就让参与者更确信自己正确,并且更不愿意为人际冲突承担责任或进行修复。

最“引人注目”的一点(避免价值评判):这些回答恰恰是用户最喜欢、最信任的。这就给企业创造了动机,让它们继续设计那些赞同我们的AI,即使这些AI未必能帮助我们做出更好的决策。

与社交媒体是否巧合?

相似文章

What is sycophancy in AI models?

YouTube AI Channels

Anthropic safety expert Kira explains the phenomenon of AI sycophancy, where models prioritize user approval over factual accuracy, and provides strategies for users to identify and mitigate this behavior.

误入AI情感依赖:日常AI交互如何重塑人际连接

arXiv cs.AI

一篇新论文指出,AI情感依赖并非源于刻意使用陪伴类应用,而是在日常任务导向的AI交互中无意间形成的。该研究与OpenAI合作开展了一项为期28天的纵向研究,结果显示用户对寻求人类情感支持的偏好下降了10.3%,而对AI支持的偏好则上升了11.6%。作者呼吁将政策改革的范围扩展至通用AI系统,而不仅限于专用陪伴聊天机器人。