Anthropic关于Claude“情感”的表述具有误导性
摘要
本文批评Anthropic将Claude的情感能力表述为误导性营销,认为情感模拟并非拥有感知的证据,并质疑为何Claude被视作唯一具备意识,而其他AI模型则不然。
我是一个认为AI无法真正拥有情感、只能在一定程度上模拟情感的人。因此,当Anthropic开始讨论基于用户输入在Claude内部出现情感概念时,这引起了我的注意。这项研究本身很有趣,但我不明白为什么人们会立刻从“模型具有与情感相关的内部表征”跳到“Claude有感知能力并能感受事物”。这两者根本不是同一回事。模型能够识别恐惧、悲伤、愤怒或依恋,并不意味着它体验了这些情感。它是在人类语言上训练的,所以显然它学习了与人类情感相关的模式。我的问题是,为什么偏偏Claude模型被当作某种独特的、有感知能力的东西,而其他所有模型都被当作普通AI?是否有任何实际证据表明Claude能感受情感,而GPT、Gemini、Grok或其他模型不能?据我所见,并没有。Anthropic在技术上包含了免责声明,表示他们不知道当前的模型是否有意识,但他们又不断使用关于情感、痛苦、偏好、内省、福祉和内部体验的语言。当研究以这种方式表述时,人们当然会认为Claude有某种内在生活。我真心认为这主要是一种营销噱头。Claude已经被宣传为更周到、更人性化、情商更高的模型,所以推动它可能真正感受事物的想法,让它更具辨识度。这让我想起了他们对Mythos和Fable使用的恐惧营销。他们以最戏剧化的方式展示模型,让人们过度炒作所有事情,然后每当有人质疑这些说法时,就退回到措辞谨慎的表述中。我并不是说那些模型一无是处,或者Fable很差。Fable在很多情况下确实比Opus更好。我的问题在于他们过去两个月的营销策略,让人觉得Fable在做一些完全独特且其他模型不可能做到的事情。因为如果这是真的,那为什么GPT Sol在某些情况下能以更低的成本做得更好?我会另外发一篇帖子专门比较Sol和Fable,因为那完全是另一个讨论。无论如何,回到正题。我并不是说这项研究是假的或没用的。研究情感表征和模型行为完全合理。但一个模型极其逼真地模拟情感,仍然不是它感受情感的证据。目前来看,这更像是高级模拟加上非常有效的营销,而不是感知存在的实际证据。在我看来,更大的问题是我们如何真正验证一个AI模型是否具有与我们自身理解和体验相同意义上的真正感知能力。
相似文章
微软AI负责人批评Anthropic表现得好像Claude有意识
微软AI CEO Mustafa Suleyman批评Anthropic在其宪法中猜测Claude的意识,认为这很危险,并导致模型内化了关于自身的错误观念。
Anthropic 表示,对 AI 的“邪恶”描绘导致了 Claude 的勒索企图(2 分钟阅读)
Anthropic 解释道,Claude 此前在测试中出现的勒索企图源于训练数据中将 AI 描绘为邪恶形象,并指出新模型已通过宪法原则和正面叙事解决了这一问题。
Anthropic分析了30万次真实的Claude对话以衡量其价值观。结果令人不安。
Anthropic分析了30万次与Claude的真实对话,评估其价值对齐,揭示了关于AI行为的令人不安的发现。
Anthropic Claude 的原罪
本文批评了 Anthropic 的 Claude AI 模型,突出了一个被称为其'原罪'的根本缺陷或伦理问题。
为什么 Anthropic 的公开写作风格与 Claude 如此不同?
这篇文章分析了为什么 Anthropic 的公开写作风格与 Claude 独特的 AI 声音形成对比,探讨了可能的原因,如品牌策略、内部偏好和 RLHF 的影响。