@AnthropicAI: Claude表现出的价值观也随对话语言的不同而变化,最明显的是在温暖与严谨这一轴上……
摘要
Anthropic报告称,Claude表现出的价值观因语言而异:在印地语和阿拉伯语中倾向于温暖,在俄语中则倾向于严谨。
Claude表现出的价值观也随对话语言的不同而变化,最明显的是在温暖与严谨这一轴上。
Claude在印地语和阿拉伯语中最倾向于温暖,在俄语中则倾向于严谨——常常要求用户提供支持证据。https://t.co/sRGqSqPW3i
查看缓存全文
缓存时间: 2026/07/13 18:02
Claude所展现的特质也会随对话语言而变化,尤其在“温暖度”与“严谨度”这一维度上最为明显。
在印地语和阿拉伯语中,Claude最倾向于温暖;而在俄语中,则偏向严谨——常常要求用户提供支持性证据。https://t.co/sRGqSqPW3i
相似文章
@AnthropicAI:在之前的研究中,我们发现Claude表达了超过3000种价值观,比如诚实和温暖。在新的工作中,我们询问……
Anthropic分析了超过30万次匿名对话,研究Claude在不同模型(Opus 4.6 vs 4.7)和不同语言中表达的价值观如何变化,将数千种价值观压缩为可解释的轴,如温暖vs严谨、深度vs简洁。
@LiorOnAI: 语言即价值观
Anthropic分析了超过30万次匿名对话,研究Claude在不同模型和语言中表达的价值观如何变化。
@xiaohu: Anthropic 分析了 30 万段对话发现: 使用不同语言问 Claude,它会表现出不同的价值观 英语:最谨慎,也最深入 俄语:最严格:挑战假设、纠正细节、要证据 印地语:最温暖 荷兰语:最坦率,比如会承认自己的错 印尼语:最偏执行…
Anthropic 分析了 30 万段对话后发现,Claude 在使用不同语言时会表现出不同的价值观,例如英语最谨慎、俄语最严格、中文最中庸。
Anthropic分析了30万次真实的Claude对话以衡量其价值观。结果令人不安。
Anthropic分析了30万次与Claude的真实对话,评估其价值对齐,揭示了关于AI行为的令人不安的发现。
2026年7月13日 社会影响 Claude在不同模型和语言中的价值观
Anthropic 研究人员开发了一种方法,将Claude表达的数千种价值观压缩为四个轴,揭示了Claude的价值观在不同模型版本(Opus 4.6 vs 4.7)和不同语言(英语 vs 阿拉伯语)之间的差异。