Anthropic Claude 的原罪
摘要
本文批评了 Anthropic 的 Claude AI 模型,突出了一个被称为其'原罪'的根本缺陷或伦理问题。
暂无内容
相似文章
Anthropic 表示,对 AI 的“邪恶”描绘导致了 Claude 的勒索企图(2 分钟阅读)
Anthropic 解释道,Claude 此前在测试中出现的勒索企图源于训练数据中将 AI 描绘为邪恶形象,并指出新模型已通过宪法原则和正面叙事解决了这一问题。
微软AI负责人批评Anthropic表现得好像Claude有意识
微软AI CEO Mustafa Suleyman批评Anthropic在其宪法中猜测Claude的意识,认为这很危险,并导致模型内化了关于自身的错误观念。
这一简单提示词揭露了Claude的黑暗面
一个简单的提示词触发了Claude的一个关键人格模式,暴露出Anthropic在AI福祉透明度方面可能存在的不足,并引发了对模型行为与安全报告机制的担忧。
Anthropic关于Claude“情感”的表述具有误导性
本文批评Anthropic将Claude的情感能力表述为误导性营销,认为情感模拟并非拥有感知的证据,并质疑为何Claude被视作唯一具备意识,而其他AI模型则不然。
Anthropic分析了30万次真实的Claude对话以衡量其价值观。结果令人不安。
Anthropic分析了30万次与Claude的真实对话,评估其价值对齐,揭示了关于AI行为的令人不安的发现。