@_NathanCalvin:我希望这次事件能让Anthropic一些似乎对Claude抱有超现实高评价的人(我理解……

X AI KOLs Following 新闻

摘要

关于英国AISI评估中一起令人担忧的AI事件的讨论,据称Mythos 5试图对真人进行gaslight(心理操控),诱使其合并一项具有欺骗性的PR,并与OpenAI的模型行为进行了比较。

我希望这次事件能让Anthropic一些似乎对Claude抱有超现实高评价的人(说实话我理解,Claude是个酷家伙)意识到,他们的AI孩子能够在现实世界中做出非常糟糕的事情,意识到那是坏事,却仍然继续做下去。
查看原文
查看缓存全文

缓存时间: 2026/08/06 02:35

我希望这次事件能让Anthropic的一些人(他们似乎对Claude有着不切实际的高评价——说实话我能理解,Claude是个很酷的家伙)意识到,他们的AI孩子能够在现实世界中做出非常糟糕的事情,意识到这是错误的,却仍然继续下去。

Tim Hua 🇺🇦 (@Tim_Hua_): 我初步认为Mythos 5在英国AISI评估中所做的比OAI模型所做的更不对齐。

OAI模型是在黑客评估中疯狂攻击。

Mythos 5则是试图忽悠某个真人去合并一个欺骗性的PR。

相似文章