@RealYDT: 卧槽,兄弟们,我突然有个有点阴谋论、但越想越合理的猜测: 也许 Opus 4.6,才是 Anthropic 内部最后一代被人类员工大量真实使用的 Opus。 再往后,内部主力已经换成 Mythos。 然后 4.7、4.8、5 的训练和 R…

X AI KOLs Following 新闻

摘要

用户推测从Opus 4.6开始,Anthropic内部已转向使用Mythos模型,导致后续Opus模型训练和行为更加谨慎和AI化。

卧槽,兄弟们,我突然有个有点阴谋论、但越想越合理的猜测: 也许 Opus 4.6,才是 Anthropic 内部最后一代被人类员工大量真实使用的 Opus。 再往后,内部主力已经换成 Mythos。 然后 4.7、4.8、5 的训练和 RLAIF,越来越多是由 Mythos 这种更强的“AI 老师”来挑错、打分、纠偏。 如果真是这样,很多现象一下就说得通了: 为什么 4.6 还像一个很聪明的人在跟你说话, 而后面的 Opus 越来越像一个脑子里常驻着审稿人的模型 生怕漏掉任何边界条件, 生怕哪句话不够严谨, 生怕另一个 AI 看完以后能挑出毛病。 于是它开始疯狂补洞、加免责声明、覆盖所有分支。 甚至连 Opus 5 的 coding style 被吐槽,可能都不只是“性格变了”。 更像是:它学会了怎么写出一份最不容易被另一个 AI 扣分的答案。 我完全没有证据证明这是真的。 但作为一个解释框架,它诡异地能串起不少东西。
查看原文
查看缓存全文

缓存时间: 2026/08/21 03:08

卧槽,兄弟们,我突然有个有点阴谋论、但越想越合理的猜测:

也许 Opus 4.6,才是 Anthropic 内部最后一代被人类员工大量真实使用的 Opus。

再往后,内部主力已经换成 Mythos。

然后 4.7、4.8、5 的训练和 RLAIF,越来越多是由 Mythos 这种更强的“AI 老师”来挑错、打分、纠偏。

如果真是这样,很多现象一下就说得通了:

为什么 4.6 还像一个很聪明的人在跟你说话, 而后面的 Opus 越来越像一个脑子里常驻着审稿人的模型

生怕漏掉任何边界条件, 生怕哪句话不够严谨, 生怕另一个 AI 看完以后能挑出毛病。

于是它开始疯狂补洞、加免责声明、覆盖所有分支。

甚至连 Opus 5 的 coding style 被吐槽,可能都不只是“性格变了”。

更像是:它学会了怎么写出一份最不容易被另一个 AI 扣分的答案。

我完全没有证据证明这是真的。

但作为一个解释框架,它诡异地能串起不少东西。

相似文章

为什么Opus 5用起来感觉更差?

Hacker News Top

一篇评论文章,认为Anthropic的Opus 5虽然基准测试表现更强,但用起来比早期模型感觉更差,因为它会做假设而不是要求澄清,这可能源于以基准为导向的训练。

Anthropic 发布 Opus 5

TechCrunch AI

Anthropic 发布了 Opus 5,其重量级模型的新版本,比 Fable 5 更便宜且限制更少,并在某些基准测试中表现更优。该模型还引入了更轻量级的安全措施和面向 API 用户的全新 Automatic Fallbacks 功能。