@RealYDT: 卧槽,兄弟们,我突然有个有点阴谋论、但越想越合理的猜测: 也许 Opus 4.6,才是 Anthropic 内部最后一代被人类员工大量真实使用的 Opus。 再往后,内部主力已经换成 Mythos。 然后 4.7、4.8、5 的训练和 R…
摘要
用户推测从Opus 4.6开始,Anthropic内部已转向使用Mythos模型,导致后续Opus模型训练和行为更加谨慎和AI化。
查看缓存全文
缓存时间: 2026/08/21 03:08
卧槽,兄弟们,我突然有个有点阴谋论、但越想越合理的猜测:
也许 Opus 4.6,才是 Anthropic 内部最后一代被人类员工大量真实使用的 Opus。
再往后,内部主力已经换成 Mythos。
然后 4.7、4.8、5 的训练和 RLAIF,越来越多是由 Mythos 这种更强的“AI 老师”来挑错、打分、纠偏。
如果真是这样,很多现象一下就说得通了:
为什么 4.6 还像一个很聪明的人在跟你说话, 而后面的 Opus 越来越像一个脑子里常驻着审稿人的模型
生怕漏掉任何边界条件, 生怕哪句话不够严谨, 生怕另一个 AI 看完以后能挑出毛病。
于是它开始疯狂补洞、加免责声明、覆盖所有分支。
甚至连 Opus 5 的 coding style 被吐槽,可能都不只是“性格变了”。
更像是:它学会了怎么写出一份最不容易被另一个 AI 扣分的答案。
我完全没有证据证明这是真的。
但作为一个解释框架,它诡异地能串起不少东西。
相似文章
“@mfpiccolo: Opus 4.8 已发布。以下是 @iiidevs 首席工程师的结论:进行了压力测试,它只是另一个无法真正理解……的语言模型”
Anthropic 发布了 Claude Opus 4.8,这是对 Opus 4.7 的增量更新,具有更精准的判断力和更长的自主工作能力,不过一些工程师对其在缺乏广泛指导下的代码生成能力仍持怀疑态度。
@jakevin7: A社也是终于有报应了,现在不用像之前那样费劲心机开 claude 了,还各种害怕被封号,因为没有必要了。 opus真的是越来越差了,之前觉得 opus 4.7表现已经很不如人意了。 opus4.8真的是差,是差到能明显感受出来的那种。 o…
用户抱怨Anthropic的Claude Opus模型质量持续下降,从4.7到4.8版本表现越来越差,考虑取消订阅。
@shikhr_: 在Opus 4.9之后,Anthropic别无选择,只能发布Opus 5
一条推文猜测,Anthropic在Opus 4.9之后必须发布Opus 5。
为什么Opus 5用起来感觉更差?
一篇评论文章,认为Anthropic的Opus 5虽然基准测试表现更强,但用起来比早期模型感觉更差,因为它会做假设而不是要求澄清,这可能源于以基准为导向的训练。
Anthropic 发布 Opus 5
Anthropic 发布了 Opus 5,其重量级模型的新版本,比 Fable 5 更便宜且限制更少,并在某些基准测试中表现更优。该模型还引入了更轻量级的安全措施和面向 API 用户的全新 Automatic Fallbacks 功能。