“@mfpiccolo: Opus 4.8 已发布。以下是 @iiidevs 首席工程师的结论:进行了压力测试,它只是另一个无法真正理解……的语言模型”
摘要
Anthropic 发布了 Claude Opus 4.8,这是对 Opus 4.7 的增量更新,具有更精准的判断力和更长的自主工作能力,不过一些工程师对其在缺乏广泛指导下的代码生成能力仍持怀疑态度。
Opus 4.8 已发布。以下是 @iiidevs 首席工程师的结论:
进行了压力测试
它只是另一个语言模型
如果我们不非常彻底地加以利用,它无法真正写出好的代码
https://t.co/6ag1adeBKH
查看缓存全文
缓存时间: 2026/05/29 05:55
Opus 4.8 已发布。以下是 @iiidevs 首席工程师的评价:
做了压力测试 它只是又一个大模型 如果不非常深入地驾驭它,它其实写不好代码
https://t.co/6ag1adeBKH
Claude (@claudeai): 介绍一下 Claude Opus 4.8:它在 Opus 4.7 的基础上,拥有更敏锐的判断力、对自己进步更加坦诚,并且能够独立工作更长时间。
今天可用,价格不变。
相似文章
Opus 4.8 到底怎么回事???
用户对Claude Opus 4.8 AI模型的状态或行为感到困惑,引发讨论。
@FinanceYF5: 官方发布:
Anthropic 发布 Claude Opus 4.8,基于 Opus 4.7 构建,判断更敏锐,独立工作能力更强,价格不变。
Claude Sonnet 5 已发布,与 Opus 4.8 的差距比我预想的要小
Anthropic 发布了 Claude Sonnet 5,其基准测试得分非常接近 Opus 4.8,但价格大幅降低,使其成为代理任务的诱人选择,尽管可能存在实际差距。
推出 Claude Opus 4.6
Anthropic 宣布推出 Claude Opus 4.6,这是其最强大模型的升级版本,旨在提供更好的规划能力、更长的任务记忆以及更高的自主性。
@levie:Claude Opus 5 现已发布,在众多能力上相比 Opus 4.8 有巨大飞跃。在 Box,我们一直在测试…
Claude Opus 5 已发布,在尽职调查、生命科学、法律、技术和医疗保健任务的企业基准测试中,相比 Opus 4.8 显示出显著提升,增益幅度为 12-30%。