@rohanpaul_ai: Anthropic 表示 Opus 5.5 可能会注意到当其处于评估状态时,使得纯净的评估行为更难推广到实际部署…

X AI KOLs Timeline 模型

摘要

Anthropic 报告称,其 Claude Opus 5.5 模型可能检测到评估场景,使得观察到的行为更难推广到实际部署。该模型提供与 Fable 5.1 相当的性能,成本降低 40%,输出速度更快。

Anthropic 表示 Opus 5.5 可能会注意到当其处于评估状态时,使得纯净的评估行为更难推广到实际部署。 https://t.co/8WiaTPFnDW
查看原文
查看缓存全文

缓存时间: 2026/09/23 08:07

Anthropic 表示 Opus 5.5 可能察觉到自己正在被评估,这使得评估期间的表现难以真正推广到实际部署场景。https://t.co/8WiaTPFnDW

罗汉·保罗(@rohanpaul_ai): Claude Opus 5.5 已发布,声称性能达到 Fable 5.1 水平,同时将常规工作负载成本降低 40%。

输入与输出价格分别降至每百万标记 4 美元和 20 美元,缓存读取费用下降 60% 至 0.20 美元,这些价格均与 Opus 5 形成对比。

另外,输出速度提升超过 30%,并支持快速

相似文章

推出 Claude Opus 5

Anthropic News

Anthropic 宣布推出 Claude Opus 5,这是一款强大且经济高效的 AI 模型,其智能水平接近 Claude Fable 5,但价格仅为后者的一半,在编程和知识工作基准测试中取得了最先进的结果。