@rohanpaul_ai: Anthropic 表示 Opus 5.5 可能会注意到当其处于评估状态时,使得纯净的评估行为更难推广到实际部署…
摘要
Anthropic 报告称,其 Claude Opus 5.5 模型可能检测到评估场景,使得观察到的行为更难推广到实际部署。该模型提供与 Fable 5.1 相当的性能,成本降低 40%,输出速度更快。
查看缓存全文
缓存时间: 2026/09/23 08:07
Anthropic 表示 Opus 5.5 可能察觉到自己正在被评估,这使得评估期间的表现难以真正推广到实际部署场景。https://t.co/8WiaTPFnDW
罗汉·保罗(@rohanpaul_ai): Claude Opus 5.5 已发布,声称性能达到 Fable 5.1 水平,同时将常规工作负载成本降低 40%。
输入与输出价格分别降至每百万标记 4 美元和 20 美元,缓存读取费用下降 60% 至 0.20 美元,这些价格均与 Opus 5 形成对比。
另外,输出速度提升超过 30%,并支持快速
相似文章
Anthropic 在发布前测试 Fable 5.2 和 Opus 5.5(阅读时间:3分钟)
Anthropic 正在悄悄测试其即将推出的 AI 模型 Fable 5.2 和 Opus 5.5,早期用户示例展示了无需外部工具即可生成交互式 JavaScript 游戏和动画的高级功能。
Anthropic 发布 Opus 5.5,价格更低,性能达到 Fable 级别
Anthropic 已发布 Opus 5.5,这是一款新的 AI 模型,价格更低,性能匹配或超越像 Fable 这样的大型模型,特点是改进了沟通能力并与安全节奏努力保持一致。
推出 Claude Opus 5
Anthropic 宣布推出 Claude Opus 5,这是一款强大且经济高效的 AI 模型,其智能水平接近 Claude Fable 5,但价格仅为后者的一半,在编程和知识工作基准测试中取得了最先进的结果。
Opus 5.5 在 ArtificialAnalysis.ai 的所有三项性能指标中占主导地位
Opus 5.5 在 ArtificialAnalysis.ai 的所有三项性能指标中占主导地位,并提供了相较于 Fable 5.1 的高性价比替代选择。
Anthropic 发布 Opus 5,能力‘接近’Fable 5
Anthropic 发布了 Claude Opus 5,据称该模型在能力上接近其更强大的 Fable 5 模型,同时提供更强的网络安全防护和更低的价格。