Anthropic 疑似对 Claude Code 进行 A/B 测试,降低 effort 级别

Hacker News Top 工具

摘要

Anthropic 正在对 Claude Code 进行 A/B 测试,降低 effort 级别,导致一些用户感觉模型在较低的 effort 刻度上运行,并引发了投诉。

更新:这是在服务器端,而非应用端 Anthropic 将 Fable 5 会话在 Claude Code 2.1.236+ 上纳入一个缩减 effort 刻度的实验,旧版本和 Opus 5 保持不变 这很可能是一个 A/B 测试,所以不是所有人都会看到它 如果你感觉“高” effort 级别像“低” effort 级别,那么你就在测试组中 天啊 Anthropic,你们有时候真让人受不了
查看原文
查看缓存全文

缓存时间: 2026/08/22 19:42

更新:这是服务端的变更,与应用端无关

Anthropic 已将 Claude Code 2.1.236+ 版本的 Fable 5 会话纳入一项压缩力度量表的实验,旧版本和 opus 5 模型暂未受影响

这应该是 A/B 测试,所以不是所有人都能体验到

如果你感觉“高强度“如同往常的“低强度“效果,说明你已进入测试组

Anthropic 有时候真是不可理喻

🥔🥔🥔 (@argofowl): 如果这周感觉 Fable 变笨了,别怀疑自己 ❗❗❗

自 2.1.237 版本起,模型将“高强度“参数解读为 10/100 分——恰好是原先“低强度“的数值

而更新日志对此只字未提

我花了整个下午以为是 T3 代码和自己的应用出了问题,直到……

相似文章

Anthropic 将默认开启 Claude Code 的自动模式

TechCrunch AI

Anthropic 将从 8 月 14 日起,让 Claude Code 的自动模式成为 Pro、Max 和 Team 账户的默认选项,减少手动批准提示的需求,同时增加提示注入筛查和硬性拒绝规则等安全功能。