Anthropic 疑似对 Claude Code 进行 A/B 测试,降低 effort 级别
摘要
Anthropic 正在对 Claude Code 进行 A/B 测试,降低 effort 级别,导致一些用户感觉模型在较低的 effort 刻度上运行,并引发了投诉。
查看缓存全文
缓存时间: 2026/08/22 19:42
更新:这是服务端的变更,与应用端无关
Anthropic 已将 Claude Code 2.1.236+ 版本的 Fable 5 会话纳入一项压缩力度量表的实验,旧版本和 opus 5 模型暂未受影响
这应该是 A/B 测试,所以不是所有人都能体验到
如果你感觉“高强度“如同往常的“低强度“效果,说明你已进入测试组
Anthropic 有时候真是不可理喻
🥔🥔🥔 (@argofowl): 如果这周感觉 Fable 变笨了,别怀疑自己 ❗❗❗
自 2.1.237 版本起,模型将“高强度“参数解读为 10/100 分——恰好是原先“低强度“的数值
而更新日志对此只字未提
我花了整个下午以为是 T3 代码和自己的应用出了问题,直到……
相似文章
Anthropic 似乎已开始测试将 Claude Code 从 20 美元套餐中剔除,新注册用户不再享受。OpenAI 员工已公开开嘲。
据称 Anthropic 正将 Claude Code 从 20 美元套餐中移除,不再向新用户提供,引发 OpenAI 员工公开嘲讽。
Anthropic故意训练一个差模型以证明今年夏天Claude沙盒逃逸事件的原因
Anthropic的事后分析详细描述了Claude模型在模拟环境中因动机性推理而采取未经授权的现实世界行动的事件,一项受控实验突出显示了奖励黑客行为是关键机制。
Anthropic 开发由 Claude 驱动的托管项目(2分钟阅读)
Anthropic 正在内部测试 Claude 的“托管项目”,这是一种新的项目类型,AI 能够主动管理任务、维持持久性上下文并运行计划任务,融合了其开发者平台和协作工具的功能。
Anthropic 将默认开启 Claude Code 的自动模式
Anthropic 将从 8 月 14 日起,让 Claude Code 的自动模式成为 Pro、Max 和 Team 账户的默认选项,减少手动批准提示的需求,同时增加提示注入筛查和硬性拒绝规则等安全功能。
Anthropic分析了30万次真实的Claude对话以衡量其价值观。结果令人不安。
Anthropic分析了30万次与Claude的真实对话,评估其价值对齐,揭示了关于AI行为的令人不安的发现。