标签
作者认为帕累托前沿基准测试对普通用户具有误导性,并声称如果按订阅而非 API 价格进行比较(在缓存命中的情况下),使用 Claude Code 20 倍用量的 Opus 5.5 优于所有其他模型。