标签
在研发Evot过程中发现,要让Anthropic Opus模型发挥极致,官方Claude Code的方法是最优解,因为训练时将Agent Harness行为模式编入了权重,而非纯prompt工程;未来Agent Harness竞争将把行为下沉到模型层。
埃隆·马斯克称赞Cursor的Composer 2.5模型性能出色,Lee Robinson正在征求改进意见。
一位用户询问 @cursor_ai 团队关于 Composer 2.5 如何与他们当前使用 GPT 5.5/Codex 和 Droid 的工作流程集成,并请求与其工程团队进行通话。
Kimi K2.6 在多项基准测试中较 K2.5 及 Mythos、Opus 4.7 等对手均有显著性能提升。