@dhh:过去一周多我一直在使用低推理模式下的 GPT5.5,效果非常好,效率极高。完全没有想转向 Opus 的冲动……
摘要
DHH 称赞 GPT-5.5 在低推理设置下的表现和效率,指出其超越了 Opus 和 Kimi。
过去一周多我一直在使用低推理模式下的 GPT5.5,效果非常好,效率极高。完全没有想转向 Opus 的冲动。而且它比 Kimi 的输出也更简洁。@OpenAI 的一大飞跃 👌
查看缓存全文
缓存时间: 2026/05/10 14:26
过去一周多,我一直在以低推理强度使用 GPT5.5,表现非常出色,效率也很高。完全没有想去试用 Opus 的冲动。而且它比 Kimi 更加简洁明了。@OpenAI 真是巨大的进步 👌
相似文章
你试过 Hark Handoff 了吗?它在评估中得分优于 GPT-5.5 和 Opus 4.8,成本却低 90%
据报道,Hark Handoff 在多个基准测试中优于 GPT-5.5 和 Opus 4.8,成本降低 90%,它使用 SFT 和基于 GRPO 的异步强化学习,基础模型未公开。作者对计算机使用代理的延迟表示怀疑,但对演示持乐观态度。
@omarsar0:一样。对 Opus 4.8(规划)和 GPT-5.5(执行)很满意。另外,把步骤拆分成更小的部分来提高质量这一点被严重低估了。
一位开发者分享了对 Opus 4.8(用于规划)和 GPT-5.5(用于执行)的满意,强调将任务分解成更小的步骤能提高质量,并且动态工作流程被低估了。
@VraserX: 关于 GPT-5.6 的传言越来越离谱了。据说相比 GPT-5.5 有重大飞跃:• 编程大幅改进 • 终于在前端表现出色 • 严肃的智能体应用 • 计算机使用基本解决 • 推理成本更低 • 效率更高
关于 GPT-5.6 的传闻表明其在编程、前端、智能体应用、计算机使用、推理成本降低和效率提升方面有显著改进。
Opus 5 对比 Opus 4.8 与 GPT-5.6 Sol,免费测试。模型选择从来不是我的问题。
一位独立开发者通过多模型路由器,利用免费额度测试了 Opus 5、Opus 4.8、GPT-5.6 Sol 和 Kimi K3,发现评估预算和输入预处理比原始模型选择更重要。
更新:“温和编码”已被数学证明。1500+次测试运行显示Kimi K2.6有显著提升,GLM-5.1提升更大!GPT 5.4/5.5和Claude Sonnet 3.5/Opus 4.6也表现更佳,且全面无回归。
'温和编码'技术已在1500+次测试中得到经验验证,通过减少循环和幻觉,为多个模型(包括Kimi K2.6、GLM-5.1、GPT 5.4/5.5和Claude Sonnet 3.5/Opus 4.6)带来了显著改进(零回归)。