@browser_use: 开源权重模型已正式追赶上。我们在BrowserCode中测试了GLM 5.2,得分接近Opus级别,且是迄今为止最便宜的模型……
摘要
开源权重模型已追赶上专有模型,GLM 5.2在浏览器代理任务中以低成本实现了接近Opus级别的得分。其他模型如Minimax M3和Kimi k2.7也显示出显著的改进。
查看缓存全文
缓存时间: 2026/06/20 14:36
开源权重模型正式赶上来了
我们在 BrowserCode 中测试了 GLM 5.2 > 接近 Opus 级别得分 > 至今最便宜的模型
此任务仅花费 $0.18 立即试用 ↓ https://t.co/aR24ZDU1pj
Alexander Yue (@Alezander907): GLM 5.2 对浏览器代理来说是一次巨大提升,得分接近 Opus 级别,超越了 GPT 5.5
Minimax M3 达到 Sonnet 级别得分,输入价格仅 $0.30,是我新的最佳性价比模型(比 Deepseek v4 Pro 更便宜)
Kimi k2.7 相比 k2.6 提升了 +9%,但已被 M3 超越
相似文章
GLM-5.2 是首个在 Terminal-Bench 上突破 80% 的开源权重模型,超越了所有其他开源模型。
GLM-5.2 是首个在 Terminal-Bench 上超过 80% 的开源权重模型,超越了所有其他开源模型乃至 Gemini,使其以极低的成本成为前沿水准的模型。
GLM 5.2 对比 Opus
GLM 5.2 是 Z.ai 推出的全新开放权重模型,与 Claude Opus 在 3D 游戏编码任务中进行了对比。Opus 性能更快更清晰,但 GLM 5.2 在成本和易用性上具有显著优势。
GLM-5.2 刚发布开放权重,在编程方面已经异常强大
GLM-5.2 已以 MIT 许可证发布开放权重,拥有 100 万上下文窗口和两种推理努力模式。早期基准测试显示它在编程任务中表现出色,值得在基准截图之外进行测试。
GLM-5.2 是 Artificial Analysis 上新的领先开源权重模型
智谱AI的GLM-5.2已成为Artificial Analysis Intelligence Index上新的领先开源权重模型,得分为51,超越了MiniMax-M3和DeepSeek V4 Pro等竞争对手。该模型拥有744B总参数、40B活跃参数、MIT许可证和1M上下文窗口。
@browser_use: Opus 4.7 GLM 5.2 我们正在对前端设计进行模型基准测试。我们在 Browser Use v4 上运行每个模型 > 来自……的一个提示
Opus 4.7 和 GLM 5.2 正在使用 Browser Use v4 进行前端设计基准测试;结果通过链接分享。