虽然 Claude 和 GPT 仍是最佳的两个选择,但 Gemini 似乎正凭借 agy-cli 在编码智能体榜单上赶上来

Reddit r/singularity 新闻

摘要

Artificial Analysis 新发布的 Coding Agent Index 显示,Claude Code 中的 Claude Sonnet 5.5 以 68 分领先,但 Gemini 4 Argon 在 Antigravity CLI 中(64 分)以不到一半的成本紧随其后,而 GPT-6.1 Sol 在 Codex 中得分 63,每项任务成本仅 1.04 美元。

Artificial Analysis Coding Agent Index 从三个智能体编码评测维度对智能体(模型与运行框架的组合)进行评分。➤ Claude Sonnet 5.5(max)在 Claude Code 中以 68 分位居榜首,但其单任务成本也最高:14.19 美元 ➤ Gemini 4 Argon(high)在 Antigravity CLI 中得分 64,单任务成本为 5.84 美元——不到 Sonnet 5.5 成本的一半。注意,这里使用的是 Google 的促销定价,且 Argon 尚未公开发布 ➤ GPT-6.1 Sol(xhigh)在 Codex 中得分 63,成本为 1.04 美元,大约是 Argon 成本的六分之一
查看原文

相似文章

ChatGPT vs Claude vs Gemini:你该如何选择?

Reddit r/ArtificialInteligence

一位用户制作了一份对比 ChatGPT、Claude 和 Gemini 的速查表,建议 Claude 用于深度写作,ChatGPT 作为通用工具,Gemini 适合 Google 集成,并邀请常用用户反馈。