虽然 Claude 和 GPT 仍是最佳的两个选择,但 Gemini 似乎正凭借 agy-cli 在编码智能体榜单上赶上来
摘要
Artificial Analysis 新发布的 Coding Agent Index 显示,Claude Code 中的 Claude Sonnet 5.5 以 68 分领先,但 Gemini 4 Argon 在 Antigravity CLI 中(64 分)以不到一半的成本紧随其后,而 GPT-6.1 Sol 在 Codex 中得分 63,每项任务成本仅 1.04 美元。
Artificial Analysis Coding Agent Index 从三个智能体编码评测维度对智能体(模型与运行框架的组合)进行评分。➤ Claude Sonnet 5.5(max)在 Claude Code 中以 68 分位居榜首,但其单任务成本也最高:14.19 美元 ➤ Gemini 4 Argon(high)在 Antigravity CLI 中得分 64,单任务成本为 5.84 美元——不到 Sonnet 5.5 成本的一半。注意,这里使用的是 Google 的促销定价,且 Argon 尚未公开发布 ➤ GPT-6.1 Sol(xhigh)在 Codex 中得分 63,成本为 1.04 美元,大约是 Argon 成本的六分之一
相似文章
剩下哪些最好的10到20美元编程AI助手?
讨论在每月10-20美元价位的最佳AI编程助手,指出Claude和ChatGPT现在比早期版本更受限且降级,Gemini则是当前的竞争者。
ChatGPT vs Claude vs Gemini:你该如何选择?
一位用户制作了一份对比 ChatGPT、Claude 和 Gemini 的速查表,建议 Claude 用于深度写作,ChatGPT 作为通用工具,Gemini 适合 Google 集成,并邀请常用用户反馈。
Anthropic发布Claude Sonnet 5,以更低成本运行AI代理
Anthropic发布了Claude Sonnet 5,这是一款更强大、更具成本效益的智能代理模型,与OpenAI的GPT-5.6 Sol和Google的Gemini 3.5 Flash竞争,提供更强的自主性和更低的价格。
在同一仓库中运行 Claude Code、Codex 和 Gemini CLI 作为编码代理一周——它们各自的薄弱环节。
一位开发者在一周内对比了 Claude Code、Codex 和 Gemini CLI 三种编码代理,指出了它们在上下文处理、精确度和上下文大小方面的优势,以及在成本、模糊处理能力和一致性方面的不足。
Gemini 4 在编程方面并非顶尖,但在其他 AI 生产力榜单上表现出色
一项榜单分析显示,Gemini 4 在编程任务中的排名较低,但在其他 AI 生产力基准测试中表现强劲,凸显了其在代码生成之外的更广泛能力。