Kimi K3 (Max) 在新的 Code Arena Fullstack 排名中夺得第一,超越 GPT-5.6 Sol(第二)和 Claude Fable 5(第三)
摘要
新的 Code Arena Fullstack 排名评估 AI 模型在全栈 Web 开发任务上的表现;Kimi K3 (Max) 获得第一名,GPT-5.6 Sol 和 Claude Fable 5 紧随其后。
查看缓存全文
缓存时间: 2026/07/28 20:28
Code Arena 现在可以评测全栈能力了!
查看 AI 模型在全栈 Web 开发任务上的整体排名:多步骤推理、工具使用和端到端应用生成。
- Kimi K3 (Max) 位居第一
- GPT 5.6 Sol (xHigh) 排名第二
- Claude Fable 5 排名第三 查看更多评分:http://arena.ai/leaderboard/code/webdev/fullstack…
WebDev AI 排行榜 - 网页开发最佳 AI 模型
来源:https://arena.ai/leaderboard/code/webdev/fullstack 使用条款 (https://arena.ai/terms-of-use) 隐私政策 (https://arena.ai/privacy-policy)
Arena.ai (@arena): Code Arena 刚刚升级,带来了全栈能力 🚀
全新 Fullstack Code Arena 登场。我们正从仅限前端原型,迈向包含数据库、API 密钥和快速部署的全栈开发。构建、迭代、发布真实软件——一切尽在其中
相似文章
KIMI K3 在 arena.ai 上击败 Claude Fable 和 GPT 5.6 sol
据报道,KIMI K3 在 arena.ai 基准测试中表现优于 Claude Fable 和 GPT 5.6。
Kimi K3 在 Frontend Code Arena 基准测试中位列第一
Kimi K3 在 Frontend Code Arena 基准测试中取得最高排名,展现出强大的编码能力。
@FinanceYF5: ArenaAI 表示,OpenAI 的 GPT-5.6 Sol 现在已经并列登顶 Code Arena: Frontend,与 Claude Fable 5 并列第一。 这是 OpenAI 模型第一次登上 Code Arena 榜首,也显…
OpenAI的GPT-5.6 Sol模型在Code Arena: Frontend中与Claude Fable 5并列第一,首次登上该榜单榜首,显示出其在代理编码和前端开发上的大幅进步。
Kimi K3 在 ArtificialAnalysis 上获得第三名,击败了 Claude Opus 4.8
Kimi K3 模型在 ArtificialAnalysis 基准测试中排名第三,超过了 Claude Opus 4.8。
@FinanceYF5: 前几天还在刷屏的Kimi K3,现在被反超了——Claude Opus 5(Max推理)杀进Frontend Code Arena和Text Arena,双双拿下第一。 默认high推理版本也不差,Code Arena排第3仅次于Kimi…
Claude Opus 5(Max推理)在Frontend Code Arena和Text Arena中超越Kimi K3,双双拿下第一,默认high推理版本也表现不俗。