标签
新的 Code Arena Fullstack 排名评估 AI 模型在全栈 Web 开发任务上的表现;Kimi K3 (Max) 获得第一名,GPT-5.6 Sol 和 Claude Fable 5 紧随其后。
OpenAI的GPT-5.6 Sol模型在Code Arena: Frontend中与Claude Fable 5并列第一,首次登上该榜单榜首,显示出其在代理编码和前端开发上的大幅进步。