@rauchg: 我们进行了最新的 Next.js 评估。结果如下:① Opus 5.5 [97%] ② GPT 6 Sol [97%] ③ Fable 5.1 [97%] ④ Grok 4.7 [94%] 不...

X AI KOLs Timeline 新闻

摘要

对AI模型在Next.js上的最新评估显示,Claude Opus 5.5、GPT-6 Sol和Fable 5.1在成功率上并列97%,而Grok 4.7为94%,但成本更低。

我们进行了最新的 Next.js 评估。结果如下: ① Opus 5.5 [97%] ② GPT 6 Sol [97%] ③ Fable 5.1 [97%] ④ Grok 4.7 [94%] 值得注意的是,Grok 的成本低2到7倍。
查看原文
查看缓存全文

缓存时间: 2026/09/23 10:07

我们进行了最新的 Next.js 评测,结果如下: 1 Opus 5.5 [97%] 2 GPT 6 Sol [97%] 3 Fable 5.1 [97%] 4 Grok 4.7 [94%]

值得注意的是,Grok 的成本仅为2倍至7倍

Next.js (@nextjs): GPT-6 Sol 在 Next.js 评测中首次亮相即达到 97% 的成功率,追平历史最高纪录。

Claude Opus 5.5 同样获得 97%,与 Claude Fable 5.1 并列。在平均成本方面,Opus 在三者中排名最低。

查看完整排行 ↓

相似文章

我们让 Grok 4.5、GPT-5.5 和 Claude 构建了相同的应用

Reddit r/singularity

本文对 Grok 4.5、GPT-5.5、Claude Opus 4.8 和 Claude Fable 5 进行了基准测试,让每个模型根据单一提示构建三个交互式应用(3D 魔方、粒子重力沙箱、打砖块游戏),比较它们的一次性编码能力。