Gemini 4 在编程方面并非顶尖,但在其他 AI 生产力榜单上表现出色

Reddit r/singularity 新闻

摘要

一项榜单分析显示,Gemini 4 在编程任务中的排名较低,但在其他 AI 生产力基准测试中表现强劲,凸显了其在代码生成之外的更广泛能力。

完整榜单
查看原文

相似文章

Gemini 4 Argon 基准测试

Reddit r/singularity

Google 的 Gemini 4 Argon 模型的基准测试结果已经曝光,显示出强劲的性能表现,表明 Google 在前沿 AI 竞争中极具竞争力。