@interjc: Gemini 3.5 Pro 快着点儿吧,我都要把你开除出御三家了

X AI KOLs Timeline 模型

摘要

据泄露的基准测试结果,Gemini 3.5 Pro 在内部评估中性能超过 Claude Fable 5 和 GPT-5.6,零样本性能相比 3.1 Pro 有显著提升,目前处于私下验证测试阶段,即将公开推出。

Gemini 3.5 Pro 快着点儿吧,我都要把你开除出御三家了
查看原文
查看缓存全文

缓存时间: 2026/07/14 18:29

Gemini 3.5 Pro 快着点儿吧,我都要把你开除出御三家了

0xMarioNawfal (@RoundtableSpace): Gemini 3.5 Pro 基准测试泄露刚刚发布,数据令人瞩目。

内部评估中据说超越了 Claude Fable 5 和 GPT-5.6 零样本性能相比 3.1 Pro 显著提升 目前处于私有验证和测试阶段

  • 公开发布

相似文章

@narens:基准测试巅峰

X AI KOLs Following

在Artificial Analysis的分析师代理基准测试中,Gemini 3.7 flash超越了Fable 5、Opus 5和GPT-5.6。

Gemini 3.5 Pro 显然是一场灾难,即将发布

Reddit r/singularity

一位用户批评 Gemini 3.5 Pro,声称它是一场灾难,用户界面糟糕,性能还不如之前的版本,同时猜测它即将发布以及 DeepMind 正在进行重组。