@jakevin7: 有个事挺有意思的。 DeepSeek V4 的技术报告,对所有主流大模型做了一轮横评,结论是——Gemini 3.1 Pro 的世界知识是所有模型里最强的。 不是 GPT,不是 Claude,是 Gemini。 但大家用 Gemini 的…

X AI KOLs Following 新闻

摘要

根据DeepSeek V4技术报告对主流大模型的横评,Gemini 3.1 Pro的世界知识被认为最强,但用户普遍觉得不好用,原因是该模型不主动调用搜索工具。

有个事挺有意思的。 DeepSeek V4 的技术报告,对所有主流大模型做了一轮横评,结论是——Gemini 3.1 Pro 的世界知识是所有模型里最强的。 不是 GPT,不是 Claude,是 Gemini。 但大家用 Gemini 的感受普遍是:这玩意好用吗? 问题不在模型本身,在于它极度懒得动。 你要问它最新的新闻,它有搜索工具,但就是不主动用。很多时候你得明确说你去搜一下,它才搜。就像一个博览群书的人,你问他最近发生了什么,他耸耸肩:我没看今天的报纸。 一个世界知识最强的模型,工具懒得调——这才是 Gemini 用起来别扭的真正原因。
查看原文
查看缓存全文

缓存时间: 2026/06/08 05:14

有个事挺有意思的。

DeepSeek V4 的技术报告,对所有主流大模型做了一轮横评,结论是——Gemini 3.1 Pro 的世界知识是所有模型里最强的。

不是 GPT,不是 Claude,是 Gemini。

但大家用 Gemini 的感受普遍是:这玩意好用吗?

问题不在模型本身,在于它极度懒得动。

你要问它最新的新闻,它有搜索工具,但就是不主动用。很多时候你得明确说你去搜一下,它才搜。就像一个博览群书的人,你问他最近发生了什么,他耸耸肩:我没看今天的报纸。

一个世界知识最强的模型,工具懒得调——这才是 Gemini 用起来别扭的真正原因。

相似文章

Open source battle: GLM vs Kimi vs MiMo vs DeepSeek

Reddit r/LocalLLaMA

本文测试了智谱GLM 5.1、月之暗面Kimi K2.6、阶跃星辰MIMO 2.5 Pro和深度求索DeepSeek V4 Pro四个开源中国AI模型在编程任务中的表现,发现GLM在多数任务中整体领先但非绝对,各模型各有优劣。