Gemini 3 开启智能新时代
摘要
Google 发布了其迄今为止最智能的模型 Gemini 3,具备增强的推理能力和多模态功能。该模型现已集成到 Google 各产品中,面向 Ultra 订阅用户的「深度思考」复杂问题求解模式即将推出。
查看缓存全文
缓存时间: 2026/05/08 09:39
# Gemini 3 开启智能新时代
来源:https://blog.google/products-and-platforms/products/gemini/gemini-3/
Gemini 3 是我们最智能的模型,助你实现任何创意。
## 总体摘要
Google 推出 Gemini 3,其最智能的 AI 模型,增强了推理和多模态能力。你现在可以在 Gemini app、AI Studio 和 Vertex AI 等 Google 产品中访问 Gemini 3。Gemini 3 Deep Think 模式即将面向 Ultra 订阅用户推出,更多模型也将陆续发布。
摘要由 Google AI 生成。生成式 AI 仍处于实验阶段。
## 要点速览
- "Gemini 3 开启智能新时代" 介绍了 Google 最新、最智能的 AI 模型。
- Gemini 3 Pro 在推理、多模态和编程基准测试中超越前代模型。
- Gemini 3 Deep Think 模式将智能边界推向更高,应对复杂问题。
- 你可以使用 Gemini 3 学习、构建和规划任何事物,具备更强的推理和工具使用能力。
- Gemini 3 现已登陆多款 Google 产品,Deep Think 即将推出。
摘要由 Google AI 生成。生成式 AI 仍处于实验阶段。
#### 探索其他风格:
Gemini 3 标志,黑色背景前由蓝色点阵组成的数字 3
**本文目录**
- CEO 寄语 (https://blog.google/products-and-platforms/products/gemini/gemini-3/#note-from-ceo)
- Gemini 3 介绍 (https://blog.google/products-and-platforms/products/gemini/gemini-3/#gemini-3)
- Gemini 3 Deep Think (https://blog.google/products-and-platforms/products/gemini/gemini-3/#gemini-3-deep-think)
- 学习任何事物 (https://blog.google/products-and-platforms/products/gemini/gemini-3/#learn-anything)
- 构建任何事物 (https://blog.google/products-and-platforms/products/gemini/gemini-3/#build-anything)
- 规划任何事物 (https://blog.google/products-and-platforms/products/gemini/gemini-3/#plan-anything)
- 负责任开发 (https://blog.google/products-and-platforms/products/gemini/gemini-3/#responsible-development)
您的浏览器不支持音频元素。
收听文章
内容由 Google AI 生成。生成式 AI 仍处于实验阶段
\[\[duration\]\] 分钟
### **Google 与 Alphabet CEO Sundar Pichai 寄语:**
近两年前,我们开启了 Gemini 时代,这是公司有史以来最大的科学和产品项目之一。自那时起,看到人们对它的喜爱令人难以置信。AI Overviews 现在每月拥有 20 亿用户。Gemini app (https://gemini.google.com/app/download/mobile?android-min-version=301356232&ios-min-version=322.0&is_sa=1&campaign_id=&utm_source=seo&utm_medium=blog&utm_campaign=&pt=9008&mt=8&ct=gemini3_blog-seo_boosting&redirect=home) 月活用户突破 6.5 亿,超过 70% 的 Cloud 客户使用我们的 AI,1300 万开发者基于我们的生成式模型进行构建,而这只是我们所见影响的冰山一角。
我们能够以史无前例的速度将先进能力推向世界,这得益于我们差异化的全栈 AI 创新方法——从领先的基础设施到世界一流的研究、模型和工具,再到触达全球数十亿人的产品。
每一代 Gemini 都在前代基础上构建,让你能做更多。Gemini 1 在原生多模态 (https://blog.google/technology/ai/google-gemini-ai/) 和长上下文窗口 (https://blog.google/technology/ai/google-gemini-next-generation-model-february-2024/) 方面取得突破,扩展了可处理的信息类型和数量。Gemini 2 为智能体能力 (https://blog.google/technology/google-deepmind/google-gemini-ai-update-december-2024/#ceo-message) 奠定基础,并在推理和思考 (https://blog.google/technology/google-deepmind/gemini-model-thinking-updates-march-2025/#gemini-2-5-thinking) 方面不断突破,帮助处理更复杂的任务和创意,使 Gemini 2.5 Pro 在 LMArena 榜单上领跑超过六个月。
现在我们推出 Gemini 3,我们最智能的模型,融合 Gemini 的所有能力,助你实现任何创意。
它在推理方面达到顶尖水平,能够把握深度与细微差别——无论是感知创意中的微妙线索,还是剖析复杂问题的重叠层次。Gemini 3 还能更好地理解你请求的背景和意图,让你用更少的提示词获得所需。令人惊讶的是,短短两年内,AI 已从简单的文本和图像识别,进化到能够"读懂氛围"。
从今天开始,我们以 Google 的规模全面推出 Gemini。这包括在 Search 的 AI Mode 中 (http://blog.google/products/search/gemini-3-search-ai-mode) 引入 Gemini 3,具备更复杂的推理和全新的动态体验。这是我们首次在发布首日就将 Gemini 引入 Search。Gemini 3 也于今日上线 Gemini app (https://blog.google/products/gemini/gemini-3-gemini-app)、面向开发者的 AI Studio (https://blog.google/technology/developers/gemini-3-developers) 和 Vertex AI (https://cloud.google.com/blog/products/ai-machine-learning/gemini-3-is-available-for-enterprise),以及我们全新的智能体开发平台 Google Antigravity (http://antigravity.google/)——详见下文。
与前几代一样,Gemini 3 再次推动技术前沿。在这个新篇章中,我们将继续突破智能、智能体和个性化的边界,让 AI 真正为每个人所用。
希望你喜爱 Gemini 3,我们会持续改进,期待看到你用它构建的作品。更多精彩即将呈现!
---
## **Gemini 3 介绍:我们最智能的模型,助你实现任何创意**
*Google DeepMind CEO Demis Hassabis 和 Google DeepMind CTO 兼 Google 首席 AI 架构师 Koray Kavukcuoglu,代表 Gemini 团队*
今天我们在通往 AGI 的道路上又迈出一大步,正式发布 Gemini 3。
它是全球多模态理解最佳模型,也是我们迄今最强大的智能体和氛围编程模型,提供更丰富的可视化和更深度的交互性——全部建立在顶尖推理能力的基础之上。
我们通过预览版发布 Gemini 3 Pro 开启 Gemini 3 时代 (https://deepmind.google/models/gemini/),并于今日在多款 Google 产品中可用,让你可以在日常生活中使用它学习、构建和规划任何事物。我们还推出了 Gemini 3 Deep Think——我们的增强推理模式,将 Gemini 3 性能推向更高——并在向 Google AI Ultra 订阅用户开放前,先向安全测试人员提供访问权限。
## 前所未有的深度与细微差别的顶尖推理
Gemini 3 Pro 凭借顶尖推理和多模态能力,能够将任何创意变为现实。它在所有主要 AI 基准测试中大幅超越 2.5 Pro。
它以突破性的 1501 Elo 分数登顶 LMArena 排行榜。它在 Humanity's Last Exam(不使用任何工具达到 37.5%)和 GPQA Diamond(91.9%)上展现出博士级推理能力。它还在数学领域树立前沿模型新标杆,在 MathArena Apex (https://matharena.ai/?comp=apex--apex_2025) 上达到 23.4% 的新高。
超越文本领域,Gemini 3 Pro 以 MMMU-Pro 81% 和 Video-MMMU 87.6% 的成绩重新定义多模态推理。它还在 SimpleQA Verified 上取得 72.1% 的顶尖成绩,显示出事实准确性方面的重大进步。这意味着 Gemini 3 Pro 在科学、数学等广泛主题上具备高度可靠的复杂问题解决能力。
Gemini 3 Pro 还为每次交互带来前所未有的深度与细微差别。它的回应聪明、简洁、直接,摒弃陈词滥调和奉承,提供真正的洞察——告诉你需要知道的,而非仅仅是你想听的。它充当真正的思想伙伴,为你提供理解信息和表达自我的新方式,从通过生成高保真可视化代码来翻译艰深的科学概念,到创意头脑风暴。
*Gemini 3 可以为托卡马克中的等离子体流编码可视化,并撰写捕捉聚变物理之美的诗歌。*
### Gemini 3 Deep Think
Gemini 3 Deep Think 模式将智能边界推向更高,在推理和多模态理解能力上实现阶跃式提升,帮助你解决更复杂的问题。
在测试中,Gemini 3 Deep Think 在 Humanity's Last Exam(不使用工具达到 41.0%)和 GPQA Diamond(93.8%)上超越了 Gemini 3 Pro 本已令人印象深刻的表现。它还在 ARC-AGI-2 上取得史无前例的 45.1%(使用代码执行,ARC Prize Verified),展现出解决新颖挑战的能力。
Gemini 3 Deep Think 模式在一些最具挑战性的 AI 基准测试中表现卓越。详见我们的评估方法 (http://deepmind.google/models/evals-methodology/gemini-3-pro)。
## Gemini 3 助你学习、构建和规划任何事物
### 学习任何事物
Gemini 从一开始就旨在无缝整合文本、图像、视频、音频和代码等多种模态的任意主题信息。Gemini 3 将多模态推理前沿推向更高,通过结合顶尖推理、视觉和空间理解、领先的多语言性能以及 100 万 token 上下文窗口,以适合你的方式帮助你学习。
例如,如果你想学习家族传统烹饪,Gemini 3 可以破译和翻译不同语言的手写食谱,生成可分享的家族 cookbook。或者如果你想学习新主题,你可以给它学术论文、长视频讲座或教程,它能生成代码制作互动抽认卡、可视化图表或其他格式,帮助你掌握材料。它甚至可以分析你的匹克球比赛视频,识别需要改进的地方,并生成整体动作提升的训练计划。
为了帮助您更好地理解网络信息,Search 中的 AI Mode 现已使用 Gemini 3,实现全新的生成式 UI 体验,如沉浸式视觉布局和交互式工具与模拟,全部根据你的查询实时生成。
### 构建任何事物
在 2.5 Pro 成功的基础上,Gemini 3 兑现了为开发者实现任何创意的承诺。它在零样本生成方面表现出色,能够处理复杂的提示和指令,渲染出更丰富、更具交互性的 Web UI。
Gemini 3 是我们构建的最佳氛围编程和智能体编程模型——让我们的产品更加自主,并提升开发者生产力。它以 1487 Elo 的优异成绩登顶 WebDev Arena 排行榜。它在 Terminal-Bench 2.0 上取得 54.2% 的成绩,该测试评估模型通过终端操作计算机的工具使用能力;在 SWE-bench Verified(76.2%)上大幅超越 2.5 Pro,该基准测试衡量编程智能体。
你现在可以在 Google AI Studio、Vertex AI、Gemini CLI 以及我们全新的智能体开发平台 Google Antigravity 中使用 Gemini 3 进行构建 (https://blog.google/technology/developers/gemini-3-developers)。它也已在 Cursor、GitHub、JetBrains、Manus、Replit 等第三方平台上线。
### 推出全新的智能体优先开发体验
随着 Gemini 3 加速模型智能进化,我们有机会重新构想整个开发者体验。今日我们发布 Google Antigravity (http://antigravity.google/),我们全新的智能体开发平台,让开发者能够在更高、以任务为导向的层级上进行操作。
利用 Gemini 3 的高级推理、工具使用和智能体编程能力,Google Antigravity 将 AI 辅助从开发者工具箱中的工具转变为积极的合作伙伴。虽然 Google Antigravity 的核心是熟悉的 AI IDE 体验,但其智能体已被提升至专用界面,并直接获得编辑器、终端和浏览器的访问权限。现在,智能体可以自主规划和执行复杂的端到端软件任务,同时验证自己的代码。
除 Gemini 3 Pro 外,Google Antigravity 还紧密集成我们最新的 Gemini 2.5 Computer Use 模型用于浏览器控制,以及我们顶级图像编辑模型 Nano Banana(Gemini 2.5 Image)。
*Google Antigravity 使用 Gemini 3 驱动航班追踪应用的端到端智能体工作流。智能体独立规划、编写应用代码,并通过基于浏览器的计算机使用验证其执行。*
### 规划任何事物
自 Gemini 2 开启智能体时代以来,我们取得了长足进步,不仅提升了 Gemini 的编程智能体能力,还增强了其在更长周期内可靠提前规划的能力。Gemini 3 通过在 Vending-Bench 2 (https://andonlabs.com/evals/vending-bench-2) 上登顶排行榜证明了这一点,该测试通过管理模拟自动售货机业务来检验长期规划能力。Gemini 3 Pro 在完整的模拟一年运营中保持稳定的工具使用和决策,带来更高回报且不偏离任务。
Gemini 3 Pro 展现出更优的长期规划能力,相比其他前沿模型产生显著更高的回报。
这意味着 Gemini 3 能更好地帮助你在日常生活中完成事务。通过将更深度的推理与改进后更稳定的工具使用相结合,Gemini 3 可以代表你采取行动,导航更复杂的多步骤工作流——从预订本地服务到整理收件箱——全程在你的控制和指导下进行。
Google AI Ultra 订阅用户今日即可在 Gemini app 中通过 Gemini Agent (https://blog.google/products/gemini/gemini-3-gemini-app) 体验这些智能体能力。我们在改进 Gemini 智能体能力方面学到了很多,期待看到你如何使用它,我们将很快扩展到更多 Google 产品。
## 负责任地构建 Gemini 3
Gemini 3 是我们最安全的模型,经历了 Google AI 模型迄今最全面的安全评估。该模型显示出更低的迎合性、更强的提示注入抵抗力,以及通过网络安全攻击防止滥用的改进保护。
除我们针对前沿安全框架 (https://deepmind.google/discover/blog/strengthening-our-frontier-safety-framework/) 关键领域的内部测试外,我们还与世界顶尖主题专家合作进行评估,向英国 AISI 等机构提供早期访问,并获得 Apollo、Vaultis、Dreadnode 等行业专家的独立评估。更多信息请参阅 Gemini 3 模型卡 (http://deepmind.google/models/model-cards/gemini-3-pro)。
## Gemini 的下一个时代
这只是 Gemini 3 时代的开始。从今日起,Gemini 3 开始逐步推出:
- 面向所有用户在 Gemini app (https://blog.google/products/gemini/gemini-3-gemini-app),以及面向 Google AI Pro 和 Ultra 订阅用户在 Search 的 AI Mode (http://blog.google/products/search/gemini-3-search-ai-mode)
- 面向开发者 (https://blog.google/technology/developers/gemini-3-developers) 在 AI Studio 的 Gemini API、我们全新的智能体开发平台 Google Antigravity;以及 Gemini CLI
- 面向企业 (https://cloud.google.com/blog/products/ai-machine-learning/gemini-3-is-available-for-enterprise) 在 Vertex AI 和 Gemini Enterprise
对于 Gemini 3 Deep Think 模式,我们正在额外花时间进行安全评估并听取安全测试人员的反馈,然后再将其 avai
相似文章
Gemini 3.1 Pro:专为最复杂任务打造的更智能模型
Google 发布 Gemini 3.1 Pro,这是一款升级后的 AI 模型,推理能力大幅提升,可应对复杂任务,现已面向开发者、企业和消费者推出。
开始使用 Gemini 3 构建
Google 发布了 Gemini 3 Pro,这是一款全新的 AI 模型,旨在编程、智能体工作流和多模态推理方面超越之前的版本。该模型可通过 Gemini API、Google AI Studio 以及全新的 Google Antigravity 开发平台使用。
Gemini 3 Deep Think:推动科学、研究与工程进步
Google 发布了 Gemini 3 Deep Think 的重大更新,这是一种专门的推理模式,旨在通过将深厚的科学知识与实际应用相结合,解决科学、研究和工程领域的复杂挑战。
推出 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking
Google 推出 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking,这是一组先进的AI模型,专为实时推理和语音代理设计,在各项基准测试中均取得了最高分。
Gemini 2.5:我们最聪慧的模型进一步升级
谷歌发布 Gemini 2.5 系列更新,包括性能改进的 2.5 Pro 和 Flash 模型,新增功能包括 Deep Think(增强型推理模式)、原生音频输出和通过 Project Mariner 实现的计算机使用能力。这些模型现已在 WebDev Arena 和 LMArena 排行榜中领先。