首页
/
模型
/
Gemini 2.5:我们最聪慧的模型进一步升级
Gemini 2.5:我们最聪慧的模型进一步升级
摘要
谷歌发布 Gemini 2.5 系列更新,包括性能改进的 2.5 Pro 和 Flash 模型,新增功能包括 Deep Think(增强型推理模式)、原生音频输出和通过 Project Mariner 实现的计算机使用能力。这些模型现已在 WebDev Arena 和 LMArena 排行榜中领先。
Gemini 2.5 Pro 作为开发者最爱的编码模型继续保持优势,而 2.5 Flash 也在最新更新中获得进一步提升。我们为模型增加了多项新功能,包括 Deep Think(2.5 Pro 的实验性增强推理模式)。
查看缓存全文
缓存时间:
2026/04/20 08:35
# Gemini 2.5:我们最智能的模型变得更强大
来源:https://blog.google/innovation-and-ai/models-and-research/google-deepmind/google-gemini-updates-io-2025/
Gemini 2\.5 Pro 继续深受开发者喜爱,是编码的最佳模型,而 2\.5 Flash 也在新更新中表现得更加出色。我们还为模型带来了新功能,包括 Deep Think,这是为 2\.5 Pro 推出的实验性增强推理模式。
抽象插图:两条明亮的蓝色波浪线在黑色背景前
本文章目录
- [2\.5 Pro 性能表现](#25-pro-性能表现)
- [Deep Think](#deep-think)
- [2\.5 Flash 改进](#25-flash-改进)
- [新的 2\.5 功能](#新的-25-功能)
- [开发者体验](#开发者体验)
3 月份,我们发布了 Gemini 2\.5 Pro,这是我们迄今为止最聪慧的模型,两周前,我们为开发者提前发布了 I/O 更新,让他们能够构建令人印象深刻的网络应用。今天,我们分享更多关于 Gemini 2\.5 模型系列的更新:
- 除了 2\.5 Pro 在学术基准上的出色表现外,它现已成为 WebDev Arena 和 LMArena 排行榜上世界领先的模型,同时在帮助人们学习方面也表现出色。
- 我们为 2\.5 Pro 和 2\.5 Flash 带来了新功能:原生音频输出以提供更自然的对话体验、高级安全防护,以及 Project Mariner 的计算机使用功能。2\.5 Pro 还将通过 Deep Think 变得更加强大,这是一个用于高度复杂数学和编码的实验性增强推理模式。
- 我们继续投资开发者体验,在 Gemini API 和 Vertex AI 中引入思维总结以提高透明度,为 2\.5 Pro 扩展思维预算以提供更多控制权,并在 Gemini API 和 SDK 中添加 MCP 工具支持以访问更多开源工具。
- 2\.5 Flash 现已在 Gemini 应用中向所有人开放,我们将在 6 月初在 Google AI Studio 中向开发者普遍提供更新版本,在 Vertex AI 中向企业提供,之后 2\.5 Pro 也会随之推出。
这项显著进步是 Google 各团队不懈努力的结果,他们致力于改进我们的技术,并安全、负责任地开发和发布这些技术。让我们深入了解。
## 2\.5 Pro 性能表现更好
我们最近更新了 2\.5 Pro,帮助开发者构建更丰富、更具交互性的网络应用。很高兴看到用户和开发者的积极反响,我们继续根据用户反馈进行改进。
除了在学术基准上的强劲表现外,新的 2\.5 Pro 现已领先热门编码排行榜 WebDev Arena,ELO 评分为 1415。它也在 LMArena 的所有排行榜中领先,该榜单评估各个维度上的人类偏好。凭借 100 万令牌的上下文窗口,2\.5 Pro 在长上下文和视频理解性能方面达到了业界最先进水平。
自从融入 LearnLM(我们与教育专家共同开发的模型系列)以来,2\.5 Pro 现已成为学习领域的领先模型。在评估其教学法和有效性的对比评估中,教育工作者和专家在各种场景中都更喜欢 Gemini 2\.5 Pro。而且,它在学习科学的五项原则中的每一项上都超越了顶尖模型,这些原则是构建 AI 学习系统的基础。
欲了解更多信息,请查看我们更新的 Gemini 2\.5 Pro 模型卡和 Gemini 技术页面。
### Deep Think
通过探索 Gemini 思维能力的前沿,我们开始测试一种称为 Deep Think 的增强推理模式,它采用新的研究技术,使模型能够在回应之前考虑多个假设。
2\.5 Pro Deep Think 在 2025 USAMO 上取得了令人印象深刻的成绩,这是目前最难的数学基准之一。它也在 LiveCodeBench 上领先,这是一个用于竞技级编码的困难基准,并在 MMMU 上获得了 84\.0% 的得分,该测试评估多模态推理。
图表演示 Gemini 2\.5 Pro Deep Think 的高级功能
由于我们用 2\.5 Pro DeepThink 定义了前沿,我们花费额外时间进行更多前沿安全评估,并听取安全专家的进一步意见。作为其中的一部分,我们将通过 Gemini API 向受信任的测试者提供它,以获取他们的反馈,然后再广泛提供。
## 更好的 2\.5 Flash
2\.5 Flash 是我们为速度和低成本而设计的最高效的主力模型,现在在许多方面都更好了。它在推理、多模态、代码和长上下文的关键基准上有所改进,同时效率更高,在我们的评估中使用的令牌减少了 20-30%。
图表比较 Gemini 2\.5 Flash 与其他模型
新的 2\.5 Flash 现已在 Google AI Studio 中供开发者预览,在 Vertex AI 中供企业使用,在 Gemini 应用中供所有人使用。在 6 月初,它将正式推出用于生产环境。
欲了解更多信息,请查看我们更新的 Gemini 2\.5 Flash 模型卡和 Gemini 技术页面。
## 新的 Gemini 2\.5 功能
### 原生音频输出和 Live API 改进
今天,Live API 推出了音频-视觉输入和原生音频输出对话的预览版本,这样你可以直接构建对话体验,与更自然、更富表达力的 Gemini 互动。
它还允许用户控制其语调、口音和说话风格。例如,你可以告诉模型在讲故事时使用戏剧性的语音。它还支持工具使用,能够代表你进行搜索。
你可以尝试一组早期功能,包括:
- 情感对话,其中模型检测用户声音中的情感并做出相应回应。
- 主动音频,其中模型将忽略背景对话并知道何时做出回应。
- Live API 中的思维,其中模型利用 Gemini 的思维能力支持更复杂的任务。
我们还为 2\.5 Pro 和 2\.5 Flash 发布了文本转语音的新预览版本。这些是首创的多发言人支持,通过原生音频输出实现两个语音的文本转语音。
与原生音频对话一样,文本转语音是富有表达力的,可以捕捉细微差别,如耳语。它支持 24 种以上的语言,并可以无缝切换。
此文本转语音功能将在今天晚些时候在 Gemini API 中推出。
### 计算机使用
我们将 Project Mariner 的计算机使用功能引入 Gemini API 和 Vertex AI。Automation Anywhere、UiPath、Browserbase、Autotab、The Interaction Company 和 Cartwheel 等公司正在探索其潜力,我们很高兴在今年夏天向开发者更广泛地推出,让他们实验这一功能。
### 更好的安全防护
我们还显著增加了对安全威胁的防护,如间接提示注入。这是当恶意指令被嵌入到 AI 模型检索的数据中时发生的情况。我们的新安全方法显著提高了 Gemini 在工具使用过程中对间接提示注入攻击的防护率,使 Gemini 2\.5 成为迄今为止我们最安全的模型系列。
欲了解更多信息,请阅读我们在安全性、责任和隐私方面的工作,以及我们如何在 Google DeepMind 博客上推进 Gemini 的安全防护。
## 增强的开发者体验
### 思维总结
2\.5 Pro 和 Flash 现在将在 Gemini API 和 Vertex AI 中包含思维总结。思维总结将模型的原始思维组织成清晰的格式,包含标题、关键细节和模型操作信息,如工具使用时机。
我们希望通过以更结构化、更精简的格式展示模型的思维过程,开发者和用户将发现与 Gemini 模型的交互更容易理解和调试。
### 思维预算
我们推出 2\.5 Flash 时配备思维预算,让开发者通过平衡延迟和质量来更好地控制成本。我们也在为 2\.5 Pro 扩展这一功能。这允许你控制模型在回应前用于思考的令牌数量,甚至可以关闭其思维功能。
Gemini 2\.5 Pro 配备预算将在接下来的几周内通用于稳定的生产用途,与我们的通用模型一起推出。
### MCP 支持
我们在 Gemini API 中添加了对模型上下文协议 (MCP) 定义的原生 SDK 支持,以便更轻松地与开源工具集成。我们也在探索部署 MCP 服务器和其他托管工具的方式,让你更轻松地构建代理应用。
我们始终在创新新方法来改进我们的模型和开发者体验,包括使其更高效和更强大,并继续响应开发者反馈,所以请继续提出!我们也继续加大基础研究的广度和深度——推进 Gemini 功能的前沿。更多信息即将推出。
在我们的网站上了解更多关于 Gemini 及其功能的信息。
风格化的 3D 文本 "IO25" 在白色网格背景上以充满活力的渐变色呈现。
## 在你的收件箱中获取更多 Google 故事。
完成。只需再多一步。
检查你的收件箱以确认你的订阅。
你已订阅我们的新闻通讯。
你也可以通过以下方式订阅
相似文章
Google DeepMind Blog
Google推出了Gemini 2.5,这是其最智能的AI模型。Gemini 2.5 Pro Experimental在LMArena基准测试中领先优势显著,并通过改进的思维模型架构展现了增强的推理和编码能力。
Google DeepMind Blog
Google 宣布 Gemini 2.5 Pro 和 Flash 模型的稳定正式发布,推出新的 Gemini 2.5 Flash-Lite 预览版,具有更低的延迟和成本,并更新 Flash 系列的定价,调整输入/输出令牌费率。
Google DeepMind Blog
Google 宣布通过 API 正式推出 Gemini 2.0 Flash,并推出实验性的 Gemini 2.0 Pro(用于高级编码和推理任务),以及成本高效的 Gemini 2.0 Flash-Lite。所有模型都支持多模态输入和文本输出,并可通过 Google AI Studio、Vertex AI 和 Gemini 应用访问。
Google DeepMind Blog
Google 发布 Gemini 3.1 Pro,这是一款升级后的 AI 模型,推理能力大幅提升,可应对复杂任务,现已面向开发者、企业和消费者推出。
Google DeepMind Blog
Google 宣布 Gemini 2.5 Flash 和 Pro 模型正式推出,并推出预览版 Gemini 2.5 Flash-Lite——一个新的成本高效且最快的变种,针对高吞吐量、低延迟的任务进行了优化。