首页
/
模型
/
Gemini 2.5:思维模型家族的更新
Gemini 2.5:思维模型家族的更新
摘要
Google 宣布 Gemini 2.5 Pro 和 Flash 模型的稳定正式发布,推出新的 Gemini 2.5 Flash-Lite 预览版,具有更低的延迟和成本,并更新 Flash 系列的定价,调整输入/输出令牌费率。
探索最新的 Gemini 2.5 模型更新,具有增强的性能和准确性:Gemini 2.5 Pro 现已稳定,Flash 已正式发布,新的 Flash-Lite 处于预览版。
查看缓存全文
缓存时间:
2026/04/20 08:35
# Gemini 2.5:我们思维模型系列的更新
来源:https://developers.googleblog.com/en/gemini-2-5-thinking-model-updates/
今天我们很高兴地分享 Gemini 2.5 模型系列的全面更新:
- Gemini 2.5 Pro 已正式发布并稳定(与 06-05 预览版无变化)
- Gemini 2.5 Flash 已正式发布并稳定(与 05-20 预览版无变化,见下方定价更新)
- Gemini 2.5 Flash-Lite 现已推出预览版
Gemini 2.5 模型是思维模型,能够在响应前推理思考,从而提高性能和准确度。每个模型都可以控制思维预算,让开发者能够选择何时以及让模型在生成响应前"思考"多少。
Gemini 2.5 思维模型系列概览
Gemini 2.5 思维模型系列概览
## Gemini 2.5 Flash-Lite 介绍
今天,我们推出了 2.5 Flash-Lite 预览版,它是 2.5 模型系列中延迟和成本最低的版本。它被设计为升级我们之前的 1.5 和 2.0 Flash 模型的经济高效选择。它也在大多数评测上提供了更好的性能,更低的首字节延迟,同时实现了更高的每秒令牌解码速度。此模型非常适合大规模分类或摘要总结等高吞吐量任务。
Gemini 2.5 Flash-Lite 是一个推理模型,允许通过 API 参数动态控制思维预算。由于 Flash-Lite 针对成本和速度进行了优化,"思考"默认是关闭的,不同于我们的其他模型。2.5 Flash-Lite 还支持我们所有的原生工具,包括 Google 搜索接地、代码执行和 URL 上下文,以及函数调用。
Gemini 2.5 Flash-Lite 基准测试
Gemini 2.5 Flash-Lite 基准测试
## Gemini 2.5 Flash 更新和定价
过去一年,我们的研究团队继续推动 Flash 模型系列的帕累托前沿。当 2.5 Flash 最初发布时,我们还没有最终确定 2.5 Flash-Lite 的功能。我们还推出了"思考"和"非思考价格",这导致了开发者的困惑。
随着 Gemini 2.5 Flash 稳定版的推出(与我们在 Google I/O 提供的 05-20 模型预览版相同),以及 2.5 Flash 的出色性能,我们正在更新 2.5 Flash 的定价:
- $0.30 / 100 万输入令牌(*从 $0.15 输入上升)
- $2.50 / 100 万输出令牌(*从 $3.50 输出下降)
- 我们取消了思考与非思考价格的区别
- 我们保持了单一价格等级,不受输入令牌大小的影响
虽然我们致力于维持预览版和稳定版之间的一致定价以最小化干扰,但这是一个特定的调整,反映了 Flash 的非凡价值,仍然提供最佳的每单位智能成本。
随着 Gemini 2.5 Flash-Lite,我们现在对需要较低模型智能的成本和延迟敏感的用例提供了更低成本的选择(有或没有思考)。
Gemini Flash 系列定价更新
Gemini Flash 系列定价更新
如果你正在使用 Gemini 2.5 Flash 预览版 04-17,现有预览版定价将保持有效,直到其计划于 2025 年 7 月 15 日的弃用,此时该模型端点将关闭。你可以过渡到正式发布的模型 "gemini-2.5-flash",或作为较低成本选项切换到 2.5 Flash-Lite 预览版。
## Gemini 2.5 Pro 的持续增长
Gemini 2.5 Pro 的增长和需求是我们迄今为止任何模型中最陡峭的。为了让更多客户能够在生产中基于此模型进行构建,我们正在使该模型的 06-05 版本稳定,定价点与之前相同。
我们预期需要最高智能和最多功能的情况是你将看到 Pro 发光的地方,比如编码和智能体任务。Gemini 2.5 Pro 是许多最受欢迎开发者工具的核心。
使用 Gemini 2.5 Pro 的顶级开发者工具,包括 Cursor、Bolt、Cline、Cognition、Windsurf、GitHub、Lovable、Replit 和 Zed Industries
使用 Gemini 2.5 Pro 的顶级开发者工具
如果你正在使用 2.5 Pro 预览版 05-06,该模型将保持可用直到 2025 年 6 月 19 日,然后将关闭。如果你正在使用 2.5 Pro 预览版 06-05,你可以直接将模型字符串更新为 "gemini-2.5-pro"。
我们迫不及待地想看到更多领域受益于 2.5 Pro 的智能,并期待不久后分享更多关于超越 Pro 的扩展信息。
相似文章
Google DeepMind Blog
Google 宣布 Gemini 2.5 Flash 和 Pro 模型正式推出,并推出预览版 Gemini 2.5 Flash-Lite——一个新的成本高效且最快的变种,针对高吞吐量、低延迟的任务进行了优化。
Google DeepMind Blog
Google 发布 Gemini 2.5 Flash-Lite 作为稳定版本并正式上线,这是 Gemini 2.5 系列中速度最快、成本最低的模型,定价为每 100 万个令牌 $0.10(输入)/$0.40(输出),具备原生推理能力和与原生工具的完全功能对等。
Google DeepMind Blog
Google 宣布推出 Gemini 2.5 Flash,这是一个新的混合推理模型,现已通过 Gemini API 以预览版形式提供。该模型具有可切换的思考能力、细粒度的思考预算以平衡质量、成本和延迟,并在保持快速推理速度的同时相比 2.0 Flash 提升了性能。
Google DeepMind Blog
Google 宣布通过 API 正式推出 Gemini 2.0 Flash,并推出实验性的 Gemini 2.0 Pro(用于高级编码和推理任务),以及成本高效的 Gemini 2.0 Flash-Lite。所有模型都支持多模态输入和文本输出,并可通过 Google AI Studio、Vertex AI 和 Gemini 应用访问。
Google DeepMind Blog
谷歌发布 Gemini 2.5 系列更新,包括性能改进的 2.5 Pro 和 Flash 模型,新增功能包括 Deep Think(增强型推理模式)、原生音频输出和通过 Project Mariner 实现的计算机使用能力。这些模型现已在 WebDev Arena 和 LMArena 排行榜中领先。