在 Gemini 应用中尝试 Deep Think

Google DeepMind Blog 产品

摘要

Google 正在为 Gemini 应用中的 Google AI Ultra 订阅者推出 Deep Think,这是一项新的推理能力,采用并行思维技术,在 2025 IMO 基准测试中达到铜牌级性能。完整的金牌级版本正与精选数学家分享用于研究目的。

我们正在为 Gemini 应用中的 Google AI Ultra 订阅者推出 Deep Think,并为精选数学家提供参加 IMO 竞赛的完整版 Gemini 2.5 Deep Think 模型的使用权限。
查看原文
查看缓存全文

缓存时间: 2026/04/20 08:35

# 在 Gemini 应用中尝试 Deep Think 来源:https://blog.google/products-and-platforms/products/gemini/gemini-2-5-deep-think/ 我们正在为 Google AI Ultra 订阅者在 Gemini 应用中推出 Deep Think,并为部分数学家提供了参加国际数学奥林匹克竞赛 (IMO) 的完整版 Gemini 2.5 Deep Think 模型的访问权限。 ## 概览 Google AI Ultra 订阅者现在可以在 Gemini 应用中使用 Deep Think。这个工具使用并行思考来解决复杂问题,在编码和科学发现等领域表现出色。你可以通过在 Gemini 应用的提示栏中切换来访问 Deep Think。 摘要由 Google AI 生成。生成式 AI 仍在测试阶段。 ## Gemini 2.5 Deep Think 今天,我们向 [Google AI Ultra 订阅者](https://one.google.com/about/google-ai-plans/)在 [Gemini 应用](https://gemini.google/)中推出 Deep Think——这是专为他们提供的最新功能之一。 这个新版本采纳了早期受信任测试者的反馈和研究突破。与 [I/O 大会首次发布的版本相比](https://blog.google/technology/google-deepmind/google-gemini-updates-io-2025/#deep-think),这是一次重大改进,表现为关键基准的显著提升和受信任测试者的正面反馈。这是我们最近在今年国际数学奥林匹克竞赛 (IMO) 中 [达到金牌标准](https://deepmind.google/discover/blog/advanced-version-of-gemini-with-deep-think-officially-achieves-gold-medal-standard-at-the-international-mathematical-olympiad/)的模型的变体。虽然该模型需要花费数小时来推理复杂数学问题,但今天发布的版本更快、更易于日常使用,同时根据内部评估,在 2025 年 IMO 基准上仍能达到铜牌级别的性能。 Deep Think 可以成为创意解决问题的强大工具: 当我们将 Deep Think 交到 Google AI Ultra 订阅者手中时,我们还与一小群数学家和学者分享了在 IMO 中 [达到金牌标准](https://deepmind.google/discover/blog/advanced-version-of-gemini-with-deep-think-officially-achieves-gold-medal-standard-at-the-international-mathematical-olympiad/)的官方 Gemini 2.5 Deep Think 模型。我们期待听到它如何增强他们的研究和调查工作,并将利用他们的反馈来继续改进这一产品。 这个版本代表了我们在建立更有帮助和能力更强的 AI 使命中的重大进步,进一步体现了我们致力于使用 Gemini 推动人类知识前沿发展的承诺。 ## Deep Think 的工作原理:扩展 Gemini 的并行"思考时间" 就像人们通过探索不同角度、权衡潜在方案和完善最终答案来解决复杂问题一样,Deep Think 使用并行思考技术推进思考能力的前沿。这种方法让 Gemini 能同时生成许多想法并同时考虑它们,甚至可以随着时间推移修改或组合不同的想法,最终得出最佳答案。 此外,通过扩展推理时间或"思考时间",我们让 Gemini 有更多时间探索不同的假设,并找到复杂问题的创意解决方案。 我们还开发了新颖的强化学习技术,鼓励模型利用这些扩展的推理路径,使 Deep Think 随着时间推移成为更好、更直观的问题解决者。 ## Deep Think 的性能表现:最先进的水平 Deep Think 可以帮助人们解决需要创意、战略规划和分步改进的问题,例如: - **迭代开发和设计:** 我们对 Deep Think 在需要逐段构建复杂内容的任务上的表现印象深刻。例如,我们观察到 Deep Think 可以改进网页开发任务的美观性和功能性。 Gemini 应用中的 Deep Think 使用并行思考技术来提供更详细、更有创意和更周到的响应。 一张对比三个 AI 生成的体素艺术场景的图片。每个图像显示一个花园中的塔楼,有树木和樱花,从左到右展示了越来越多的细节和复杂性。图像标记为"Gemini 2.5 Flash"、"Gemini 2.5 Pro"和"Gemini 2.5 Deep Think"。 - **科学和数学发现:** 由于能够推理高度复杂的问题,Deep Think 可以成为研究人员的强大工具。它可以帮助制定和探索数学猜想,或推理复杂的科学文献,可能加快发现的步伐。 - **算法开发和代码:** Deep Think 特别擅长解决 [困难的编码问题](https://x.com/GoogleDeepMind/status/1925676461651791992),其中问题表述和对权衡与时间复杂度的仔细考虑至关重要。 Deep Think 的性能也体现在测量编码、科学、知识和推理能力的具有挑战性的基准中。例如,与其他不使用工具的模型相比,Gemini 2.5 Deep Think 在 LiveCodeBench V6(测量竞争性代码性能)和 Humanity's Last Exam(测量科学和数学等不同领域的专业知识的具有挑战性的基准)上取得了最先进的性能。 一组四个柱状图,对比 AI 模型性能。Gemini 2.5 在推理、代码和数学基准上超过 Gemini 2.5 Pro、OpenAI O3 和 Grok 4。 ## 我们如何负责任地推进 Gemini 我们继续在整个训练和部署生命周期中构建安全性和责任感到 Gemini 中。在测试中,Gemini 2.5 Deep Think 相比 Gemini 2.5 Pro 展现了改进的内容安全性和语气客观性,但在拒绝善意请求方面的倾向略高。 随着 Gemini 解决问题的能力不断进步,我们正在深入审视与复杂性增加相关的风险,包括我们的前沿安全评估和针对关键能力级别的计划缓解措施的实施。 有关 Gemini 2.5 Deep Think 安全结果的进一步详情可在 [模型卡](https://storage.googleapis.com/deepmind-media/Model-Cards/Gemini-2-5-Deep-Think-Model-Card.pdf)中获得。 ## 如何在 Gemini 应用中使用 Deep Think 如果你是 Google AI Ultra 订阅者,你可以在 Gemini 应用中使用 Deep Think,每天有固定数量的提示,通过在模型下拉菜单中选择 2.5 Pro 时在提示栏中切换"Deep Think"。Deep Think 会自动与代码执行和 Google 搜索等工具配合使用,并可以生成更长的响应。 我们还在致力于在未来几周内通过 Gemini API 向一组受信任的测试者发布带有工具和不带工具的 Deep Think,以更好地了解其在开发者和企业用例中的可用性。 从研究到部署,堆栈几乎每一层的团队都为使 Deep Think 对 Gemini 应用用户更快速、更可靠和更友好而努力。我们迫不及待地想看到你用它构建的东西。

相似文章

Gemini 3 Deep Think:推动科学、研究与工程进步

Google DeepMind Blog

Google 发布了 Gemini 3 Deep Think 的重大更新,这是一种专门的推理模式,旨在通过将深厚的科学知识与实际应用相结合,解决科学、研究和工程领域的复杂挑战。

使用 Gemini Deep Think 加速数学与科学发现

Google DeepMind Blog

DeepMind 宣布 Gemini Deep Think 具备解决数学、物理学和计算机科学领域专业研究问题的能力,其核心亮点在于全新智能体 "Aletheia",能够迭代式地验证和修正解决方案。

Gemini 3 开启智能新时代

Google DeepMind Blog

Google 发布了其迄今为止最智能的模型 Gemini 3,具备增强的推理能力和多模态功能。该模型现已集成到 Google 各产品中,面向 Ultra 订阅用户的「深度思考」复杂问题求解模式即将推出。