Gemini Omni 和 Gemini 3.5 的 9 个实际演示

Google AI Blog 模型

摘要

Google 展示了其新模型 Gemini Omni(通过对话进行视频生成和编辑)和 Gemini 3.5 Flash(用于复杂任务的智能体模型)的 9 个演示,这些演示在 Google I/O 2026 上呈现。

<img src="https://storage.googleapis.com/gweb-uniblog-publish-prod/images/Gemini_Omni_and_Gemini_3.5_hero.max-600x600.format-webp.webp">观看 9 个视频,了解 Gemini Omni 和 Gemini 3.5 的功能,这些模型在 Google I/O 2026 上发布。
查看原文
查看缓存全文

缓存时间: 2026/05/29 19:19

# 9 个 Gemini Omni 与 Gemini 3.5 实机演示 来源:https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-omni-3-5-videos/ 随着 Gemini Omni 的推出,Gemini 的推理能力与创造能力得以融合;而 Gemini 3.5 则是为了帮助您执行复杂的智能体工作流而生。 Gemini Omni & Gemini 3.5 主图 您的浏览器不支持音频元素。 收听文章 此内容由 Google AI 生成。生成式 AI 处于实验阶段。 \[\[时长\]\] 分钟 在 Google I/O 2026 (https://blog.google/innovation-and-ai/technology/developers-tools/google-io-2026-collection/) 上,我们发布了最新模型:Gemini Omni (https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-omni/) 以及 Gemini 3.5 (https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3.5/) 系列模型。 Gemini Omni 是我们新推出的模型,它能基于任意输入生成任何内容,首先从视频开始。借助 Omni,您可以组合图像、音频、视频和文本作为输入,并基于 Gemini 的真实世界知识生成高质量视频。您还可以通过对话轻松编辑视频。 此外还有 Gemini 3.5,这是我们最新的一系列模型,将前沿智能与实际行动结合。这标志着在构建更强大、更智能的智能体方面迈出了重要一步。我们以发布 3.5 Flash 作为该系列的起点。它为智能体和编码提供了前沿性能,擅长执行复杂的长期任务,带来实际效用。 为了让您更清楚地了解 Gemini Omni 和 Gemini 3.5 Flash,以下 9 个演示展示了它们能帮助您完成的任务。 ## Gemini Omni **通过对话编辑视频。**Omni 的一大特色在于提供了一种更简便的视频编辑方式——使用自然语言。每一条指令都基于前一条指令构建。您的人物保持一致,物理规律得以保持,场景也能记住之前发生的一切。这意味着您可以改变周围的世界。更改特定细节,或者改变一切。您的视频成为您自己永远无法拍摄的场景的起点。 提示词:让雕塑变成气泡做的。 **重新构想动作。**拍摄一段视频,只需让 Omni 改变正在发生的事件。编辑动作,添加新角色或物体,或将某个时刻转变为意想不到的场景。 提示词:调暗房间里的灯光。在一个漂浮在手掌上方追踪的玻璃球内放置黑白棋盘格房间,球内包含同一只手的递归表示,手拿着球,形成无限递归的房间。摄像机缓慢靠近球体,形成视频循环。 **在多轮交互中优化视频。**改变环境、角度、风格甚至具体细节,而不会丢失原始场景的脉络。滚动浏览轮播图,查看编辑如何层层叠加。 提示词:一段小提琴手演奏歌曲的视频。 提示词:将小提琴手转移到图像环境中。 提示词:让小提琴隐形。 提示词:将摄像机角度改为小提琴手肩膀上方。 ## Gemini 3.5 Flash **大规模执行智能体任务。**3.5 Flash 在多个维度上提供了可与大型旗舰模型媲美的智能,同时保持了 Flash 系列一贯的高速。这种速度与性能的平衡使 3.5 Flash 成为处理长期智能体任务的理想选择。在这里,由 Antigravity 驱动,3.5 Flash 执行多步骤工作流,根据动态条件自动重命名和分类非结构化资产。 由 Antigravity 驱动的 3.5 Flash 当与更新后的 Antigravity 框架结合时,3.5 Flash 成为部署协作子智能体以大规模解决最苛刻用例问题的强大引擎。在监督下,它能可靠地执行多步骤工作流和编码任务,同时保持前沿性能。 **使用 3.5 Flash 创建更丰富、更具交互性的 Web UI 和图形。**3.5 Flash 构建在 Gemini 3 (https://blog.google/products-and-platforms/products/gemini/gemini-3-examples-demos/) 强大的多模态基础之上。观看 3.5 Flash 如何在 AI Studio 上仅用 60 秒就为结账流程生成不同的 UX 方案。 **尝试个人 AI 智能体和新的智能体验。**3.5 Flash 现已成为全球范围内 Gemini 应用和搜索中 AI 模式的默认模型。其智能体能力正在为日常生活中的前沿智能提供动力,带来新功能。 3.5 Flash 增强的智能体编码能力正在为搜索 (https://blog.google/products-and-platforms/products/search/search-io-2026/#search-agents) 带来更加智能的体验,例如我们新的信息智能体。这些智能体全天候在后台运行,智能地在信息之间进行推理,在恰当的时机找到您需要的确切内容。它们会发送一份综合更新,并附上更深入探索的网络链接,以便您采取行动。信息智能体将于今年夏季首先面向 Google AI Pro 和 Ultra 订阅用户推出。 信息智能体会持续通知用户,是否有他们喜爱的运动员宣布推出联名运动鞋或签名款产品。 现在,我们将 Google Antigravity 的强大功能以及 Gemini 3.5 Flash 的智能体编码能力直接引入搜索,搜索 (https://blog.google/products-and-platforms/products/search/search-io-2026/#agentic-coding) 能够即时为您的提问生成理想答案,并以正确的格式呈现。这样您就能获得定制的生成式 UI,包括视觉工具和模拟,精确满足您的需求。这些生成式 UI 功能将于今年夏季免费向所有搜索用户开放。 搜索利用 3.5 Flash 构建交互式视觉效果,解释 Gyroid 图案。 对于您的持续性任务,例如策划婚礼或建立新的健身计划,搜索还会为您构建定制体验——例如仪表盘、追踪器或迷你应用——您可以反复使用。在接下来的几个月里,您将能够直接在搜索中借助 Antigravity 创建自己的定制体验,首先面向美国地区的 Google AI Pro 和 Ultra 订阅用户。 搜索构建自定义健身追踪器。 还有全新的 Gemini Spark (https://blog.google/innovation-and-ai/products/gemini-app/next-evolution-gemini-app/),您的个人 AI 智能体,它运行在 Gemini 3.5 上,并使用了 Antigravity 框架。它全天候运行,帮助您管理数字生活,在您的指示下为您采取行动。它与您日常依赖的 Workspace 工具深度集成,如 Gmail、文档、幻灯片等。Gemini Spark 现已面向所有美国地区的 Google AI Ultra 订阅用户开放。 Gemini Spark 创建一份无坚果零食清单,然后将其添加到 Instacart。 Gemini Omni Flash 正面向全球所有 Google AI Plus、Pro 和 Ultra (https://one.google.com/about/google-ai-plans/) 订阅用户,通过 Gemini 应用 (https://gemini.google.com/) 和 Google Flow (https://labs.google/fx/tools/flow) 推出。同时也在 YouTube Shorts 和 YouTube Create 应用 (https://blog.youtube/news-and-events/youtube-news-google-io-2026/) 上免费向用户推出。在接下来的几周内,我们还将通过 API 向开发者和企业客户开放。 Gemini 3.5 Flash 现已通过 Google Antigravity (https://blog.google/innovation-and-ai/technology/developers-tools/google-io-2026-developer-highlights) 和 Google AI Studio 中的 Gemini API (https://aistudio.google.com/)、Android Studio (https://developer.android.com/studio)、Gemini Enterprise Agent Platform (https://console.cloud.google.com/agent-platform/overview) 以及 Gemini Enterprise (https://cloud.google.com/gemini-enterprise) 全面可用。同时,它也在搜索的 AI 模式 (https://g.ai/) 中面向所有人提供,并正在向全球所有 Gemini 应用 (https://blog.google/innovation-and-ai/products/gemini-app/next-evolution-gemini-app/) 用户推出。 IOCollection_social ## 在收件箱中获取更多来自 Google 的故事。 完成。只剩一步了。 检查您的收件箱以确认订阅。 您已订阅我们的通讯。 您也可以使用以下方式订阅

相似文章

Gemini Omni 1.1 Flash

Product Hunt

Gemini Omni 1.1 Flash 是 Google 最新的多模态模型,为开发者引入了新的创作控制和生成视频能力。

Gemini Omni | I/O 2026 Keynote

YouTube AI Channels

Google在I/O 2026上发布Gemini Omni,一个能够从任何输入生成任何输出的新模型,结合世界知识与生成式媒体,实现对话式视频编辑和创意变形,首先推出Gemini Omni Flash。