@GoogleDeepMind: Google Flow Gemini Omni 用我们最新的模型创作更具电影感的故事,该模型带来了批量编辑、改进的角色一致性…
摘要
Google 宣布其 AI 创意工作室 Flow 的更新,包括新的 Gemini Omni Flash 模型,用于多模态视频编辑,具有改进的角色一致性;Flow Agent 用于协作规划和批量编辑;以及通过自然语言创建自定义工具。还推出了新的移动应用和音乐生成模型 Lyria 3 Pro。
查看缓存全文
缓存时间: 2026/05/19 18:50
Google Flow 🤝 Gemini Omni
使用我们的最新模型创作更具电影感的故事,该模型带来了批量编辑、改进的角色一致性等新功能。以下是 @FlowbyGoogle 的其他新内容 → https://t.co/corY3RwY7t
#GoogleIO https://t.co/usg0Sudiv9
全新智能体、移动应用及 Google Flow 与 Google Flow Music 的 Gemini Omni 集成
来源:https://blog.google/innovation-and-ai/models-and-research/google-labs/flow-updates/?utm_source=x&utm_medium=social&utm_campaign=&utm_content= Google Flow 产品系列的全新功能,助您在项目的每个阶段进行想象、协作与精炼。
在去年的 I/O 大会上,我们推出了专为电影制作人打造的 Google Flow (http://flow.google/)。此后,我们将 Flow 扩展为一个 AI 创意工作室,新增了视频和图像生成与编辑功能,并在全球超过 140 个国家上线。今年早些时候,我们为 Google Flow 家族增添了新成员 Google Flow Music (https://flowmusic.google/),它将谷歌最新的音乐模型 Lyria 3 Pro (https://gemini.google/overview/music-generation/) 带给艺术家、制作人和词曲作者。现在,我们推出了涵盖创意流程每一步的智能体、提供精准视频编辑的新 AI 模型、可用“氛围编码”定制工作流的功能,以及用于移动创作的应用程序。
让我们更深入地了解 Google Flow 和 Google Flow Music 的新内容。¹ (https://blog.google/innovation-and-ai/models-and-research/google-labs/flow-updates/?utm_source=x&utm_medium=social&utm_campaign=&utm_content=#footnote-1)
Google Flow 的新功能
我们通过 Gemini Omni (https://deepmind.google/models/gemini-omni/)、全新的智能体体验和自定义工具,将 Google Flow 提升到了新高度。
-
充分利用 Gemini Omni 的潜力:Gemini Omni Flash 是一个能从任何输入(首先是视频)创建任何内容的模型。它融合了 Gemini 的智能与我们生成式媒体模型的能力,在世界理解、多模态和精准视频编辑方面实现了飞跃。你可以将 Omni 理解为视频版的 Nano Banana (https://gemini.google/overview/image-generation/)。对于使用 Google Flow 的创意人士,Omni Flash 允许你将现实世界的灵感与生成内容相结合,并通过对话式迭代。Omni Flash 还改进了角色一致性,确保每个场景中的身份和声音得以保留。Omni Flash 面向全球 Google AI 订阅用户在 Flow 中提供。
-
在每一阶段协作:Google Flow Agent 是你的创意伙伴,能够根据你的输入规划和推理复杂任务,并始终受你掌控。它基于 Gemini 模型构建,具备专业知识并深入理解你的项目,可协助进行早期头脑风暴、创作和编辑。例如,智能体可以充当特定场景中角色对话的讨论对象,甚至提出情节建议。当项目深入时,你的智能体可以一次性创建多个变体,提供更多选择,甚至进行批量编辑,使你的调整反映在所有素材中。一旦你拥有素材,智能体可将其整理成合集,甚至智能地重命名。该智能体现已面向全球所有 Google Flow 用户开放。
-
使用定制 Tools 构建所需功能:借助 Google Flow Tools,你现在可以用自然语言在 Google Flow 中创建定制工具和工作流程。无论是寻找特定的图像编辑器、视频调整器还是自定义着色器,你都可以轻松开发,无需编码经验。如果你创建了可能被他人喜欢的工具,可以轻松与其他 Flow 用户共享,后者可将其混搭融入自己的项目中。例如,我们的一位早期访问合作伙伴 László Gaal (https://www.laszlogaal.com/) 创建了一个名为“pixelBento (https://labs.google/fx/tools/flow/shared/tool/44b73cc0-ad82-49a6-b118-86c31ec49a71)”的工具,用于应用低保真和故障美学等后期特效。你可以在 Flow (https://labs.google/fx/tools/flow) 中查看此工具及其他工具,包括来自我们的合作伙伴 Kat Zhang (https://labs.google/fx/tools/flow/shared/tool/46270263-54a1-46fb-a68c-dae111f650fb) 和 metapuppet (https://labs.google/fx/tools/flow/shared/tool/32f2b8f8-a1a9-43ed-899f-c0fbff2e9599) 的工具。全球所有 Flow 用户均可使用现有 Tools,而 Google AI 订阅用户还可以创建和重新混搭它们。
Google Flow Music 的新功能
Google Flow Music 一直允许你创作、迭代和分享工作室品质的歌曲。我们的最新功能提供了更强大的编辑控制力和改进的音乐视频创作。
- 逐段落精准编辑你的歌曲:我们为艺术家、词曲作者和制作人提供了对 Google Flow Music 中创作内容的更精细控制。现在,你可以高亮歌曲的任何部分进行修改。即时重写或翻译歌词,重新编排节拍落点等,而不会影响曲目的其余部分。或者,你可以采样自己某首歌曲的特定段落,并将其扩展为完全不同的方向。
- 通过翻唱版本重新构想整首曲目:转换你在 Google Flow Music 中制作的完整歌曲的风格,同时保留原始旋律和结构。例如,尝试为你最喜欢的播放列表创建一个“低保真学习”版本。
- 使用 Gemini Omni 创作音乐视频:我们最新的模型也将登陆 Google Flow Music,让你能与智能体对话式协作,导演可分享的音乐视频。借助 Omni Flash,你可以引导风格、主题和场景,使其与曲目的叙事和节奏相匹配。该功能面向所有 Google AI 订阅用户开放。
此外,针对 Google Flow 和 Google Flow Music,我们正在推出移动应用。虽然网页版仍是访问所有功能和特性的首选平台,但移动应用为随时随地创作提供了灵活性。对于 18 岁及以上的用户,Flow 应用 (https://play.google.com/store/apps/details?id=com.google.android.apps.labs.whisk) 现已在 Android 上提供测试版(iOS 即将推出),而 Flow Music 应用 (https://apps.apple.com/us/app/google-flow-music/id6760315723) 现已在 iOS 上提供(Android 即将推出)。
在过去一年中,来自不同领域的数百万创意人士已使用 Google Flow 和 Google Flow Music 将他们的想法变为现实;我们迫不及待地想看到这些新功能在创意人士手中诞生怎样的作品。
图中展示的是带有 Google I/O 2026 标志的彩色抽象设计。
在收件箱中获取更多来自 Google 的故事。
已完成。只差一步。
请检查您的收件箱以确认订阅。
您已订阅我们的新闻通讯。
您也可以使用以下方式订阅:
相似文章
Gemini Omni 1.1 Flash 让你在构建时拥有更多控制权
Google DeepMind 发布了 Gemini Omni 1.1 Flash,这是一款更新的生成式视频AI模型,具有增强的创意控制、场景扩展和更快的原型制作功能,现在可通过 API 在 Google AI Studio 中使用。
Google 的 Gemini Omni 将图像、音频和文本转化为视频——而这仅仅是个开始
Google 发布了 Gemini Omni,这是一个多模态模型系列,能够从图像、音频和文本生成视频,跨输入进行推理以产生一致的高质量输出。首个模型 Gemini Omni Flash 将在 Google I/O 上向 Gemini 应用、YouTube Shorts 和 Flow 推出。
@googledevs: 正在构建创意工具或媒体编辑软件吗? Gemini Omni 1.1 Flash 现已通过 Gemini API 在 @Go… 上提供
Gemini Omni 1.1 Flash 现已通过 Google AI Studio 中的 Gemini API 提供,为生成式视频提供生产就绪的控制,功能包括场景扩展、4K 升级和更快的原型制作。
@GoogleDeepMind: 我们正在发布 Gemini Omni:这是我们迈向能够从任何内容创造任何内容的模型的第一步——从视频开始…
Google DeepMind 宣布推出 Gemini Omni,这是一种新型模型,它将 Gemini 的智能与生成式媒体系统相结合,能够从任何输入创建视频,标志着多模态人工智能的重大进步。
Google 所有新 AI 更新一网打尽(NotebookLM、Gemini 等)
Google 推出了一系列重要的 AI 更新,最引人注目的是 NotebookLM 新增的由 Gemini 3 Pro 驱动的电影级视频生成功能以及代码驱动的动画效果。此次更新还包括 Gemini 的音乐创作能力、增强的演示文稿编辑功能,以及让免费用户更便捷地访问各种模型。