Google I/O '26 Keynote

YouTube AI Channels 新闻

摘要

Google I/O '26 主题演讲展示了AI全面提速:月处理3.2千万亿Token,Gemini月活超9亿,发布新一代TPU芯片及世界模型Gemini Omni,并推出Ask YouTube、Docs Live等对话式AI功能。

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/05/21 15:39

**TL;DR:** Google I/O '26 主题演讲展示了 AI 的全面提速:每月处理 3.2 千万亿个 Token,Gemini 月活用户突破 9 亿,发布了新一代 TPU 芯片以及世界模型 Gemini Omni,并推出了 Ask YouTube、Docs Live 等对话式 AI 功能。 ## 开场与十年 AI 愿景 Sundar Pichai 以一段充满个人趣味的开场白开启了 Keynote。他提到今年是公司转向 AI-first 战略的第十年,而 AI 正在成为解决最复杂科学问题的终极工具。Google 采取差异化的全栈式 AI 创新方法,覆盖从定制芯片、安全基础设施到模型、产品和平台,这一方法让创新速度更快,并照亮了公司的每个角落。 ## 规模增长:Token、开发者和用户 过去两年,Google 服务的 Token 处理量从每月 9.7 万亿激增至 480 万亿,一年后又翻了七倍,达到每月 3.2 千万亿。目前每月有超过 850 万开发者使用 Google 的模型构建新应用,模型 API 每分钟处理约 190 亿个 Token。过去 12 个月中,超过 375 个客户各自处理了超过 1 万亿 Token。 在产品端,Google 有 13 个产品各拥有超过 10 亿用户,其中 5 个超过 30 亿用户。Gemini 应用月活跃用户从去年的 4 亿增长至 9 亿,每日请求增长超过七倍。此外,已有超过 500 亿张图像通过 Nano Banana 模型生成。 ## 搜索与 Gemini 应用升级 AI 概览(AI Overviews)月活用户超过 25 亿,AI 模式(AI Mode)则被称为搜索有史以来最大的升级,月活用户已超 10 亿。当用户使用 AI 功能时,他们更频繁地使用搜索,搜索体验从单次查询转变为持续对话。 Gemini 应用加入了个性化智能功能,使响应更定制化。Sundar 提及其个人使用 Gemini 理解父母就诊记录的场景。 ## 对话式 AI 新功能 三个重要产品获得对话式 AI 升级: - **Ask Maps**:支持复杂长问题,例如“我的孩子刚掉进鸭塘,婚礼半小时后开始,我走路去哪给她买件新裙子?” - **Ask YouTube**:支持自然语言查询,例如“教三岁孩子骑踏板自行车,他们已会骑平衡车”。系统会给出概述、提示,并直接跳转到视频最相关的部分,同时记住上下文,支持追问和表格化对比。今年夏天在美国广泛推出。 - **Docs Live**:用户可以用语音口述想法,Gemini 自动从 Drive 调取简历、提取邮件细节,并生成文档草稿。演示中,用户通过语音要求为职业日演讲创建谈话要点,Gemini 不仅能调用简历,还能提取“职业日后勤”邮件中的信息,并将类比格式化为表格,甚至自动加入个人故事备注。Docs Live 今年夏天向 Pro 和 Ultra 订阅者推出,类似功能随后进入 Gmail 和 Google Keep。 ## 基础设施投资与 TPU 芯片 Google 2022 年资本支出为 310 亿美元,今年预计达到 1800 到 1900 亿美元。关键投资是定制芯片。继第八代 TPU 后,Google 首次采用双芯片设计: - **TPU 8t**:针对大规模预训练优化,原始计算能力是上代近三倍。借助 JAX 和 Pathways,训练不再受限于单个数据中心,可在全球超过 100 万个 TPU 上分布训练,实现数周而非数月的大模型训练。 - **TPU 8i**:针对推理优化,大幅降低延迟。现场演示中,一个 Flash 模型在 8i 上生成 Chrome 恐龙游戏,Token 生成速度接近每秒 1500 个。 两款芯片每瓦性能提升高达两倍。演讲中穿插了一段 TPU 动画短片,展示了芯片在蛋白质折叠、气候模拟等任务中的工作。 ## 模型突破:Gemini Omni Demis Hassabis 宣布了 Gemini Omni 系列,这是将 Gemini 的多模态能力与生成式媒体模型(如 Veo、Nano Banana、Genie)结合的世界模型。Omni 能够从任何输入生成任何输出,在模拟动能、重力等物理概念上实现了阶梯式变化。 演示中,输入“制作一个黏土动画解释蛋白质折叠”,Omni 生成了包含氨基酸链、α 螺旋和 β 折叠的动画。更重要的是,Omni 支持通过对话式语言编辑视频:例如修改自拍中的细节、改变风格或添加元素。一个简单圆圈可变形为黑洞,傍晚散步场景可被实时调整。 第一个模型 Gemini Omni Flash 即日起可在产品中使用,Omni Pro 将在未来分享更多信息。 ## 透明度与 SynthID 面对深度伪造风险,Google 的 SynthID 水印已标记了 1000 亿张图像和视频,以及相当于 60000 年的音频资产。数百万用户通过 Gemini 应用中的检测器验证 AI 生成内容。现在 Google 还在跨产品添加内容凭证验证,展示内容是否由 AI 生成及其来源。 --- Source: https://www.youtube.com/live/wYSncx9zLIU

相似文章

I/O '26 Recap: Everything You Need to Know

YouTube AI Channels

Google I/O 2026 大会发布了 Gemini 3.5 Flash/Pro、Gemini Omni 多模态模型、Anti-Gravity 智能体平台、Gemini Spark 个人 AI 以及搜索购物等全面升级,强调全栈 AI 创新与科学应用,展示了一系列新体验和硬件产品。

Gemini | I/O 2026 Keynote

YouTube AI Channels

Google 在 I/O 2026 上宣布 Gemini 应用的全面重新设计(神经表现)、多模态创作模型 Gemini Omni、以及 Daily brief 和 Gemini Spark 等主动智能体功能,同时推出 macOS 版语音驱动的多文档处理能力。

Sundar Pichai Opening Remarks | I/O 2026 Keynote

YouTube AI Channels

Sundar Pichai opened Google I/O 2026 with highlights of AI token processing reaching 3.2 quintillion per month, new TPU 80/80i chips, the Gemini Omni world model, and multiple product updates, emphasizing full-stack AI innovation.

AI x Society | I/O 2026 Keynote

YouTube AI Channels

Google在I/O 2026 Keynote上发布了Gemini 3.5、Omni、Code Mender、Gemini for Science、WeatherNext等最新AI成果,强调AGI已近在眼前,并展示了AI在网络安全、科学模拟和健康领域的应用。

我们在 I/O 2026 上宣布的 100 件事

Google AI Blog

Google I/O 2026 上发布了一系列公告,包括推出先进 AI 模型 Gemini 3.5 Flash 和 Gemini Omni,以及新的开发者工具和平台更新。