Sundar Pichai Opening Remarks | I/O 2026 Keynote

YouTube AI Channels 新闻

摘要

Sundar Pichai opened Google I/O 2026 with highlights of AI token processing reaching 3.2 quintillion per month, new TPU 80/80i chips, the Gemini Omni world model, and multiple product updates, emphasizing full-stack AI innovation.

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/05/22 19:05

TL;DR: Sundar Pichai 在 I/O 2026 上宣布 AI 月 token 处理量达 3.2 千万亿,推出新一代 TPU、Gemini Omni 模型和多项产品更新,强调 AI 正以全栈创新驱动规模增长。 ## 开场:AI 驱动的不凡一年 Sundar Pichai 以一段幽默的太空舱插曲开场,点明过去一年是“紧张的、不懈发布的时期”。他回顾了 Google 转型为 AI-first 的十年历程,并强调其差异化全栈 AI 创新方法:从自研芯片、安全基础,到世界级研究与模型,再到覆盖数十亿用户的产品平台。这种方法使公司能够“更快迭代和创新,并照亮每一个角落”。 ## AI 采用规模:从 token 到用户的故事 ### token 爆炸式增长 Pichai 展示了 AI 被广泛采纳的直观证据——token 处理量: - 两年前:每月 9.7 万亿 token - 去年 I/O:约 480 万亿 token - 现在:**3.2 千万亿 token/月**(增长 7 倍) 他说:“我从没想过会在 I/O 主题演讲中说出‘千万亿’这个词,但这就是现实。” ### 开发者与产品需求 - 每月 **850 万开发者** 使用 Google 模型构建应用 - 模型 API 每秒处理 **190 亿美元 token** - 过去 12 个月,**超过 375 个客户** 各自处理了超过 1 万亿 token - Google 有 **13 个产品** 拥有超过 10 亿用户,其中 5 个超过 30 亿 ### 搜索与 Gemini 应用 - **AI 概览**:每月超 25 亿用户 - **AI 模式**:一年内突破 10 亿月活用户,“这是搜索有史以来最大的升级” - **Gemini 应用**:月活用户从去年 I/O 的 4 亿增长到 **9 亿**,一年翻番;每日请求量增长 7 倍以上 - **Nano banana 模型**:已生成超 500 亿张图像 ## 对话式 AI 深入产品 ### 地图:十年最大升级 新增“地图”功能,支持复杂长查询。Pichai 举了一个真实例子:“我的孩子刚掉进鸭池里,婚礼还有 30 分钟开始。我该去哪里给她买条新裙子?” ### 问 YouTube 针对用户对海量视频的困惑,新功能可回答诸如“如何教三岁孩子骑脚踏车”的问题。它提供概览、实用提示、相关视频并自动跳转到最相关部分;还支持追问(如“应该买手刹还是脚刹?”),并以表格呈现对比信息。**今年夏天将在美国广泛推出。** ### Docs Live:语音创编文档 用户可语音口述想法,Gemini 自动完成文档创建。演示中,用户为高中职业日演讲准备要点,要求从云端硬盘调取简历、提取学校邮件、添加类比表格和个人故事。Pichai 强调所有演示均为实时、未加速。**今年夏天向 Pro 和 Ultra 订阅用户推出**,同时登录 Gmail 和 Google Keep。 ## 基础设施投资:自研芯片与全球训练 ### 资本支出激增 - 2022 年:310 亿美元 - 2026 年预计:**1800-1900 亿美元**(约 6 倍) ### 第八代 TPU:TPU 80 与 TPU 80i - 双芯片方法,分别为训练和推理优化 - **TPU 80**:面向大规模预训练,原始计算能力接近上一代 **3 倍** - **Jackson Pathways**:训练可跨多个站点扩展至 **10 万+ TPU**,实现全球最大训练集群,训练周期从数月缩短至数周 - **TPU 80i**:推理专用,延迟大幅降低。现场演示 Flash 模型生成 Chrome Dino 游戏,**每秒接近 1500 token** - 能效提升:每瓦性能最高提升 **2 倍** ### 幽默的 TPU 幕后花絮 一段拟人化对话展示了 TPU 的“日常工作”——处理蛋白质折叠、模拟气候数据、生成哈巴狗图片,并调侃“有数万亿项工作要做”。 ## 世界模型:Gemini Omni ### 从预测文本到模拟现实 Demis Hassabis 登场,指出去年 I/O 提出的世界模型愿景已迈向新阶段。他宣布 **Gemini Omni**:一种“从任何输入创建任何输出”的模型,结合 Gemini 智能与 Veo、Nano banana、Genie 等生成式媒体模型,在“模拟动能和重力等方面实现阶跃变化”。 ### 功能亮点 - 生成高度准确的视频(如“黏土动画解释蛋白质折叠”) - 支持对话式语言迭代编辑视频(输入自拍后自由调整风格、添加元素) - “任何东西都可以成为创造全新现实的画布” - 首批模型:**Gemini Omni Flash**(已投入产品);Omni Pro 即将公布 ## AI 透明度:SynthID 与内容凭证 ### 识别深度伪造的挑战 研究显示人们正确识别高质量深度伪造视频的几率仅约四分之一。 ### Google 的解决方案 - **SynthID**:隐形水印,已为超 **1000 亿张图片和视频**、相当于 **6 万年的音频** 添加水印 - **SynthID 检测器**:数百万人在 Gemini 应用中使用 - **内容凭证验证**:显示内容是 AI 生成、相机拍摄还是经 GenAI 编辑 - **扩展到搜索和 Chrome**:用户可圈选或右键点击,询问“这是 AI 生成的吗?” - **行业合作**:NVIDIA 去年加入;**OpenAI、Kakao、ElevenLabs** 正采用 SynthID 2 ## 展望 Pichai 总结:“这就是我们在世界模型方面取得的进展。现在让我们谈谈我们的 Gemini 3 系列下一步计划。” 演讲在提及 Gemini 3 已发布后结束,暗示后续会有更多细节。 --- Source: [Sundar Pichai Opening Remarks | I/O 2026 Keynote](https://www.youtube.com/watch?v=duHhImuaZGU)

相似文章

Google I/O '26 Keynote

YouTube AI Channels

Google I/O '26 主题演讲展示了AI全面提速:月处理3.2千万亿Token,Gemini月活超9亿,发布新一代TPU芯片及世界模型Gemini Omni,并推出Ask YouTube、Docs Live等对话式AI功能。

Google I/O 2026 上的 13 个重大发布

The Verge

Google 在 I/O 2026 主题演讲中带来多项重大 AI 发布,包括 Gemini 3.5 和 Gemini Omni 模型系列、Gemini 应用重新设计、始终在线的 AI 助手 Spark、Android 应用的 vibe-coding,以及与 Xreal 合作推出的 Project Aura 智能眼镜更新版本。

我们在 I/O 2026 上宣布的 100 件事

Google AI Blog

Google I/O 2026 上发布了一系列公告,包括推出先进 AI 模型 Gemini 3.5 Flash 和 Gemini Omni,以及新的开发者工具和平台更新。