Google DeepMind 新AI模型可控制机器人全身
摘要
Google DeepMind 发布了 Gemini Robotics 2,这是一种能控制整个类人机器人做出全身动作、提升灵活度的 AI 模型。同时,该更新还引入了具身推理能力、端侧模型,以支持多机器人协同与安全保障。
<figure>
<img alt="Apptronik 的 Apollo 2 机器人从架子上取下一只棒球手套" data-caption="Apptronik 的 Apollo 2 机器人从架子上取下一只棒球手套。 | 图片来源:Google" data-portal-copyright="图片来源:Google" data-has-syndication-rights="1" src="https://platform.theverge.com/wp-content/uploads/sites/2/2026/07/gemini-robotics-2-shelf.png?quality=90&strip=all&crop=0,0,100,100" />
<figcaption>
Apptronik 的 Apollo 2 机器人从架子上取下一只棒球手套。 | 图片来源:Google </figcaption>
</figure>
<p class="wp-block-paragraph">Google DeepMind 表示,其最新版 Gemini Robotics AI 模型能够“控制整个类人机器人”。与此前专注于控制类人机器人上半身的版本不同,<a href="https://www.theverge.com/news/628021/google-deepmind-gemini-robotics-ai-models">Gemini Robotics 2</a> 现支持从脚趾到指尖的“全身动作”,据<a href="https://deepmind.google/blog/gemini-robotics-2-brings-whole-body-intelligence-to-robots/">周四发布的公告</a>称。</p>
<p class="wp-block-paragraph">新模型将使类人机器人能够执行更广泛的行动,包括行走、下蹲、伸展和操控物体。Google 分享的视频显示,Apptronik 的 Apollo 2 机器人可以<a href="https://www.youtube.com/watch?v=nBftSI5mmHA">弯腰捡起</a>喷水壶,还能在架子上寻找并取下特定物品。</p>
<div class="youtube-embed"><iframe title="Gemini Robotics 2 实现智能全身控制" src="https://www.youtube.com/embed/9MNLEAzA59o?rel=0" allowfullscreen allow="accelerometer *; clipboard-write *; encrypted-media *; gyroscope *; picture-in-picture *; web-share *;"></iframe></div>
<p class="wp-block-paragraph">尽管 Google DeepMind 并未……</p>
<p><a href="https://www.theverge.com/tech/973276/google-deepmind-gemini-robotics-2-whole-body">阅读 The Verge 的完整报道。</a></p>
查看缓存全文
缓存时间: 2026/07/30 19:51
# Google DeepMind 的新 AI 模型可控制机器人全身动作
来源:https://www.theverge.com/tech/973276/google-deepmind-gemini-robotics-2-whole-body
Google DeepMind 表示,其 Gemini Robotics AI 模型的最新版本能够“控制完整的人形机器人”。此前版本主要关注控制人形机器人的上半身(https://www.theverge.com/news/628021/google-deepmind-gemini-robotics-ai-models),而根据周四发布的公告(https://deepmind.google/blog/gemini-robotics-2-brings-whole-body-intelligence-to-robots/),Gemini Robotics 2(https://deepmind.google/models/gemini-robotics/vla/)现已支持从脚趾到指尖的“全身动作”。
新模型将使人形机器人能够执行更广泛的动作,包括行走、下蹲、伸展和操控物体。Google 分享的视频显示,Apptronik 的 Apollo 2 机器人可以弯腰拿起(https://www.youtube.com/watch?v=nBftSI5mmHA)一个喷水壶,还能从架子上找到并取下特定物品。
尽管 Google DeepMind 指出其机器人“在运动速度方面还有待提升”,但补充说,这次更新“是朝着完成更复杂、更真实世界任务所需技能迈出的重要一步,这些任务需要全身协调。”
此外,Gemini Robotics 2 支持更好的灵巧性,现在可以控制更复杂的五指手。这使得机器人能够执行诸如密封 Ziploc 袋、扎垃圾袋或拧灯泡等任务。
Google DeepMind 还升级了 Gemini Robotics ER(具身推理)模型,这是一个视觉语言模型,帮助机器人分析环境、处理指令并执行多步骤任务。Gemini Robotics ER 2 在较长时间内完成任务的能力更强,并且“现在能够理解任务的开始和结束。”
Google DeepMind 表示,这次更新还允许不同类型的多个机器人协作完成任务。一段视频(https://www.youtube.com/watch?v=CiTPDm7PKW0)展示了 Apollo 2 如何指导 Google 的双臂机器人清理车库时将工具放入收纳箱。
该公司指出,Gemini Robotics ER 2 是“迄今为止最安全的机器人模型”,因为它能够“更好地检测到人类靠近,触发安全工具调用,并在有人过于接近时使机器人安全停止。”
与此同时,Google DeepMind 还改进了其 Gemini Robotics 设备端模型,该模型可以在没有互联网连接的情况下在机器人本地运行(https://www.theverge.com/news/691882/google-deepmind-on-device-ai-robots-gemini)。现在,该模型能够更快地适应新的本体,包括那些“形状、传感器和自由度截然不同”的本体。
**关注本文的故事和作者**,即可在个性化主页信息流中看到更多类似内容,并接收邮件更新。
- Emma Roth
相似文章
Gemini Robotics 2 为机器人带来全身智能
DeepMind 推出 Gemini Robotics 2,这是一组 AI 模型(VLA、ER、On-Device),使机器人能够进行全身控制、精细操作和多机器人协作,支持本地设备端执行,并能快速适应新的机器人本体。
需要全身控制的任务,配备Gemini Robotics 2
Google DeepMind的Gemini Robotics 2将物理AI扩展到全身控制,使类人机器人能够在杂乱空间中执行需要伸展、弯腰和平衡的任务。
Gemini Robotics 2 将谷歌AI带入物理世界
谷歌DeepMind发布了Gemini Robotics 2,这是一个结合了视觉语言和视觉语言动作模型的AI模型,用于控制人形机器人完成复杂的物理任务,如拧灯泡和整理货架。
Intelligent whole-body control with Gemini Robotics 2
Google DeepMind 展示了 Gemini Robotics 2 模型,使机器人阿波罗能够在杂乱环境中通过全身控制和具身推理理解自然语言指令、自主协调动作并完成收拾运动装备等多步骤任务,验证了通用机器人的潜力。
Gemini Robotics 将 AI 引入物理世界
Google DeepMind 推出 Gemini Robotics,这是一个基于 Gemini 2.0 的视觉-语言-动作模型,可以控制物理机器人,具有更强的通用性、交互性和灵巧性。该公司还推出了用于空间推理的 Gemini Robotics-ER,并与 Apptronik 合作开发人形机器人。