@heyshrutimishra:这就是机器人技术以惊人速度扩展的方式。超过一百万小时的人们日常任务数据。完全没有机器人数据。……
摘要
Dyna Robotics 推出了 Dyna-2,一个在超过一百万小时人类视频上预训练的世界动作模型,发现了机器人操作的新扩展定律。
查看缓存全文
缓存时间: 2026/08/10 23:37
这就是机器人技术以惊人速度扩展的方式。
一百万+小时的人类日常任务视频。完全没有机器人数据。
更多人类经验 → 更好的机器人操作。
可预测。单调递增。跨越五个数量级,未见上限。
Dyna Robotics(@DynaRobotics): 今天,我们推出 Dyna-2,一个基于一百万小时人类视频预训练的世界-动作模型。在这个规模上,我们首次发现了几个新的缩放定律:
• 世界-动作模型在人类数据上表现出跨越四个数量级的缩放定律,从 1000
相似文章
Dyna-2: A 1-Million-Hour Scaling Law for World-Action Models (29 minute read)
Dyna-2 is a world-action model pre-trained on over a million hours of human video, showing scaling laws on human data and a human-to-robot transfer scaling law for zero-shot robot performance.
@FinanceYF5:最让我惊讶的是:Dyna-2从未在单条机器人轨迹上训练过,但它看到的人类视频越多,在机器人任务上的表现就越好……
Dyna Robotics 推出了 Dyna-2,这是一个在一百万小时人类视频上预训练的世界-动作模型,揭示了缩放定律,并表明具身差距更像是一个适应问题,而非知识问题。
小米机器人-1:基于超过10万小时真实世界轨迹的视觉-语言-动作模型规模化
小米推出小米机器人-1,这是一个基于超过10万小时真实世界操作轨迹训练的视觉-语言-动作基础模型,展现出清晰的规模化定律,并以极少的微调数据在真实世界任务中实现高成功率。
Xiaomi-Robotics-1
小米展示了Robotics-1,这是一个通过无实体预训练在10万小时数据上训练的机器人策略模型,展现出清晰的扩展行为和对真实世界任务的强大泛化能力。
Ego2Robot:从第一人称人类数据规模化合成机器人数据
Ego2Robot是一个可扩展的流水线,通过动作重定向和视觉合成,将第一人称人类操作视频转换为机器人训练数据,生成涵盖15种机器人形态的18,561小时数据。实验表明,在该合成数据与真实机器人数据上联合预训练,可提升视觉-语言-动作模型在分布外场景下的泛化能力,并已在真实机器人部署中得到验证。