@svlevine: 动作分块是一种神秘而有效的方法。现代大规模模仿学习没有它基本无法工作……
摘要
Sergey Levine 重点介绍了一篇新论文,该论文探讨了为什么动作分块在现代大规模机器人模仿学习中如此有效,并剖析了其背后的原因。
查看缓存全文
缓存时间: 2026/08/08 11:08
Action chunking(动作分块)是一种神秘而有效的方法。现代大规模模仿学习基本上离不开它。但它究竟为什么有效?在我们的新论文中,我们试图拆解其中的原因。俗话说得好,接下来发生的事情可能会让你大吃一惊……
Andrew Wagenmaker (@ajwagenmaker): Action chunking 是几乎所有现代机器人模仿学习方法中的关键组成部分。
但为什么它如此关键?我们真的需要 action chunking 吗?欢迎查看我们的最新研究,一探究竟!(1/n)
相似文章
@starlitmatcha:今天我读了几篇关于 Action Chunking Transformers (ACT) 和 Diffusion Policy 的论文,它们是……的实现
Khushi 分享了她在 Action Chunking Transformers 和 Diffusion Policy 上的阅读笔记,解释了如何通过动作分块与生成模型(如 VAE 和扩散模型)改进机器人模仿学习,以及如何通过解耦规划与执行来解决推理延迟问题。
离线到在线强化学习的自适应 Q 分块
本文介绍了自适应 Q 分块(AQC),这是一种强化学习方法,能够动态选择动作分块大小,以平衡反应式控制与长期规划。该方法在 OGBench 和 Robomimic 上取得了最先进的结果,提升了大规模 VLA 模型在机器人任务中的性能。
@svlevine:要想让机器人做好一件事,你需要知道如何与它对话。如果你不会,你可以学习,通过Semanti…
本文介绍了语义动作强化学习(Semantic Action RL),它通过对视觉-语言-动作(VLA)提示进行强化学习,使机器人能够在现实世界中快速学习新任务。
@aimalysheva: 潜在行为正当时,尤其在机器人领域:不再预测机器人的实际关节指令或游戏…
潜在行为在机器人领域越来越受关注,它使得从无动作标签的无标注视频中学习成为可能。DeepMind和FAIR的最新论文展示了从受控游戏环境到野外互联网视频的进展,有望实现模仿学习的可扩展训练。
@TeachTheMachine:决定你的RAG是否有效的7种分块策略
来自MachineLearningMastery的一篇教育性文章,涵盖了RAG流水线的七种分块策略,从固定大小令牌分块到高级语义和层次化方法,并提供了每种策略的适用场景指导。