@svlevine: 动作分块是一种神秘而有效的方法。现代大规模模仿学习没有它基本无法工作……
摘要
Sergey Levine 重点介绍了一篇新论文,该论文探讨了为什么动作分块在现代大规模机器人模仿学习中如此有效,并剖析了其背后的原因。
查看缓存全文
缓存时间: 2026/08/08 11:08
Action chunking(动作分块)是一种神秘而有效的方法。现代大规模模仿学习基本上离不开它。但它究竟为什么有效?在我们的新论文中,我们试图拆解其中的原因。俗话说得好,接下来发生的事情可能会让你大吃一惊……
Andrew Wagenmaker (@ajwagenmaker): Action chunking 是几乎所有现代机器人模仿学习方法中的关键组成部分。
但为什么它如此关键?我们真的需要 action chunking 吗?欢迎查看我们的最新研究,一探究竟!(1/n)
相似文章
@starlitmatcha:今天我读了几篇关于 Action Chunking Transformers (ACT) 和 Diffusion Policy 的论文,它们是……的实现
Khushi 分享了她在 Action Chunking Transformers 和 Diffusion Policy 上的阅读笔记,解释了如何通过动作分块与生成模型(如 VAE 和扩散模型)改进机器人模仿学习,以及如何通过解耦规划与执行来解决推理延迟问题。
离线到在线强化学习的自适应 Q 分块
本文介绍了自适应 Q 分块(AQC),这是一种强化学习方法,能够动态选择动作分块大小,以平衡反应式控制与长期规划。该方法在 OGBench 和 Robomimic 上取得了最先进的结果,提升了大规模 VLA 模型在机器人任务中的性能。
@svlevine: 如何使用实时分块(RTC)运行强化学习?在这项工作中,我们找到了方法,用小型强化学习策略配合大型机器人基础模型……
一项研究合作介绍了ARLI,这是一种通过异步推理使用实时分块来启用视觉-语言-动作模型的强化学习微调的方法,通过让强化学习策略观察更近期的图像来改善机器人行为。
多行动,少决策:技能引导的自适应动作分块用于长期任务LLM代理
本文提出'Space',一种技能引导的自适应动作分块方法,用于长期任务LLM代理,将成功率提高7.0%–31.3%,并将LLM决策轮次减少高达78.9%。
@svlevine:要想让机器人做好一件事,你需要知道如何与它对话。如果你不会,你可以学习,通过Semanti…
本文介绍了语义动作强化学习(Semantic Action RL),它通过对视觉-语言-动作(VLA)提示进行强化学习,使机器人能够在现实世界中快速学习新任务。