CARE:面向视觉-语言-动作策略的经验引导原子纠正执行
摘要
CARE是一个面向视觉-语言-动作策略的框架,通过从执行失败中学习生成纠正动作来增强机器人操作,在模拟和现实世界任务中展示了成功率的提升。
查看缓存全文
缓存时间: 2026/09/22 07:26
论文页面 - CARE:基于经验引导的视觉-语言-动作策略原子纠正执行方法
来源:https://huggingface.co/papers/2609.24118
摘要
视觉-语言-动作(VLA)策略在机器人操作中表现出色,但一旦执行偏离标称轨迹就容易变得脆弱。我们提出CARE(纠正性原子机器人执行框架),该框架通过学习执行过程中遇到的失败案例来提升恢复能力。CARE不依赖手工设计或随机扰动生成纠正数据,而是收集失败的轨迹记录,建模基于阶段条件的失败后偏差,并利用所得的经验分布合成代表性失败状态与纠正演示。在推理阶段,CARE结合分阶段规划与基于物理的三维监测,在保持任务进度的同时触发原子级调整或重新操作。我们进一步提出失败状态恢复基准测试(FSR-Bench),用于评估在局部偏差与结构异常下从中间失败状态恢复的能力。跨多种VLA骨干网络、仿真基准测试与真实世界双臂任务的实验表明,CARE带来持续改进:仿真环境中平均任务成功率提升14.5个百分点,真实世界环境提升15.9个百分点。代码、模型与数据集已开源:https://github.com/xiaojunlan/care
查看arXiv页面(https://arxiv.org/abs/2609.24118)| 查看PDF(https://arxiv.org/pdf/2609.24118)| GitHub仓库(https://github.com/xiaojunlan/care)| 加入收藏(https://huggingface.co/login?next=%2Fpapers%2F2609.24118)
通过代理获取本论文:
hf papers read 2609.24118
未安装最新CLI?请执行:
curl -LsSf https://hf.co/cli/install.sh | bash
引用本论文的模型数量:0
暂无模型关联本论文。
在模型README.md中引用 arxiv.org/abs/2609.24118 即可从此页面关联。
引用本论文的数据集数量:0
暂无数据集关联本论文。
在数据集README.md中引用 arxiv.org/abs/2609.24118 即可从此页面关联。
引用本论文的空间数量:0
暂无空间关联本论文。
在空间README.md中引用 arxiv.org/abs/2609.24118 即可从此页面关联。
收录本论文的合集数量:0
暂无合集收录本论文。
将本论文添加至新合集(https://huggingface.co/new-collection)即可从此页面关联。
相似文章
VLA-Corrector:一种用于自适应动作视野的轻量级检测与纠正推理框架
VLA-Corrector 提出了一种轻量级的检测与纠正推理框架,可在无需重新训练的情况下自适应调整视觉-语言-动作策略中的动作视野,提升机器人操控任务的鲁棒性和效率。
AR-VLA: 面向视觉-语言-动作模型的真正自回归动作专家
提出了AR-VLA,一个自回归动作专家,它通过长期记忆生成连续的、具有上下文感知能力的机器人策略训练的动作序列,相比反应式VLA模型,提高了轨迹平滑度和任务成功率。
CAVA:面向智能体AI系统运行时治理的规范动作验证与证明
本文提出了规范动作验证与证明(CAVA),这是一种运行时语义层,将异构智能体活动转换为用于治理的规范运行时动作对象,从而在多样化的AI执行环境中实现一致的审批绑定、凭证可再现性和策略执行。
APT:动作专家预训练提升视觉-语言-动作策略的指令泛化能力
研究人员提出APT,一种两阶段训练方法,先在视觉-动作对上预训练动作专家,再整合语言条件,显著提升视觉-语言-动作策略在分布外指令上的泛化能力。
AI-Care:用于阿尔茨海默病护理中任务协调的对话式代理系统
本文介绍了 AI-Care,这是一个对话式代理 AI 系统,旨在通过自然语言交互帮助阿尔茨海默病患者管理如日历提醒等日常任务。研究详细阐述了基于 LangGraph 的系统架构及安全控制措施,试点结果显示用户对系统具有高度信任且任务完成率高。