CoToGrasp:基于标准工作空间学习的接触拓扑条件化灵巧抓握合成
摘要
CoToGrasp是一个生成式框架,它使用标准工作空间来合成基于特定接触拓扑的多样化、稳定的抓握,实现零样本泛化,并在DexGraspNet数据集上超越了现有的规划器。
查看缓存全文
缓存时间: 2026/08/21 16:12
论文页面 - CoToGrasp:基于典范工作空间学习的接触拓扑条件灵巧抓取合成
来源:https://huggingface.co/papers/2608.19776
摘要
CoToGrasp 是一种生成框架,它利用与物体无关、以夹持器为中心的工作空间,在特定接触拓扑条件下合成多样且稳定的抓取,实现零样本泛化。
当前的灵巧抓取规划器主要针对物理稳定性进行优化,重点关注物体能否被抓取,而非如何抓取才能支持下游功能任务。然而,基于特定人类抓取分类体系来条件化抓取合成,通常需要成本高昂、带有物体标注的数据集。为解决这些局限性,我们提出了 CoToGrasp,一种新颖的生成框架,它在特定接触拓扑条件下严格合成多样且稳定的抓取。为绕过数据收集瓶颈,CoToGrasp 完全采用与物体无关的方式进行训练。我们引入了一种基于特征的典范工作空间,它将局部物体特征投影到统一的以夹持器为中心的域中,从而有效地将语义功能意图与任意物体几何形状解耦。通过在此工作空间中学习夹持器的内在接触流形,我们的模型在推理时实现了对未见物体的零样本泛化。在大规模 DexGraspNet 数据集上的广泛评估表明,CoToGrasp 达到了最先进的性能,超越了现有的分类体系引导规划器。最后,我们在物理机器人平台上验证了我们合成的接触拓扑在物理上的可行性和运动学上的可行性。代码可在我们的项目网站 https://cea-list.github.io/cotograspweb/ 获取。
查看 arXiv 页面 (https://arxiv.org/abs/2608.19776)查看 PDF (https://arxiv.org/pdf/2608.19776)项目页面 (https://cea-list.github.io/cotograspweb/)GitHub3 (https://github.com/CEA-LIST/CoToGrasp)添加到收藏集 (https://huggingface.co/login?next=%2Fpapers%2F2608.19776)
在您的智能体中获取本文:
hf papers read 2608.19776
没有最新 CLI?curl -LsSf https://hf.co/cli/install.sh | bash
引用本文的模型0
无模型链接此论文
在模型 README.md 中引用 arxiv.org/abs/2608.19776 以从本页链接。
引用本文的数据集0
无数据集链接此论文
在数据集 README.md 中引用 arxiv.org/abs/2608.19776 以从本页链接。
引用本文的 Space0
无 Space 链接此论文
在 Space README.md 中引用 arxiv.org/abs/2608.19776 以从本页链接。
包含本文的收藏集0
无收藏集包含此论文
将本文添加到收藏集 (https://huggingface.co/new-collection) 以从本页链接。
相似文章
GOAG: 用于灵巧机器人操作的生成式与物体无关的抓取规划器
GOAG 是一种深度生成抓取规划器,它学习特定抓手的接触面分布,为未见物体采样有效抓取,无需针对特定物体的训练,在 MultiDex 数据集上实现了灵巧机器人操作的最先进结果。
SeededGrasp:复杂场景中多形态语言引导的抓取
SeededGrasp 提出了一种数据高效的框架,利用视觉语言模型预测种子点,用于轻量级抓取生成器的条件输入,从而在复杂场景中实现多机器人形态的语言引导抓取。该方法在仿真中达到72%的成功率,在实际中达到78%,优于基线方法,并包含一个全新的大规模多形态抓取数据集。
DexJoCo: 面向任务的灵巧操作在MuJoCo上的基准测试与工具包
DexJoCo 提出了一个面向任务的灵巧操作在 MuJoCo 中的基准测试与工具包,包含11个功能性任务、一个低成本数据采集系统,以及全面评估,揭示了当前灵巧操作策略的局限性。
DeVI:基于物理的灵巧人-物交互,通过合成视频模仿实现
DeVI 提出一种框架,借助混合 3D-2D 跟踪奖励,将文本驱动的合成视频转化为具备物理可信度的灵巧机器人控制,实现对未见物体的零样本泛化。
人类通用抓取
一种流匹配模型可从RGB-D图像生成多样化的人类抓取动作,实现零样本机器人抓取,性能优于现有方法。该模型在大规模自我中心数据集上训练,在新基准测试中显著超越当前最先进的基线方法。