video-action-model

标签

Cards List
#video-action-model

Zero-WAM:基于人类视频的上下文世界-动作建模,用于开放任务泛化

Hugging Face Daily Papers · 2026-08-26 缓存

Zero-WAM 是一个因果视频-动作模型,通过基于上下文的人类视频指导,实现对未见过任务的零样本机器人操作,并利用 HumanGen 数据集和未来块预测目标来提高泛化能力。

0 人收藏 0 人点赞
#video-action-model

@rohanpaul_ai: 大多数视频动作机器人模型都是带有动作模块的内容创作视频生成器。LingBot-VA 2.0 fr…

X AI KOLs Timeline · 2026-07-13 缓存

LingBot-VA 2.0 是一个从头开始为机器人控制训练的视频动作基础模型,实现了 225 Hz 的闭环执行,具有 13B 参数(每个 token 激活 1.9B),并在 RoboTwin 2.0 上优于之前的模型。

0 人收藏 0 人点赞
#video-action-model

关于这个机器人在1倍速下从移动传送带上抓取物体,有什么看法?

Reddit r/artificial · 2026-07-10

一个使用LingBot-VA 2.0视频动作模型的机器人,以1倍速实时从移动传送带上抓取物体,它预测未来运动而不仅仅是反应当前帧。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈