autoregressive-model

标签

Cards List
#autoregressive-model

VideoRAE:通过表示自编码器驯服视频基础模型进行生成建模

Hugging Face Daily Papers ↗ · 2026-07-15 缓存

本文介绍了VideoRAE,一种表示自编码器,它利用冻结的视频基础模型来创建紧凑、可重建且利于生成的视频潜在表示。该模型在UCF-101上取得了最先进的结果,且收敛速度优于其他自编码器。

0 人收藏 0 人点赞
#autoregressive-model

Xiaomi-Robotics-U0: 基于世界基础模型的统一具身合成

Hugging Face Daily Papers ↗ · 2026-07-13 缓存

小米机器人推出U0,这是一个380亿参数的多模态自回归模型,用于统一具身合成,将具身生成视为图像和视频生成的扩展。它在多个具身任务上取得了最先进的结果,超越了GPT-Image-2.0,并提高了真实世界操作的成功率。

0 人收藏 0 人点赞
#autoregressive-model

MotionVLA:用于人形机器人运动的视觉-语言-动作模型

Hugging Face Daily Papers ↗ · 2026-06-13 缓存

提出MotionVLA,一种用于人形运动生成的视觉-语言-动作模型,采用双流频率分词器分别编码姿态和物理动态,实现了更高的多样性和一致性。

0 人收藏 0 人点赞
#autoregressive-model

ARM:采用统一离散表示的自回归大型多模态模型

Hugging Face Daily Papers ↗ · 2026-06-09 缓存

ARM提出了一种统一的基于离散语义标记化和强化学习优化的自回归框架,用于图像理解、生成与编辑,并展示了跨任务协同效果。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈