video-foundation-model

标签

Cards List
#video-foundation-model

VideoRAE:通过表示自编码器驯服视频基础模型进行生成建模

Hugging Face Daily Papers · 2026-07-15 缓存

本文介绍了VideoRAE,一种表示自编码器,它利用冻结的视频基础模型来创建紧凑、可重建且利于生成的视频潜在表示。该模型在UCF-101上取得了最先进的结果,且收敛速度优于其他自编码器。

0 人收藏 0 人点赞
#video-foundation-model

@_akhaliq: LingBot-Video 已在 Hugging Face 上发布——基于 MoE 的视频基础模型,专为具身智能打造,300亿参数,仅……

X AI KOLs Following · 2026-07-08 缓存

LingBot-Video,一个基于 MoE 的 300 亿参数视频基础模型,专为具身智能设计,已在 Hugging Face 上发布。推理时仅 30 亿参数激活,并额外使用 7 万小时具身数据增强。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈