audio-visual-generation

标签

Cards List
#audio-visual-generation

开源全模态世界模型(GitHub仓库)

TLDR AI · 昨天 缓存

JoyAI-Echo是一个开源的GitHub仓库,提供长期音视频生成和全模态世界模型,用于创建持久故事和交互式世界。

0 人收藏 0 人点赞
#audio-visual-generation

持久故事与交互式世界的长时间音视频生成

Hugging Face Daily Papers · 3天前 缓存

本文介绍了JoyAI-Echo-1.5,这是一个统一的音视频生成系统,适用于长视频和交互式世界,使用跨镜头记忆和几何感知控制来保持连贯性和持久性。

0 人收藏 0 人点赞
#audio-visual-generation

EchoWM:开放且可进入的全模态世界模型

Hugging Face Daily Papers · 3天前 缓存

EchoWM 介绍了一种开放的全模态世界模型,能够生成同步的视频、声音、音乐和语音,并支持连续的6自由度导航,用于可进入的生成媒体。

0 人收藏 0 人点赞
#audio-visual-generation

LongAV-Compass:面向分钟级音视频生成在T2AV、I2AV和V2AV上的统一评估

Hugging Face Daily Papers · 2026-05-25 缓存

LongAV-Compass是一个综合基准,用于评估分钟级音视频生成在文本、图像和视频条件模态下的表现,衡量长时间序列上的质量、一致性和对齐程度。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈