image-to-video

标签

Cards List
#image-to-video

@_akhaliq:SCoPE 用于视频扩散Transformer的视线坐标位置编码 模型:https://huggingface.co/TencentAR…

X AI KOLs Timeline · 2026-08-13 缓存

SCoPE 是 TencentARC 提出的一个模型,它将相机视线作为位置坐标添加到预训练的视频扩散 Transformer 中,从而能够在保持图像到视频先验的同时实现相机轨迹控制。该发布包含一个用于 Wan2.2-I2V-A14B 推理的自包含检查点。

0 人收藏 0 人点赞
#image-to-video

@yoheinakajima:一个人的模糊是另一个人的运动数据,用以解码

X AI KOLs Following · 2026-08-11 缓存

介绍了Blur2Vid,一种从运动模糊图像生成视频的方法,发表于SIGGRAPH Asia 2025。

0 人收藏 0 人点赞
#image-to-video

lightx2v/Minimax-h3-Turbo

Hugging Face Models Trending · 2026-08-07 缓存

面向 Minimax-h3-Turbo 视频生成模型的 Hugging Face 页面,提供通过 Diffusers 及 Colab/Kaggle 笔记本使用该模型的说明。

0 人收藏 0 人点赞
#image-to-video

中国MiniMax H3成为首个登顶AI视频排名的开放模型(2分钟阅读)

TLDR AI · 2026-08-04 缓存

MiniMax发布了开放权重的H3视频模型,这是首个登顶AI视频排名的开放模型,在视频编辑中排名第一,在文本生成视频中排名第二。该33B参数模型可处理文本、图像、视频和音频,但部分组件如2K分辨率和H3-Context-IR仍未开放。

0 人收藏 0 人点赞
#image-to-video

@heyshrutimishra: MiniMax H3 刚刚成为 AI 领域最好的视频编辑器。在 Artificial Analysis 的视频编辑排行榜上排名第1,在文字转视频中排名第2…

X AI KOLs Following · 2026-07-31 缓存

MiniMax H3 在 Artificial Analysis 视频编辑排行榜上位居榜首,提供基于指令的多模态输入编辑现有片段,并具有竞争力的定价,同时计划开源权重供商业使用。

0 人收藏 0 人点赞
#image-to-video

Comfy-Org/MiniMax-H3

Hugging Face Models Trending · 2026-07-30 缓存

Comfy-Org 为 ComfyUI 重新打包了 MiniMax-H3 模型文件,包括扩散模型、文本编码器和 VAE,并提供了用于文本生成视频、图像生成视频和参考生成视频的工作流模板。

0 人收藏 0 人点赞
#image-to-video

Flux 3

Hacker News Top · 2026-07-24 缓存

Black Forest Labs 宣布推出 FLUX 3,这是一个多模态基础模型,能够共同从图像、视频和音频中学习,实现跨模态的统一生成和理解,现已开放早期访问。

0 人收藏 0 人点赞
#image-to-video

GraphVid:交互式图可控视频生成

Hugging Face Daily Papers · 2026-07-23 缓存

GraphVid 提出了一种基于图条件的图像到视频生成模型,通过结构化交互图实现交互式控制,在 FID 和 FVD 上较先前方法有显著降低,表现优异。

0 人收藏 0 人点赞
#image-to-video

日本加速视频生成,推出新系列动漫生成模型。

Reddit r/singularity · 2026-07-20 缓存

日本AIdea Labs发布了AnimeGen,一款免费的动漫风格视频生成AI模型,支持文本到视频和图像到视频,允许商业使用。

0 人收藏 0 人点赞
#image-to-video

CineMobile:用于电影级摄像机运动生成的设备端图像到视频扩散

Hugging Face Daily Papers · 2026-07-04 缓存

本文介绍了CineMobile,一种高效的设备端图像到视频生成方法,通过蒸馏引导剪枝、扩散蒸馏和混合量化,相较于教师模型实现了40倍加速,使得在移动设备上实现电影级摄影机运动效果成为可能。

0 人收藏 0 人点赞
#image-to-video

Pixlie

Product Hunt · 2026-06-19

Pixlie 是一个 AI 视频工作室,能够实现文本和图像到视频的转换,并具备真正的控制能力。

0 人收藏 0 人点赞
#image-to-video

Go-with-the-Track: 基于点追踪的视频合成与运动控制

Hugging Face Daily Papers · 2026-06-18 缓存

Go-with-the-Track 使用点轨迹嵌入与空间感知编码及视频扩散变压器,统一了视频生成中的运动控制与参考图像合成,在单一模型中实现了卓越的运动与参考控制。

0 人收藏 0 人点赞
#image-to-video

两步物理:在视觉细化之前锁定运动先验以防止其被抹除

Hugging Face Daily Papers · 2026-06-04 缓存

PhaseLock是一个无需训练的框架,通过从早期步骤推理中保留运动先验来提高图像到视频扩散模型的物理一致性,以最小开销实现6.2个百分点的提升。

0 人收藏 0 人点赞
#image-to-video

AAD-1:一步自回归视频生成的非对称对抗性蒸馏

Hugging Face Daily Papers · 2026-06-02 缓存

AAD-1 引入具有分阶段训练的非对称对抗性蒸馏,以实现一步自回归视频生成,在 VBench 上优于先前方法。

0 人收藏 0 人点赞
#image-to-video

@HuggingPapers: 字节跳动刚刚在Hugging Face上发布了Bernini,通过文本、图像或参考视频生成或编辑视频,媲美最佳…

X AI KOLs Following · 2026-06-01 缓存

字节跳动发布了Bernini,一个开源的视频生成与编辑模型,可在Hugging Face上获取,性能媲美顶级闭源模型。

0 人收藏 0 人点赞
#image-to-video

@FinanceYF5: 同一家公司,两代产品,52分的差距 Grok-Imagine-Video-1.5-Preview(720p)登上了 Image-to-Video Arena 第一名! 相比 Grok-Imagine-Video(720p),它大幅提升了 …

X AI KOLs Timeline · 2026-05-31 缓存

Grok-Imagine-Video-1.5-Preview(720p)在 Image-to-Video Arena 中获得第一名,比前代产品提升了52分,超过了 Seedance-2.0 和 HappyHorse 等顶级视频模型。

0 人收藏 0 人点赞
#image-to-video

nvidia/Cosmos3-Super-Image2Video

Hugging Face Models Trending · 2026-05-21 缓存

NVIDIA 发布 Cosmos3-Super-Image2Video,该模型能够根据输入图像和文本指令生成时间上连贯的视频序列,是面向物理 AI 应用的 Cosmos 3 全模态世界模型平台的一部分。

0 人收藏 0 人点赞
#image-to-video

Efficient-Large-Model/SANA-WM_bidirectional

Hugging Face Models Trending · 2026-05-18 缓存

SANA-WM 是一个高效的 2.6B 参数开源世界模型,用于分钟级视频生成并具备精确的相机控制。它采用混合线性扩散变换器和两阶段流水线,从图像和文本提示生成 720p 视频。

0 人收藏 0 人点赞
#image-to-video

我一直在为AI社区构建一些东西,希望能得到一些早期反馈。

Reddit r/AI_Agents · 2026-05-17

Dhee 是一款新型智能视频生成AI,能够根据单一描述生成视频,自动处理提示词、图像生成与合成,并支持逐镜头编辑以进行精细调整。

0 人收藏 0 人点赞
#image-to-video

@Jaaneek: 不仅能聊天,还能生成图像、搜索 X、图像转视频,只需普通 Grok 订阅!

X AI KOLs Following · 2026-05-15 缓存

Grok AI 现已向所有普通订阅用户提供图像生成、X 搜索和图像转视频功能。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈