@RisingSayak: 我们刚刚发布了Diffusers的新版本!其中包括许多新的图像和视频流水线(Ideogram4、MotifVideo等…
摘要
Diffusers库已更新,新增了包括Ideogram4、MotifVideo以及DiffusionGemma模型在内的图像和视频流水线。
查看缓存全文
缓存时间: 2026/07/06 02:00
我们刚刚发布了新版本的Diffusers!
其中包括许多新的图像和视频管线(如Ideogram4、MotifVideo等)。
同时,也包含了近期备受欢迎的DiffusionGemma 🤌
查看说明获取完整详情。https://t.co/49lDK8Vnnk
相似文章
介绍模块化扩散器 - 用于扩散管道的可组合构建块
Hugging Face 推出了模块化扩散器(Modular Diffusers),这是一个使用可组合、可重用的构建块而非单体管道实现的新框架,用于构建扩散管道。该系统允许灵活地混合匹配图像生成工作流的组件,并支持与 Mellon 等可视化工作流工具的集成。
@omarsar0: 太棒了!我最近花了很多时间在研究扩散LLM上,所以这真是完美的时机。我觉得有……
Google DeepMind 发布了 DiffusionGemma,这是一个开放实验模型,以块的形式生成文本而非逐词生成,实现了自我修正和更快的输出。
@volokuleshov: 恭喜谷歌开源Gemma Diffusion!我想特别感谢一组非常有才华的康奈尔大学学生,他们在实验室开发了这个模型中许多新想法:
谷歌已开源DiffusionGemma,这是一种基于扩散的新型文本生成模型,采用块扩散和高效的编解码器技术,康奈尔大学的研究人员也做出了贡献。
使用 NVIDIA NeMo Automodel 和 🤗 Diffusers 大规模微调视频和图像模型
NVIDIA NeMo Automodel 与 Hugging Face Diffusers 集成,支持对扩散模型进行可扩展的分布式微调,用于图像和视频生成,支持的模型包括 FLUX.1-dev、Wan 2.1 和 HunyuanVideo。
@_philschmid: Gemma 迎来扩散模型!DiffusionGemma 每秒可处理高达1000+个token! - 基于Gemma 4构建,为26B MoE模型。 - 3.8B…
DiffusionGemma 是一个基于 Gemma 4 的 26B MoE 模型,通过扩散模型以256个token的块进行文本生成,每秒可处理超过1000个token,经量化后可在18GB显存内运行,已根据 Apache 2.0 许可发布。