标签
一个名为TAPEDECK的开源、自托管AI音乐生成电台工具,使用MiniMax Music 3从用户本地GPU上的音乐库创建无限的、个性化电台。
Minimax 正准备发布 Music 3 的开源权重版本,Diffusers 和 ComfyUI 中的活跃 PR 证明了这一点,演示已经可用,Comfy-Org 也暗示将在数小时内进行重大发布。
一个Hugging Face仓库,托管了为ComfyUI使用而转换的MiniMax-H3模型,以及用于加快推理的Lightx2v蒸馏LoRA。
MiniMax-H3 的早期预览版 LoRA 支持 4 步音视频生成,取代约 20 步,采样速度大约提升 5 倍,但质量仍不成熟。
MiniMax-H3 Turbo 4步音频-视频生成的第三方ComfyUI兼容LoRA转换,包含进一步训练的checkpoint-500变体及示例工作流。
这是 MiniMax-H3 的早期预览版 LoRA,支持在 4 步采样(而非约 20 步)内联合生成视频和同步音频,采样速度约提升 5 倍,并附带 ComfyUI 自定义节点和三个 bf16 检查点。
Scenema Audio,一款支持零样本声音克隆的表现力丰富的文本转语音模型,现已成为 ComfyUI 的原生自定义节点,并经过量化可在 8GB 显存上运行。此次发布新增了内联舞台指示提示、12 种预设语音,并简化了 ComfyUI 的提示词格式。
一篇病毒式传播的帖子讲述了一位匿名开发者如何构建了ComfyUI——一款强大的免费开源AI图像工具,并将其与Adobe的订阅费用以及近期与美国司法部的和解进行对比。帖子称赞ComfyUI免费、本地运行、采用GPL-3.0许可的发布方式。
Kijai 的 MiniMax-H3-experimental 是一个尚在开发中的模型,支持 w4a8 量化和用于 ComfyUI 的 int8_convrot VAE,仅为测试目的而发布。
Kijai 分享了一个为 MiniMax-H3 快速训练的二维微型 VAE,旨在改进 ComfyUI 中的潜空间预览。还附上了由 madebyollin 训练的更好的替代方案。
详解如何在 RTX 4080 16GB 上通过 ComfyUI 原生工作流本地运行 MiniMax H3 视频生成模型,包含模型下载、目录配置、参数调优及常见坑点。
一份实用的无审查 AI 图像生成器汇总,推荐严肃用户通过 ComfyUI 本地运行 FLUX,并通过 Atlas Cloud 使用 Krea 2 Turbo 和 Wan spicy 图像模型,以获得托管速度和提示词遵循能力。
发布一个NVFP4量化的无审查MiniMax-H3文本编码器(Qwen3-VL-32B Heretic),可适配在单张16GB GPU上,并可作为ComfyUI工作流中的直接替代品。
ComfyUI v0.27.0でネイティブ対応されたINT8 ConvRot量子化手法について、FP8を超える性能報告やモデル格納形式の分類を含む技術解説記事。
MiniMax H3 是新一代开放权重视频模型,能够根据文本、图像、视频或音频生成带有原生立体声的 2K 视频,并在发布当天就获得了 ComfyUI 支持及优化,使其能够在消费级 GPU 上运行。
该 Hugging Face 仓库提供了社区编译的 MiniMax H3(Hailuo 3.0)量化与剪枝权重,使得在拥有 16-24GB 显存的消费级 GPU 上能够进行本地文本/图像/音频到视频的生成。包含 INT4、INT8 和 NVFP4 变体,并附有硬件特定指南。
一个Hugging Face仓库,提供未经审查的Qwen3-VL-32B变体的ComfyUI safetensors检查点,包含BF16和INT8 ConvRot H3条件编码器以及可选的生成尾部。
该仓库提供 Qwen3-VL-32B 的 INT8 ConvRot 量化 ComfyUI safetensors,包括包含第 0-49 层的 MiniMax-H3 条件编码器,以及用于第 50-63 层的可选提示增强尾部,专为在 32GB GPU 上的 ComfyUI 使用而设计。
提供 MiniMax-H3 模型的 GGUF 量化版本的 Hugging Face 仓库,用于 ComfyUI,包含目录结构和所需 VAE 的链接。