标签
Fal.ai 发布了 H3 Max,这是一款经过后训练的 MiniMax H3 变体,专门针对高质量视频生成进行了优化。据官方宣称,其在提示词遵循度、画面美学和生成速度方面均排名领先——生成 5 秒视频仅需约 3 秒,吞吐量达到官方 H3 模型的 35 倍。
H3 Max 是一个AI模型,能在不到3秒内生成5秒的768p视频,带有原生立体声音频,比实时更快,并在Design Arena和Artificial Analysis的图转视频类别中排名第一。一个演示展示了其在Twitch上的连续视频流应用。
有人优化了 Minimax H3 Max AI 模型,使其运行速度快于实时,创建了一个 Rick and Morty 风格的跨维度有线电视流,但该流经常被下架。
MiniMax M3 在 GMI Cloud 上免费可用,直至9月6日,同时也可通过 OpenRouter 访问。该平台还提供其他AI模型,如 M2.7、Speech 2.8 和 Music 3.0。
一位用户发现了一个GitHub仓库,它提供了用户友好的Minimax音乐生成UI,具有类似Suno的工作流程,简化了流程并避免了命令行问题。
用户分享购买MSI DGX Spark的经历,用于运行DeepSeek V4 Flash和DeepSeek Harness等AI模型,并探索Minimax H3和Music功能。
讨论比较了各种 AI 模型的训练成本,指出 Qwen 27B 和 DeepSeek V4 Flash 在每令牌 GPU 小时数上成本相似,强调了 MFU 在预训练效率中的作用。
五家中国领先AI初创公司——DeepSeek、Moonshot AI、Zhipu AI、MiniMax 和 MAAS——的综述简介,突出它们各自的战略、融资事件和市场定位。
Diffusers团队宣布了多个开源权重AI模型,包括MiniMax H3、LTX 2.5、Wan Animate 2和MiniMax Music 3,突显了在多模态视频和音频生成方面的进步。
MiniMax-Music3 gradio 工作流现在可作为 Hugging Face Space 使用,便于轻松使用音乐生成模型。
Matt Shumer 重点介绍了 GMI Cloud 提出的一种廉价且高效的可控视频生成工作流:先用代码创建低保真度的骨架场景,再通过视频模型使其变得逼真,成本仅为 1.97 美元。
AiOS San Francisco 是一场面向 AI 和 Apple 平台爱好者的线下聚会,届时 Wendy Labs 和 MiniMax 将带来关于 Swift 驱动的 AI、机器人、嵌入式设备,以及可在 Mac 上本地运行的 MiniMax H3 视频生成模型的演讲和演示。
一位中国用户就中国关于色情和法律审查的法律提供了背景说明,解释了为什么 MiniMax 和其他中国 AI 实验室限制 LoRAs 和内容生成以遵守严格的法律执行。
MiniMax发布了一款开放权重的视频模型,尽管许可证中带有区域限制。
Seedance 2.5 和 Minimax H3 这两款最先进的多模态视频生成器的上手对比。Seedance 在高动作编排、角色一致性和指令遵循方面胜出,而 Minimax 在音乐视频风格输出、价格、分辨率和开放权重可用性方面占优。
提供 MiniMax-H3 模型的 GGUF 量化版本的 Hugging Face 仓库,用于 ComfyUI,包含目录结构和所需 VAE 的链接。
MiniMax H3 在 Artificial Analysis 视频编辑排行榜上位居榜首,提供基于指令的多模态输入编辑现有片段,并具有竞争力的定价,同时计划开源权重供商业使用。