中国MiniMax H3成为首个登顶AI视频排名的开放模型(2分钟阅读)

TLDR AI 模型

摘要

MiniMax发布了开放权重的H3视频模型,这是首个登顶AI视频排名的开放模型,在视频编辑中排名第一,在文本生成视频中排名第二。该33B参数模型可处理文本、图像、视频和音频,但部分组件如2K分辨率和H3-Context-IR仍未开放。

Artificial Analysis将MiniMax H3评为视频编辑第一、文本生成视频第二、图像生成视频第三。
查看原文
查看缓存全文

缓存时间: 2026/08/04 13:30

# 中国 MiniMax H3 成为首个登顶 AI 视频排行榜的开源模型 来源:https://the-decoder.com/chinas-minimax-h3-is-the-first-open-model-to-top-an-ai-video-ranking/ **MiniMax 发布 H3 视频模型权重,开源模型首次登顶视频排行榜。**Artificial Analysis (https://x.com/ArtificialAnlys/status/2083042088338538594) 将 H3 评为视频编辑第一名、文生视频第二名、图生视频第三名。这款 330 亿参数的模型可同时处理文本、图像、视频和音频,生成 4 到 15 秒带立体声的视频片段。根据模型卡 (https://huggingface.co/MiniMaxAI/MiniMax-H3) 说明,单个提示词最多可包含九张参考图像、三个视频片段和三个音频片段。 *视频来自**MiniMax H3** 不过,有两个部分仍然保持闭源。2K 分辨率模块和 H3-Context-IR(负责将提示词和参考素材转换为结构化中间格式)未被包含在内。在 ComfyUI 中本地运行 H3 最高支持 768p,用户需要自行按照 MiniMax 发布的提示词指南来处理上下文准备。开放权重确实允许针对自定义素材、角色或特定视觉风格进行微调。许可证方面有一个限制:仅允许年收入低于 2000 万美元的公司进行商业使用。 字节跳动同日发布了闭源的 Seedance 2.5 (https://the-decoder.com/bytedances-seedance-2-5-generates-30-second-video-clips-with-built-in-audio/),可生成带内嵌音频的 30 秒视频片段。 ### 无炒作的 AI 新闻——由人工精选 订阅 THE DECODER,享受无广告阅读、每周 AI 资讯、每年六次的独家"AI 雷达"前沿报告、完整存档访问权限以及评论区访问权限。 立即订阅 (https://the-decoder.com/subscription/)

相似文章

MiniMax H3(10分钟阅读)

TLDR AI

MiniMax 发布 H3,这是一款开放的多模态生成模型,支持文本、图像、视频和音频,可生成最长 15 秒的 2K 视频并带有原生立体声,同时计划开源模型权重。

fal 发布 H3 Max

Product Hunt

Fal.ai 发布了 H3 Max,这是一款经过后训练的 MiniMax H3 变体,专门针对高质量视频生成进行了优化。据官方宣称,其在提示词遵循度、画面美学和生成速度方面均排名领先——生成 5 秒视频仅需约 3 秒,吞吐量达到官方 H3 模型的 35 倍。