PipeNetwork/minimax-h3-mlx

Simon Willison's Blog 工具

摘要

Simon Willison 重点介绍了 PipeNetwork/minimax-h3-mlx,这是一个将 MiniMax-H3 移植到 Apple Silicon 上的 MLX 的 Python 包,并演示了在 M5 Max MacBook Pro 上运行它,从文本提示生成视频。

暂无内容
查看原文
查看缓存全文

缓存时间: 2026/08/04 21:38

# PipeNetwork/minimax-h3-mlx 来源:https://simonwillison.net/2026/Aug/4/minimax-h3-mlx/ 2026年8月4日 — 链接博客 **PipeNetwork/minimax\-h3\-mlx(https://github.com/PipeNetwork/minimax-h3-mlx)**。MiniMax 两天前发布了 MiniMax\-H3(https://huggingface.co/MiniMaxAI/MiniMax-H3)——他们将其描述为“一个通用、全模态(omni-modal)的生成式系统”,实际上这意味着它可以接受文本、图像、音频和视频,并利用它们生成最长 15 秒、包含音频的视频片段。 这个 Python 包将其移植到 MLX,以便在 Apple Silicon 上运行。 我在我的 M5 Max MacBook Pro 上成功运行了它。我克隆了仓库,并按如下方式运行模型: `` # 首先下载模型 uvx --from huggingface_hub hf download MiniMaxAI/MiniMax-H3 \ --include 'FL2VA/*' --exclude 'FL2VA/transformer/*' uvx --from huggingface_hub hf download pipenetwork/MiniMax-H3-MLX-8bit # 现在运行提示词 uv run --with mlx-vlm \ --with-requirements requirements.txt python scripts/generate.py \ "a rainbow colored skunk leaps over a mossy log in a supermarket" \ -o skunk.mp4 \ -c ~/.cache/huggingface/hub/models--MiniMaxAI--MiniMax-H3/snapshots/fa9c8ab1eaa21c8ae25e7e40b83b2e6002f340af/FL2VA \ -t ~/.cache/huggingface/hub/models--pipenetwork--MiniMax-H3-MLX-8bit/snapshots/3ac52081470b0488921c3ec3ba84a39097bf2361 `` 以下是我针对这个提示词得到的视频: > `a rainbow colored skunk leaps over a mossy log in a supermarket` 您的浏览器不支持 HTML5 视频。 它下载了约 115 GB 的模型文件,视频生成耗时不到 45 分钟。 视频效果令人印象深刻,但音频部分是奇怪的、类似语音的噪声,因为我没有提供任何关于音频应该是什么样子的提示指导。提示词编写指南(https://huggingface.co/MiniMaxAI/MiniMax-H3/blob/main/docs/VIDEO_PROMPT_WRITING_GUIDE_base_en.md)(我在这次实验前没有读过)里有大量关于如何让这项功能正常工作的信息。

相似文章

MiniMax H3(10分钟阅读)

TLDR AI

MiniMax 发布 H3,这是一款开放的多模态生成模型,支持文本、图像、视频和音频,可生成最长 15 秒的 2K 视频并带有原生立体声,同时计划开源模型权重。