Antirez 为 Mac 打造 MiniMax H3 推理引擎
Antirez/h3.c: MiniMax H3 inference engine for Mac computers
Antirez 开源了 h3.c 项目,这是一个专为 Apple Silicon 打造的 MiniMax H3 推理引擎,利用 Metal 框架实现原生加速。项目支持从文本生成视频和音频,并提供交互式会话,允许用户通过命令调整首尾帧、参考图像及生成参数。教程详细展示了如何在 M3 Max 和 M5 Max 上通过调整去噪步数、Transformer 层数和内存复用策略,在速度与画质之间找到最佳平衡。无论是快速预览还是追求参考级质量,用户都能通过灵活配置获得理想的视频生成效果,且无需依赖云端服务。
在 M5 Max 上,四步去噪仅需约 3.5 秒,而参考版本则需要 26.4 秒。
HN 评论区
98- Meleagris
我一直在 M5 Pro 64GB MacBook Pro 上通过 ComfyUI 使用 MiniMax H3,效果极佳。
不过我得修改默认的 ComfyUI 工作流,改用 GGUF 量化版本(city96 的 ComfyUI-GGUF 自定义节点,用 UnetLoaderGGUF 替换原生加载器)[0]。
我使用的是标记为 Q5_K_M 的模型。也有 Q8_0 版本可用,大小 34GB,只要分辨率别太高,在 64GB 统一内存里也能轻松跑起来。
主要问题是速度,生成一个 20 步、480x864 分辨率、约 9 秒的片段,我得花一个多小时。所以光冲着提速这一点,这个引擎也值得试试。
r/StableDiffusion 子版块上有大量优质信息和工作流可以参考。
[0] https://huggingface.co/Abiray/MiniMax-H3-GGUF/tree/main/unet
- antirez
在 AMA 上,Minimax 表示 H3 可以支持稀疏注意力机制,那会带来巨大的速度提升!不知道这方面有没有新进展。H3 真的很酷。编辑:根据他们在 Reddit 帖子里提到的内容,我正在测试一个基于 --sparse-attention 的可选模式。
- linzhangrun
在我的 128GB M4 Max Mac Studio 上,用 ComfyUI 生成一段 15 秒 480p 的 MiniMax H3 视频需要花一个半小时。
现在让 Codex 着手部署它,希望能大幅提升速度 :-) 不管怎样,谢谢。
- diddid
这正是 DGX spark 在 LLM 任务上失去的部分优势得以弥补的地方,diffusion 和 cuda 就像花生酱和果酱一样天生一对。
- TechSquidTV
这还是需要 128GB 内存对吧?像我这种只有寒酸 96GB 的平民,只能望而却步,错过乐趣了。