AREX Feed Article
fal 后训练的 MiniMax H3 Max 上线 ComfyUI,开源权重仍未发布
9 月 5 日 9 时 55 分(北京时间),ComfyUI 官方账号宣布 MiniMax H3 Max 已上线 ComfyUI。这是 ,官方帖称该模型「为速度与精度而训练(trained for speed and precision)」,同时说明:这套后训练版本的开源权重尚未发布,原话是「已经等不及开放权重了(Can't wait for the open weights!)」。
官方账号随后的交代了落地形态:随附工作流还带有 MiniMax 团队的 Context IR(Prompt Enhancer 提示词增强)节点与 Regenerate to 2K 放大节点。这次进入 ComfyUI 的是托管调用版 H3 Max;本地可跑所依赖的那份开源权重,仍停留在「等待」状态。
一条 5 秒视频,约 3 秒生成
H3 Max 是 :由 fal Research 以开源权重的 MiniMax H3 为起点做后训练,重点提升提示词遵循度(prompt adherence)与视觉质量,fal 的推理团队再围绕模型本身协同设计推理引擎,模型从训练到上线全部跑在 NVIDIA GB200 NVL72 系统上。fal 声称,任何以牺牲质量换取速度的优化都不会被保留,只有模型在内部质量评估中守住位置的速度优化才算数。
fal 给出的核心数字是:一条 5 秒视频约 3 秒生成完毕,吞吐量约为官方 MiniMax H3 端点的 35 倍,平均比同等质量的模型快 15 倍,全部出自 fal 自己的测试口径。fal 在 中还引用了第三方榜单数据:H3 Max 以 Elo 1,341 排在 Design Arena 图生视频榜第一(官方 MiniMax H3 为 1,333),以 Elo 1,201(2,177 个样本)排在 Artificial Analysis 带音频图生视频榜第一,数据截至 8 月 26 日;fal 自己的 12 模型头对头人类偏好测试中,H3 Max 在整体质量、提示词理解与美学三项均排第一。MiniMax H3 团队在该新闻稿中表态,称「从第一天起就与 fal 密切合作」,双方将一起把它带给全球开发者。
价格同样来自发布方口径:768p 输出的推广价为每秒 0.04 美元,为期一周的折扣到 9 月 7 日结束,之后恢复到每秒 0.08 美元。
ComfyUI 里怎么跑:托管节点,按秒计费
ComfyUI 对 MiniMax H3 的接入分成两条线。一是 :按文档说明,这类 API 工作流把生成放到托管服务上执行,用户不需要下载模型、不需要本地 GPU,每生成一秒视频计费到 Comfy API 账户,输出最长 15 秒、带原生立体声。二是 8 月初就加入的本地推理支持,针对的是已开源的 H3 权重。
两条线的先后顺序可以从 里看出:7 月 31 日的 v0.29.2 先接入 MiniMax H3 托管节点;8 月 3 日的 v0.30.0 加入基于开源权重的 MiniMax-H3 本地推理支持;8 月 13 日的 v0.33.1 增加 Context IR 提示词增强与 Regenerate to 2K 节点;9 月 2 日的 v0.34.3 把 H3 Max 作为模型选项加入文生视频、首尾帧与参考视频节点;9 月 4 日的 v0.34.4 又加入 H3 Max Turbo 选项。9 月 5 日,官方账号发帖正式宣布这批能力上线。
官方帖里提到的两个节点并非新东西,而是补齐了完整链路:Context IR 负责理解并改写多模态指令,H3 Max 生成 768p 结果,Regenerate to 2K 再把低清结果连同原始上下文回灌模型重绘出 2K。H3 Max 目前只提供托管形态,本地用户即使更新到最新版 ComfyUI,能跑 H3 Max 的方式也只有托管的 API 调用。
H3 开源的是底座,不是整套系统
按 的说明,完整 MiniMax H3 系统由三个模块组成,实际开源的只是其中一部分。Context-IR 是托管的提示词预处理系统,负责解析文本、图片、音频与参考视频之间的关系,不在开源发布之列;H3-Base 是唯一开源的生成底座,包含两套 33B 参数的 Omni-Transformer 权重(FL2VA 与 Ref2VA);Regenerate-2K 把 768p 结果重绘到 2K,同样未开源,模型卡写的是「准备好了就会发布」,目前只提供 API。
fal 的 H3 Max 正是在这个开源底座之上再训练出来的:底层权重公开,后训练配方与推理栈归 fal。如今连 fal 的这一层也还没公开。ComfyUI 本地侧目前能跑的开源模型是 H3-Base,社区随后为它做了量化适配(如 )。
「在那之前,它只是一段你租来的演示」
了 ComfyUI 的公告,措辞是「H3 Max 在速度与精度上排名第一,现在也上 ComfyUI 了」,同样没有提及权重发布的时间。这批转发与评论的焦点,几乎都落在「权重什么时候到」上。
自称做 AI 音乐视频的德州创作者 Dead Sun 转发时只问了一句:。简介自称「不加炒作的 AI 新闻(AI news without the hype)」的账号 Kabel-Salat 在原帖下把话说得更直接: 亚特兰大的中文博主 Wei 则已经在规划本地部署,他说:「我的 RTX PRO 6000 已经准备好,等本地版本出来就部署跑一跑,看看生成速度、提示词遵循和画质到底提升了多少」,理由是模型放在自己机器上可以反复改、反复生成,「不用每次点运行都先算一下要扣多少钱」。
这几条反应的落点一致:对已经能用开源 H3 在本地生成视频的社区来说,H3 Max 的增量目前只存在于托管端。9 月 2 日节点里出现 H3 Max 选项、9 月 4 日出现 Turbo 选项、9 月 5 日正式官宣,再到 9 月 6 日 fal 转发确认,双方始终没有给出权重发布的任何时间点。