H3 Max Turbo 是 fal 推出的 H3 Max 高速低价版本,提供文生视频和图生视频 API。 截至 2026 年 9 月 3 日,这两个端点均可生成 5–15 秒、 480p 或 768p、带原生同步音频的视频。常规价格为 480p 每生成秒 0.025 美元、768p 每生成秒 0.04 美元,正好是 H3 Max 常规价格的一半。
这个名称很容易和社区项目混淆。H3 Max Turbo 是 fal 托管的独立模型;“H3 Turbo” LoRA 则是在本地减少采样步数的社区加速方案。 目前关于 Max Turbo 的公开信息主要来自 fal 的实时 API 文档和示例。由于还没有独立发布文章、技术报告或 Max 与 Turbo 的公开对照评测,“质量相同”仍是需要实测的供应商说法。
H3 Max Turbo速览
| 项目 | 截至 2026 年 9 月 3 日 |
|---|---|
| 服务方 | fal |
| 模型ID | minimax/h3-max-turbo/text-to-video、minimax/h3-max-turbo/image-to-video |
| 输入 | 文本;或文本加可选首帧与尾帧 |
| 输出 | 带原生同步音频的MP4 |
| 分辨率 | 480p或768p,默认768p |
| 时长 | 5–15秒 |
| 文生视频画幅 | 21:9、16:9、4:3、1:1、3:4、9:16 |
| 图生视频画幅 | 跟随首图 |
| 提示词扩写 | 当前Schema提供balanced或quality |
| 常规价格 | 480p每秒$0.025;768p每秒$0.04 |
| 促销价格 | 480p每秒$0.00625;768p每秒$0.01,至9月7日 |
| 参考转视频 | 未发现H3 Max Turbo参考端点 |
H3 Max Turbo是什么?
fal 将 H3 Max Turbo 描述为基于 MiniMax H3 继续训练,并针对提示词遵循、视觉表现和吞吐量优化的版本。它的公开接口与 H3 Max 接近: 提示词、时长、分辨率、种子、安全检查、提示词扩写,以及画幅或首尾关键帧。
Turbo 有独立模型 ID,价格更低,官方示例也更快。不过,fal 没有披露参数量、量化方式、采样步数或训练配方,也没有公布它与 H3 Max 的受控质量对比。 因此,“Turbo”更适合被理解为 fal 的产品档位,而不是已经公开技术细节的模型架构。
H3 Max Turbo API输入
| 工作流 | 端点 | 主要控制项 |
|---|---|---|
| 文本转视频 | minimax/h3-max-turbo/text-to-video | 提示词、时长、480p/768p、画幅、种子、安全检查、提示词扩写 |
| 图像转视频 | minimax/h3-max-turbo/image-to-video | 提示词、可选首帧、可选尾帧、时长、分辨率、种子、安全检查、提示词扩写 |
图生视频端点以image_url接收首帧,以end_image_url接收尾帧。如果省略首图,fal文档称请求会按文生视频处理,默认16:9;提供首图后,输出跟随其画幅。
两个端点都返回视频,也可能返回扩写后的提示词与timings.inference。这个时间只表示GPU后端去噪,不包括排队、提示词改写、上传下载和业务处理。
最小JavaScript调用示例
把FAL_KEY保留在服务端:
import { fal } from "@fal-ai/client";
const result = await fal.subscribe("minimax/h3-max-turbo/text-to-video", {
input: {
prompt:
"五秒赛璐璐动态漫画镜头。快递员在霓虹屋顶奔跑,雨点落在金属上。低机位跟拍。声音:脚步、雨声、远处车流。",
duration: 5,
resolution: "768P",
aspect_ratio: "16:9",
prompt_expansion_mode: "balanced",
},
});
console.log(result.data.video.url);
console.log(result.data.timings?.inference);
生产环境建议使用队列和 Webhook,避免长时间保持请求连接。每次生成应保存完整模型 ID、请求 ID、种子、原始与扩写提示词、调用时价格、后端推理时间和实际总耗时。
H3 Max Turbo到底有多快?
fal文生视频Playground的演示提示词中写有**“5秒视频用1.5秒生成”**。同一公开页面展示的15秒示例响应中,timings.inference约为 7.77秒。这些数字都来自 fal 示例,不能视为延迟分布或服务等级承诺。
它们也只统计后端去噪。公平测试应分别记录:
- 排队时间;
- 提示词扩写时间(文档称
balanced约1秒,quality最多约30秒); - 返回的
timings.inference; - 上传与结果传输时间;
- 端到端总耗时与失败率。
建议每组设置至少测试 20–30 次,并记录中位数和 P95 等尾部延迟。一次很快的 Playground 结果不能代表高负载时的真实表现。
H3 Max Turbo多少钱?
实时端点显示9月7日前减免75%。常规价格与当前临时价格如下:
| 时长 | 480p促销价 | 480p常规价 | 768p促销价 | 768p常规价 |
|---|---|---|---|---|
| 5秒 | $0.03125 | $0.125 | $0.05 | $0.20 |
| 10秒 | $0.0625 | $0.25 | $0.10 | $0.40 |
| 15秒 | $0.09375 | $0.375 | $0.15 | $0.60 |
价格按生成时长计算,而不是按最终可用时长计算。如果四次生成只有一次可用,仅生成环节的可用镜头成本就约为表中价格的四倍,还没算存储、审核、剪辑和放大。 促销可能不改模型ID就发生变化,提交任务时应重新查看实时端点价格。
H3 Max Turbo、H3 Max与标准H3怎么选?
| 问题 | H3 Max Turbo | H3 Max | fal上的标准MiniMax H3 |
|---|---|---|---|
| 更适合 | 低成本、高频率打样 | 快速生成并使用多模态参考 | 2K输出和视频编辑 |
| 分辨率 | 480p或768p | 480p或768p | 最高2K |
| 时长 | 5–15秒 | 5–15秒 | 5–15秒 |
| 文本/首帧/尾帧 | 支持 | 支持 | 支持 |
| 图像、视频、音频参考端点 | 未列出 | 支持,最多12个混合文件 | 支持 |
| 视频编辑端点 | 未列出 | 未列出 | 支持 |
| 原生音频 | 支持 | 支持 | 支持 |
| 768p常规价 | 每秒$0.04 | 每秒$0.08 | 取决于所选H3工作流 |
| 已公开推理示例 | 宣传5秒约1.5秒;15秒示例约7.77秒 | 5秒示例约2.53秒 | 取决于工作流 |
需要大量试稿、优先控制单价时,可以先选 Turbo;镜头需要按顺序引用图像、视频或音频时,选择 H3 Max;交付要求 2K 或模型内视频编辑时,则考虑标准 H3。 无论选择哪一款,都应使用自己的素材比较每秒可用成片的实际成本。需要查看完整端点与榜单信息,可参考 H3 Max 详细指南。
H3 Max Turbo不是H3 Turbo LoRA
搜索结果里还有“MiniMax H3 Turbo” LoRA与ComfyUI工作流。它们是面向开放权重H3基础模型的社区加速项目,通常把本地推理压缩到4步或8步采样。 这些方案使用不同检查点,有不同的安装、许可证、硬件和质量权衡。
生产记录应保留完整标识:
minimax/h3-max-turbo/...代表fal托管的H3 Max Turbo;- 具体Turbo LoRA检查点代表社区本地推理扩展;
minimax/h3-max/...代表fal完整H3 Max档位。
这样才能避免把价格、复现记录与许可证条件归到错误模型上。
动态漫画应该如何测试?
让Turbo与H3 Max使用相同提示词、支持时相同的种子、时长、分辨率和关键帧,至少覆盖:
- 带短台词的角色特写;
- 同一角色与服装的重复镜头;
- 有明确视线关系的双人构图;
- 手与道具互动的全身动作;
- 首尾帧过渡;
- 检验指令顺序的15秒多节拍镜头。
统一评估提示词遵循、脸部与服装一致性、动作、构图、文字、口型、声音、瑕疵、后端耗时、端到端耗时和每秒可用成片成本;条件允许时采用盲评。 在公开对照数据出现前,这种配对测试最能说明 Turbo 适合最终镜头,还是更适合预览。
AniKuku如何衔接?
H3 Max Turbo 负责生成镜头;剧本、镜头拆分、角色设定、故事板和版本历史仍需要制作系统管理。AniKuku 制作工作区可把这些资产留在同一项目中, 方便团队并排比较 Turbo 和其他模型,而不必围绕单一供应商重建流程。
常见问题
H3 Max Turbo能生成音频吗?
能。fal把两个Turbo端点都归为音画生成,公开示例也包含生成的声音环境和音乐描述。对白量较大时,应先测试目标语言和口型。
H3 Max Turbo支持首尾帧吗?
支持。图生视频Schema接受可选image_url与end_image_url,首帧决定输出画幅。
H3 Max Turbo支持参考转视频吗?
核验时没有列出独立的minimax/h3-max-turbo/reference-to-video端点。完整H3 Max已有可接收有序图像、视频和音频的参考端点。
H3 Max Turbo开放权重或可以下载吗?
目前没有公开可下载的H3 Max Turbo检查点与许可证,它是fal托管API档位。不要与可下载的社区H3 Turbo LoRA混淆。
Turbo质量与H3 Max相同吗?
fal端点简介称提高吞吐不牺牲输出质量,Krea则称它在保持提示词遵循的同时更快、更便宜。核验时尚无公开的Max与Turbo受控对照评测, 因此应把它视为供应商主张,并用配对生产提示词验证。
资料来源与核验日期
本文于2026年9月3日核验。价格、促销、示例与端点会继续变化。