MiniMax H3 是目前最易测试的新模型;Seedance 2.0 是当前公平的对比版本;Seedance 2.5 尚未准备好。 H3 提供文档化的托管 API,支持 2K 输出、原生立体声、多模态参考及公开的供应商定价。Seedance 2.0 拥有文档化的国际 BytePlus 路径。Seedance 2.5 虽然官方发布,但 Dreamina 仍在 2026 年 8 月 1 日标注“即将推出”。
任何可信的对比都不应将 Seedance 2.0 的输出标记为 2.5,也不应在模型可选且测试设置可复现前宣布 2.5 胜出。
Seedance 与 MiniMax H3 一览
| 生产问题 | MiniMax H3 | Seedance 2.0 | Seedance 2.5 |
|---|---|---|---|
| 当前访问方式 | 通过 fal 托管 API 实时访问 | 通过 BytePlus 国际文档化访问 | 官方页面显示“即将推出” |
| 最大文档化时长 | 15 秒 | 视模式而定,最长 15 秒 | 标称标准模式最长 30 秒 |
| 输出分辨率 | 2K,24 FPS | 多种文档化分辨率和模式 | Dreamina 标称 4K |
| 原生音频 | 是,当前 H3 代支持立体声 | 是,支持音视频同步生成 | 是,官方产品页面确认 |
| 参考输入 | 最多 9 张图片,3 段视频,3 段音频;共 12 个文件 | 支持文本、图片、视频和音频参考 | Dreamina 官方页面标称最多 50 个多模态输入 |
| 首尾帧 | 专用托管端点 | 需确认所选 Seedance 模式 | 未公开作为国际 API 文档 |
| 本地编辑 | 作为核心 H3 工作流推广 | 依赖公开的 Seedance 工作流 | 作为核心功能推广 |
| 公开托管价格 | fal 上 2K 输出每秒 $0.26 | 查看实时 ModelArk 计划和设置 | 无公开国际价格验证 |
| 开源权重 | 已宣布;检查点尚未验证 | 无公开权重发布 | 无公开权重发布 |
表格比较的是文档化的工作流事实,而非通用视觉质量评分。供应商默认设置、安全过滤、随机种子、参考和后期处理均会影响结果。
观看 MiniMax H3 与 Seedance 2.0 对比视频
请用此视频设计测试问题,而非直接判定胜负。确认双方是否使用相同的源图像、动作参考、提示词、时长、宽高比、音频指令及重试次数。若缺少这些控制,视频仅供创意展示,非可复现的基准测试。
官方发布页面同样存在此限制。MiniMax、fal、ByteDance 和 Dreamina 选择展示能体现预期能力的输出,不公开每个片段背后的被拒绝生成。
可用性:H3 今日赢得新模型测试
MiniMax 于 7 月 31 日发布 H3,fal 同时开放文本转视频、图像转视频及多模态参考端点。团队现在即可查看架构、提交任务并估价。
Seedance 需要版本管理:
- Seedance 2.0 是当前国际文档化的模型系列,可用于基准测试和集成。
- Seedance 2.5 有官方 Dreamina 页面和详细功能声明,但页面仍显示“即将推出”,其独立国际模型 ID 和价格未公开。
这并不意味着 H3 视觉效果更好,而是 8 月 1 日时 H3 更易于操作评估。
视频质量:测试失败模式,而非演示光鲜
两大模型系列均针对电影级动作、同步音频、参考引导生成及复杂创意指导。 真正差异体现在重复镜头,而非首页最佳片段。
至少评估以下失败模式:
- 遮挡或镜头转动后的人脸和服装漂移;
- 手部接触物体时形状变化;
- 道具在角色间移动或消失;
- 镜头移动时背景几何重置;
- 多镜头间对话时序和声音身份;
- 运动和透视中可读文本的保持;
- 动作参考被遵循但未复制不想要的外观;
- 本地编辑改变已确认区域。
H3 发布材料特别强调排版、界面动画、产品渲染和动作迁移。Seedance 的文档优势在于故事导向的多模态控制、镜头指导和音视频生成。这些是合理的假设起点,而非结论。
参考与控制
H3 目前有最明确的数值限制。其托管参考端点支持最多 9 张图片、3 段视频和 3 段音频,总计不超过 12 个文件。这足以将角色身份、服装、场景、镜头运动、表演和声音分成独立参考。
Seedance 2.0 支持文本、图片、视频和音频,具体限制依赖于所用模型和供应商工作流。Seedance 2.5 在 Dreamina 官方页面将多模态输入上限提升至 50。
更多参考不一定带来更好控制。冲突素材可能降低一致性。制作提示应明确每个输入的角色:“图片 1 定义身份”,“视频 1 仅定义动作”,“音频 1 定义声音,不控制节奏”。
音频与编辑
H3 当前托管生成端点返回原生立体声音频。MiniMax 描述了对话、配乐、音效、环境声、声音迁移和对话替换。Seedance 2.0 也文档化了音视频同步生成,Dreamina 推广 2.5 的更清晰多语种输出和本地化编辑。
音频应与画面分开评估。视觉更强的结果仍可能因声音变化、无指令出现的背景音乐或语音时序无法本地化而失败。
编辑时,从一个已确认片段开始,提出单一可测变更:替换道具、重写标识、重新照明背景或更改一行台词。胜出工作流是能保留已确认像素、动作和时序的,而非产生最戏剧化二次渲染的。
API 与定价
fal 当前对 H3 文本转视频和图像转视频定价为2K 输出每秒 $0.26。10 秒基础生成费用为 $2.60,未含重试和审核成本。参考转视频按同一输出速率计费,额外图片和输入视频可能产生附加费用。
Seedance 2.0 价格因具体 ModelArk 模型、时长、分辨率、账户和当前计划而异。请使用实时计费页面,避免导入旧的固定每视频估价。Seedance 2.5 无公开独立国际价格验证。
成本比较应报告:
(生成 + 参考费用 + 重试 + 人工审核 + 修复) ÷ 通过秒数
请求更便宜不代表总成本低,若需三次重试或人工修复,反而更贵。
开源权重与供应商风险
MiniMax 表示 H3 权重将在发布后几天内公开。这可能使 H3 与封闭视频 API 有实质区别:团队可检查许可,自行部署模型,微调或使用更广泛的供应商生态。
截至本更新,检查点、许可、硬件需求和官方运行时尚未公开验证。请勿仅凭公告设计自托管部署。
Seedance 仍为封闭供应商模型,简化了托管访问,但增加了对区域可用性、供应商配额、内容审核、定价和模型退役的依赖。无论哪种情况,请将项目数据和已确认素材保存在模型之外。
你该选哪个模型?
当你需要实时托管通道、固定 2K 定价、原生立体声、首尾帧、明确多模态参考限制、排版或 UI 动画,或期待开源权重时,选择MiniMax H3 作为下一个基准。
当你已使用 BytePlus,需其故事导向参考工作流,或有历史 Seedance 提示和已确认片段对比时,选择Seedance 2.0 作为下一个基准。
将Seedance 2.5 视为观察名单模型,非默认依赖,直到目标账户开放访问且一方 API 文档明确模型、限制和价格。
对许多团队而言,正确答案不是单一供应商。使用供应商中立的镜头记录,将产品片段、对话、动画或复杂动作分配给通过该镜头验收标准的模型。
公平的 Seedance 与 H3 基准测试
构建 12 至 20 个镜头套件,测试前冻结输入:
- 使用相同提示含义和源素材;
- 尽可能匹配时长、宽高比和输出分辨率;
- 每个镜头生成至少三次尝试;
- 保留所有输出,而非仅首选结果;
- 分别评分身份、动作、镜头、构图、音频和文本;
- 记录延迟、审核失败、重试和计费成本;
- 评审时不透露供应商名称;
- 计算通过率和每秒通过成本。
AniKuku 存储脚本、场景、镜头、角色、参考、提示历史和生成版本作为项目数据,确保模型对比可复现,且单个失败镜头可切换供应商,无需重建剧集。
常见问题
MiniMax H3 比 Seedance 2.0 更好吗?
没有绝对赢家。H3 定价更清晰,支持 2K 输出、原生立体声和明确参考限制。Seedance 2.0 拥有成熟的多模态故事工作流。请比较你发布镜头的通过率。
MiniMax H3 比 Seedance 2.5 更好吗?
此对比尚早。Dreamina 仍标注 Seedance 2.5 即将推出,尚无可复现的公开 2.5 测试。
哪个模型更便宜?
fal 对 H3 2K 输出定价为每秒 $0.26。Seedance 费用取决具体供应商模型和设置,2.5 无独立国际价格验证。请比较每秒通过成本。
哪个模型更适合角色一致性?
两者均支持参考驱动工作流,但模型名称不保证跨镜头身份一致。请测试同一角色的特写、全身动作、遮挡、对话及后续匹配镜头。
我能本地运行任一模型吗?
Seedance 不公开模型权重。MiniMax 宣布 H3 权重,但截至 8 月 1 日官方检查点和许可未验证。H3 托管访问现已可用。
相关指南
- MiniMax H3 发布、规格、API、定价与演示
- Seedance 2.5 发布、访问、API 与定价状态
- Seedance 2.0 API 定价与设置
- Seedance 电影级提示框架
- AI 动漫制作工作流