新浪AI前沿速递
如何使用MiniMax的API进行视频生成?
MiniMax H3和字节Seedance 2.5于2026年7月31日同日上线,一个走开源全模态路线、一个走闭源工业化路线,实测中互有胜负,但差距并非实力碾压,而是“懂成片”与“听指挥”的性格分歧。
一、两代模型的核心规格与定位差异
时长与画质:Seedance 2.5支持单次原生30秒直出,最高4K分辨率;H3最高15秒、2K分辨率,但自带原生双声道立体声。
参考素材规模:Seedance 2.5单次最多支持50个全模态参考(30张图+10段视频+10段音频);H3上限为9张图+3段视频+3段音频,合计12项。
价格与开源:H3官方API约0.8元/秒(2K),且已于8月3日开放模型权重;Seedance 2.5 API价格较上代上涨约50%,走闭源路线。
二、MiniMax H3的API调用核心方式
异步任务模式:H3视频生成API采用“创建生成任务→轮询任务状态→按文件标识取回结果”的工程链路,适合批量生产。
素材角色区分:在请求层区分首帧、尾帧、主体参考等素材角色,提示词中补充分镜与约束,避免商品变形、人物换脸等串台问题。
多模态输入规格:H3支持0/1/2张图像的FL2VA模式,以及最多12项混合素材的Ref2VA全模态参考模式。
三、实际选择建议:按业务场景而非参数堆砌
短带货/电商批量生产:H3凭借更低成本与稳定文字、品牌元素渲染,更适合程序化工作流与预算敏感场景。
长叙事/品牌片:Seedance 2.5的30秒原生直出与精准时间戳编辑,适合需要镜头连贯性和少拼接的创作。
本地部署与私有化:H3开源特性使团队可本地跑768p版本,而Seedance 2.5依赖字节云生态。
