Skip to main content
视频生成接口通过多模态 content 数组接收文本、图片、视频和音频,支持文生视频、图生视频、首尾帧生视频和多模态参考生视频。
本接口为异步接口。创建成功后返回平台任务 id,通过 查询 MiniMax H3 视频任务 获取任务状态和生成结果。

请求示例

请求参数

content 输入要求

每次请求必须包含且只能包含一个非空 text 项。支持以下输入组合:
  1. 文生视频:仅包含一个 textratio 必填且不能为 adaptive
  2. 图生视频 - 首帧text + 一张 role=first_frame 的图片;图片未设置 role 时按首帧处理。
  3. 图生视频 - 尾帧text + 一张 role=last_frame 的图片。
  4. 图生视频 - 首尾帧text + 一张首帧图片 + 一张尾帧图片。
  5. 多模态参考生视频text + reference_imagereference_videoreference_audio 的组合。
首帧或尾帧输入不能与多模态参考输入混用。reference_audio 必须同时搭配至少一张参考图片或一个参考视频。
图生视频的宽高比由输入图片决定,传 adaptive。多模态参考生视频可传 adaptive 或支持的固定比例。

素材限制

请求体总大小不能超过 64 MB。接近大小限制时请使用公网 URL,避免使用 Base64。

图片

视频

音频

多模态参考图片、视频和音频合计不能超过 12 个。
如果音频使用 Base64 Data URI,请使用 data:audio/mp3;base64,...data:audio/wav;base64,...。沙箱实测 data:audio/mpeg;base64,... 会被 MiniMax 上游识别为 .mpeg 并拒绝;公网 .mp3.wav 地址不受此限制。

创建响应

HTTP 状态码:202 Accepted

失败状态