文生视频
视频生成 V2 接口,通过多模态 content 数组输入(文本 / 图片 / 视频 / 音频),支持文生视频、图生视频(首尾帧)、多模态参考生视频,2K 直出。
授权
在请求头中传入 Authorization: Bearer <token>。
请求头
请求体的媒介类型,请设置为 application/json。
application/json 请求体
模型名称。当前可用值:MiniMax-H3、MiniMax-H3-Max。
- MiniMax-H3:支持文生视频、图生视频(首帧 / 尾帧)与多模态参考生视频;分辨率 768P / 2K,时长 4 ~ 15 秒。
- MiniMax-H3-Max:极速生成版本。仅支持文生视频与图生视频(首帧 / 尾帧),不支持多模态参考(参考图 / 参考视频 / 参考音频);分辨率 480P / 768P,不支持 2K;时长 5 ~ 15 秒。
MiniMax-H3, MiniMax-H3-Max 多模态输入内容数组,描述用于生成视频的信息。每个元素通过 type 区分类型(text / image_url / video_url / audio_url),并可通过 role 标注用途。
每次请求必须包含一个非空 text 项(prompt 必填);缺失会返回参数错误。 支持的输入组合(对应不同生成场景):
文生视频:仅一个 text 元素。
视频分辨率。可用值:480P、768P、2K。
- MiniMax-H3:支持 768P、2K。
- MiniMax-H3-Max:支持 480P、768P(默认 768P,不支持 2K)。
480P, 768P, 2K 生成视频时长(秒),必选,整数。
- MiniMax-H3:4 ~ 15 秒。
- MiniMax-H3-Max:5 ~ 15 秒(不支持 4 秒)。
4, 5, 6, 7, 8, 9, 10, 11, 12, 13, 14, 15 生成视频的宽高比,默认 adaptive(自动,由输入自适应选择最合适的宽高比,实际比例可在查询接口的 ratio 字段获取)。
文生视频(t2va,content 仅含 text):ratio 必填,且不能为 adaptive;可用值 21:9、16:9、4:3、1:1、3:4、9:16。
21:9, 16:9, 4:3, 1:1, 3:4, 9:16 任务状态变更的回调通知地址。配置后 MiniMax 服务器会先发送含 challenge 字段的验证请求(需 3 秒内原样返回 challenge 完成验证),验证成功后每当任务状态变更即向该地址 POST 推送,推送体结构与查询任务接口的响应一致。
回调 status 取值:queued(排队中)、running(运行中)、succeeded(成功)、failed(失败)、cancelled(已取消)。
响应
创建成功后返回 task_id。使用该 task_id 调用查询任务接口获取任务状态与结果。
查询任务成功响应示例
任务 ID,用于后续查询任务状态与结果。