多模态生成视频
通过 MiniMax-H3 多模态 content 数组(文本 / 图片 / 视频 / 音频)生成视频,支持文生视频、图生视频(首尾帧)、多模态参考生视频,2K 直出。异步任务接口,提交后返回 task_id,需轮询任务状态获取结果。
通过 MiniMax-H3 多模态视频接口,在同一请求中组合文本提示词、首尾帧图片、参考图片、参考视频与参考音频。支持文生视频、图生视频(首帧 / 尾帧 / 首尾帧)、多模态参考生视频,分辨率 768P / 2K,时长 4~15 秒。
异步任务型接口:提交后立即返回 task_id,需轮询任务状态,成功后再下载视频。
仅支持 MiniMax-H3 模型。
Base URL
https://api.autorouter.top— Production
Authentication
BearerAuth: http (bearer)
使用 Bearer Token 认证。
格式: Authorization: Bearer sk-xxxxxx
Endpoints
POST /minimax/v2/video_generation
创建视频生成任务
通过多模态 content 数组(文本 / 图片 / 视频 / 音频)创建视频生成任务。本接口为异步接口,创建成功后返回 task_id,需通过查询任务接口轮询任务状态,任务成功后获取生成视频。
Headers
| Name | Type | Required | Default | Description |
|---|---|---|---|---|
Content-Type | string | Yes | application/json | 请求体的媒介类型,请设置为 application/json |
Authorization | string | Yes | - | 鉴权信息,格式:Bearer sk-xxxxxx |
Request Body
Content-Type: application/json
Example:
{
"model": "MiniMax-H3",
"content": [
{
"type": "text",
"text": "史诗级太空歌剧院线预告:女舰长独自站在巨大观景窗前,最后一支舰队正在集结并跃迁离去,强光爆闪、舰桥震动,她被留在原地。"
}
],
"resolution": "2K",
"duration": 5,
"ratio": "16:9"
}Properties:
| Name | Type | Required | Default | Enum | Description |
|---|---|---|---|---|---|
model | string | Yes | - | MiniMax-H3 | 模型名称 |
content | array | Yes | - | - | 多模态输入内容数组,描述用于生成视频的信息 |
content[].type | string | Yes | - | text、image_url、video_url、audio_url | 输入内容的类型 |
resolution | string | Yes | - | 768P、2K | 视频分辨率 |
duration | integer | Yes | - | 4~15 | 生成视频时长(秒) |
ratio | string | No | adaptive | adaptive、21:9、16:9、4:3、1:1、3:4、9:16 | 生成视频的宽高比,见下方说明 |
callback_url | string | No | - | - | 任务状态变更的回调通知地址 |
aigc_watermark | boolean | No | false | - | 是否在生成视频中添加 AIGC 标识水印 |
modelstring(必选)
模型名称。当前可用值:MiniMax-H3。
contentarray(必选)
多模态输入内容数组,描述用于生成视频的信息。每个元素通过 type 区分类型(text / image_url / video_url / audio_url),并可通过 role 标注用途。
每次请求必须包含一个非空 text 项(prompt 必填);缺失会返回参数错误。
支持的输入组合(对应不同生成场景):
- 文生视频:仅一个
text元素。 - 图生视频-首帧:
text+ 1 张image_url(role=first_frame或不填)。 - 图生视频-尾帧:
text+ 1 张image_url(role=last_frame)。 - 图生视频-首尾帧:
text+ 2 张image_url(role分别为first_frame、last_frame)。 - 多模态参考生视频:
text+ 参考图片(role=reference_image)+ 参考视频(role=reference_video)+ 参考音频(role=reference_audio)的组合。
图生视频与多模态参考生视频互斥:
content中出现reference_image/reference_video/reference_audio任一 role,就不能再出现first_frame/last_frame(反之亦然),二者不可混用。
输入媒体限制(请求体总大小 ≤ 64 MB,大文件请用公网 URL,勿用 Base64)
图片 image_url:
| 项 | 限制 |
|---|---|
| 格式 | JPG、JPEG、PNG、WEBP、HEIC、HEIF |
| 单文件大小 | ≤ 30 MB |
| 宽高范围 | [256, 5760] px |
| 长宽比(宽/高) | [0.4, 2.5] |
| 数量 | 首帧 ≤ 1、尾帧 ≤ 1、参考图 ≤ 9 |
视频 video_url(仅多模态参考场景):
| 项 | 限制 |
|---|---|
| 容器 / 格式 | MP4(.mp4)、MOV(.mov) |
| 编码 | 视频 H.264/AVC、H.265/HEVC;音频 AAC、MP3 |
| 单文件大小 | ≤ 50 MB |
| 个数 | ≤ 3 |
| 单段时长 | [2, 15] s;总时长 ≤ 15 s |
| 宽高范围 | [256, 5760] px |
| 长宽比(宽/高) | [0.4, 2.5] |
| 帧率 | [23.976, 60] |
音频 audio_url(仅多模态参考场景):
| 项 | 限制 |
|---|---|
| 格式 | WAV、MP3 |
| 单文件大小 | ≤ 15 MB |
| 个数 | ≤ 3 |
| 单段时长 | [2, 15] s;总时长 ≤ 15 s |
格式示例如下:
[
{
"type": "text",
"text": "string"
},
{
"type": "image_url",
"image_url": {
"url": "string"
},
"role": "first_frame"
},
{
"type": "video_url",
"video_url": {
"url": "string"
},
"role": "reference_video"
},
{
"type": "audio_url",
"audio_url": {
"url": "string"
},
"role": "reference_audio"
}
]输入内容的类型:
text:文本提示词image_url:图片video_url:视频(仅多模态参考场景)audio_url:音频(仅多模态参考场景)
{
"type": "text",
"text": "string"
}text:文本提示词(prompt),必填:所有场景都需包含一个非空text,描述期望生成的视频- 按字符数计算长度,单个
text最多 7000 个字符
{
"type": "image_url",
"image_url": {
"url": "string"
},
"role": "first_frame"
}image_url.url:图片地址(必填),支持:- 公网 URL
mm_file://{file_id}(引用平台已有文件,如上传或历史产物的 file_id)data:image/<格式>;base64,<Base64>data URI(<格式>小写)
role:内容用途,见下方role说明- 格式 / 大小 / 尺寸 / 数量限制见上方 content 说明
{
"type": "video_url",
"video_url": {
"url": "string"
},
"role": "reference_video"
}video_url.url:视频地址(必填),支持:- 公网 URL
mm_file://{file_id}data:video/mp4;base64,<Base64>data URI
- 注意请求体总大小 ≤ 64 MB、Base64 会放大约 33%,大视频请用公网 URL 或
mm_file:// - 仅多模态参考场景使用;格式 / 大小 / 时长限制见上方 content 说明
{
"type": "audio_url",
"audio_url": {
"url": "string"
},
"role": "reference_audio"
}audio_url.url:音频地址(必填),支持:- 公网 URL
mm_file://{file_id}data:audio/<格式>;base64,<Base64>data URI(<格式>小写)
- 仅多模态参考场景使用;格式 / 大小 / 时长限制见上方 content 说明
内容的位置或用途:
first_frame:首帧图片(图生视频;仅一张图且不填 role 时默认按 first_frame 处理)last_frame:尾帧图片(图生视频-首尾帧,需与 first_frame 成对)reference_image:参考图片(多模态参考生视频)reference_video:参考视频(多模态参考生视频)reference_audio:参考音频(多模态参考生视频)
resolutionstring(必选)
视频分辨率。当前可用值:768P、2K。
durationinteger(必选)
生成视频时长(秒),必选,整数。
可选值:4、5、6、7、8、9、10、11、12、13、14、15
ratiostring(可选)
生成视频的宽高比,默认 adaptive(自动,由输入自适应选择最合适的宽高比,实际比例可在查询接口的 ratio 字段获取)。
可用值:adaptive、21:9、16:9、4:3、1:1、3:4、9:16。
文生视频(t2va,content 仅含 text):ratio 必填,且不能为 adaptive;可用值 21:9、16:9、4:3、1:1、3:4、9:16。
图生视频(i2va,content 含 first_frame / last_frame 图片):宽高比由输入图片决定,ratio 恒为 adaptive;传入其他合理值不会报错,但会被忽略并按 adaptive 处理。
多模态参考生视频(r2va,content 含 reference_image / reference_video / reference_audio):ratio 可选,默认 adaptive;也可显式指定上述任一具体比例。
callback_urlstring(可选)
任务状态变更的回调通知地址。配置后服务器会先发送含 challenge 字段的验证请求(需 3 秒内原样返回 challenge 完成验证),验证成功后每当任务状态变更即向该地址 POST 推送,推送体结构与查询任务接口的响应一致。
回调 status 取值:queued(排队中)、running(运行中)、succeeded(成功)、failed(失败)、cancelled(已取消)。
aigc_watermarkboolean(可选)
是否在生成视频中添加 AIGC 标识水印,默认 false。
Responses
200: 成功创建任务,返回 task_id
Content-Type: application/json
400: 参数错误
401: 鉴权失败
402: 余额/额度不足
422: 输入涉及敏感内容
429: 触发限流
500: 服务端错误
请求示例
curl -X POST "https://api.autorouter.top/minimax/v2/video_generation" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer sk-xxxxxx" \
-d '{
"model": "MiniMax-H3",
"content": [
{
"type": "text",
"text": "史诗级太空歌剧院线预告:女舰长独自站在巨大观景窗前,最后一支舰队正在集结并跃迁离去,强光爆闪、舰桥震动,她被留在原地。"
}
],
"resolution": "2K",
"duration": 5,
"ratio": "16:9"
}'响应示例
{
"task_id": "424010985738629"
}响应字段说明:
| Name | Type | Description |
|---|---|---|
task_id | string | 任务 ID,用于后续查询任务状态与结果 |
更多场景示例
文生视频 (t2va)
curl -X POST "https://api.autorouter.top/minimax/v2/video_generation" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer sk-xxxxxx" \
-d '{
"model": "MiniMax-H3",
"content": [
{
"type": "text",
"text": "史诗级太空歌剧院线预告:女舰长独自站在巨大观景窗前,最后一支舰队正在集结并跃迁离去,强光爆闪、舰桥震动,她被留在原地。"
}
],
"resolution": "2K",
"duration": 5,
"ratio": "16:9"
}'图生视频 (i2va)
curl -X POST "https://api.autorouter.top/minimax/v2/video_generation" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer sk-xxxxxx" \
-d '{
"model": "MiniMax-H3",
"content": [
{
"type": "text",
"text": "Pull focus to the people in the background and add more steam to the ramen bowl."
},
{
"type": "image_url",
"image_url": {
"url": "https://example.com/first-frame.png"
},
"role": "first_frame"
}
],
"resolution": "2K",
"duration": 5,
"ratio": "adaptive"
}'多模态参考生视频 (r2va)
curl -X POST "https://api.autorouter.top/minimax/v2/video_generation" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer sk-xxxxxx" \
-d '{
"model": "MiniMax-H3",
"content": [
{
"type": "text",
"text": "角色说话:Follow the wind, live free.Leave worries behind, enjoy the moment,音色参考音频1"
},
{
"type": "video_url",
"video_url": {
"url": "https://example.com/reference.mp4"
},
"role": "reference_video"
},
{
"type": "audio_url",
"audio_url": {
"url": "https://example.com/reference.mp3"
},
"role": "reference_audio"
}
],
"resolution": "2K",
"duration": 5,
"ratio": "adaptive"
}'GET /minimax/v2/query/video_generation/{task_id}
查询任务
按 task_id 查询最近 7 天内单个视频生成任务的状态与结果。任务成功(status=succeeded)后可从 content.url 获取生成视频。
- 仅支持查询最近 7 天内的任务记录(窗口
[T-7天, T),T为请求发起时刻的 UTC 时间戳,精确到秒);超出该窗口的task_id将返回invalid task_id - 视频产物下载链接有时效,请及时下载或转存
Path Parameters
| Name | Type | Required | Description |
|---|---|---|---|
task_id | string | Yes | 要查询的任务 ID(创建任务返回的 task_id) |
Headers
| Name | Type | Required | Description |
|---|---|---|---|
Authorization | string | Yes | 鉴权信息,格式:Bearer sk-xxxxxx |
Responses
200: 成功查询任务
Content-Type: application/json
400: 参数错误
401: 鉴权失败
429: 触发限流
500: 服务端错误
请求示例
curl -X GET "https://api.autorouter.top/minimax/v2/query/video_generation/{task_id}" \
-H "Authorization: Bearer sk-xxxxxx"响应示例
{
"task": {
"id": "424010985738629",
"model": "MiniMax-H3",
"status": "succeeded",
"created_at": 1785125529,
"updated_at": 1785125946,
"content": {
"url": "https://your-cdn.example.com/h3-generated-2k-output.mp4"
},
"resolution": "2K",
"duration": 5,
"usage": {
"total_seconds": 5,
"input_seconds": 0,
"output_seconds": 5,
"input_image_count": 0
},
"ratio": "16:9",
"task_type": "generation",
"modality": "video"
}
}响应字段说明:
| Name | Type | Description |
|---|---|---|
task | object | 任务对象 |
task.id | string | 任务 ID |
task.model | string | 任务使用的模型名称,如 MiniMax-H3 |
task.status | string | 任务状态,见下方说明 |
task.error | object | 错误信息,任务成功时不返回;任务失败时返回 code 与 message |
task.created_at | integer | 任务创建时间的 Unix 时间戳(秒) |
task.updated_at | integer | 任务状态更新时间的 Unix 时间戳(秒) |
task.content | object | 任务输出内容,任务成功后返回 |
task.content.url | string | 视频产物的限时下载 URL,请及时下载或转存;过期后可重新查询获取 |
task.resolution | string | 任务产物的分辨率 |
task.duration | integer | 任务产物的时长(秒) |
task.usage | object | 本次请求的计费用量 |
task.ratio | string | 任务产物的宽高比;不适用于当前任务类型时可能返回空字符串 |
task.task_type | string | 任务类型:generation(视频生成) |
task.modality | string | 产物模态:视频生成任务返回 video |
statusstring
任务状态:
queued:排队中running:运行中succeeded:成功failed:失败cancelled:已取消
建议轮询间隔 3~5 秒,直到 status 为 succeeded、failed 或 cancelled。
errorobject
错误信息。任务成功时不返回;任务失败时返回。
错误码。
错误提示信息。
contentobject
任务输出内容,任务成功后返回。
视频产物的限时下载 URL,请及时下载或转存;过期后可重新查询获取。
usageobject
本次请求的计费用量。视频任务返回按秒计量的字段。
本次计费总秒数 = 输入秒数 + 输出秒数。
输入参考视频计费秒数(含参考视频时计)。
输出视频计费秒数。
本次计费涉及的图片数量。
错误处理
HTTP 400 参数错误
| 场景 | 处理建议 |
|---|---|
未传非空 text | 补全必填 prompt |
content 中图生视频与多模态参考 role 混用 | 二者不可混用,按场景只选一种 |
文生视频未传 ratio 或传入 adaptive | 文生视频必须显式指定具体宽高比 |
duration / resolution 非法 | 使用文档列出的枚举值 |
| 媒体格式 / 大小 / 尺寸超限 | 按 content 媒体限制调整输入 |
HTTP 401 / 403 鉴权错误
401 Unauthorized:API Key 无效或已过期403 Forbidden:API Key 无权访问此模型
HTTP 402 余额不足
返回余额不足错误。请前往 AutoRouter 控制台充值。
HTTP 422 敏感内容
输入涉及敏感内容,请调整提示词或媒体素材后重试。
任务 failed 状态
| 原因 | 处理建议 |
|---|---|
| 内容审核失败 | 调整提示词,避免敏感内容 |
| 参数组合非法 | 按 Request Body 规范传参 |
任务失败时 AutoRouter 会自动退款到你的账户。