图生视频
基于首帧图像与文本提示词生成流畅视频。异步任务接口,提交后返回 task_id,需轮询任务状态获取结果。
根据首帧图像和文本提示词生成一段流畅视频。支持自动配音、传入自定义音频、多镜头叙事。最长 15 秒、最高 1080P 分辨率。
异步任务型接口:提交后立即返回 task_id,需轮询任务状态,成功后再下载视频。
Base URL
https://api.autorouter.top— Production
Authentication
BearerAuth: http (bearer)
使用 Bearer Token 认证。
格式: Authorization: Bearer sk-xxxxxx
Endpoints
POST /api/v1/services/aigc/video-generation/video-synthesis
创建视频生成任务
基于首帧图像与文本提示词创建视频生成任务。
请求头需设置 X-DashScope-Async: enable。
Request Body
Content-Type: application/json
Example:
{
"model": "wan2.6-i2v-flash",
"input": {
"prompt": "一幅都市奇幻艺术的场景。一个充满动感的涂鸦艺术角色。一个由喷漆所画成的少年,正从一面混凝土墙上活过来。他一边用极快的语速演唱一首英文rap,一边摆着一个经典的、充满活力的说唱歌手姿势。场景设定在夜晚一个充满都市感的铁路桥下。灯光来自一盏孤零零的街灯,营造出电影般的氛围,充满高能量和惊人的细节。视频的音频部分完全由他的rap构成,没有其他对话或杂音。",
"img_url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/wpimhv/rap.png",
"audio_url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/ozwpvi/rap.mp3"
},
"parameters": {
"resolution": "720P",
"prompt_extend": true,
"duration": 10,
"shot_type": "multi",
"watermark": true
}
}Properties:
| Name | Type | Required | Description |
|---|---|---|---|
model | string | Yes | 模型名称。可选值:wan2.6-i2v、wan2.6-i2v-flash |
input | object | Yes | 输入的基本信息,如提示词、首帧图像等 |
input.prompt | string | No | 文本提示词。用来描述生成视频中期望包含的元素和视觉特点。详见下方说明 |
input.negative_prompt | string | No | 反向提示词,用于描述不希望在视频画面中出现的内容。支持中英文,长度不超过 500 个字符,超过部分会自动截断 |
input.img_url | string | Yes | 首帧图像的 URL 或 Base64 编码数据。详见下方说明 |
input.audio_url | string | No | 音频文件 URL,模型将使用该音频生成视频。详见下方说明 |
parameters | object | No | 视频处理参数,如分辨率、时长、镜头类型等 |
parameters.resolution | string | No | 分辨率档位,用于控制视频清晰度(总像素),直接影响费用。详见下方说明 |
parameters.duration | integer | No | 视频时长(秒),按秒计费。取值 [2, 15],默认 5 |
parameters.prompt_extend | boolean | No | 是否开启 prompt 智能改写。开启后使用大模型对输入 prompt 进行智能改写,对较短 prompt 提升明显,但会增加耗时。true(默认)开启,false 不开启 |
parameters.shot_type | string | No | 镜头类型。仅 wan2.6 系列支持,且仅当 prompt_extend=true 时生效。single(默认)单镜头,multi 多镜头。优先级高于 prompt |
parameters.audio | boolean | No | 是否生成有声视频。仅 wan2.6-i2v-flash 支持。true(默认)有声,false 无声。有声与无声价格不同 |
parameters.watermark | boolean | No | 是否添加水印(右下角固定文案 "AI生成")。false(默认)不添加,true 添加 |
parameters.seed | integer | No | 随机数种子,取值 [0, 2147483647]。未指定时系统自动生成。固定 seed 可提升可复现性,但不保证完全一致 |
inputobject(必选)
输入的基本信息,如提示词、首帧图像等。
文本提示词。用来描述生成视频中期望包含的元素和视觉特点。
支持中英文,每个汉字、字母、标点占一个字符,超过部分会自动截断。
wan2.6-i2v、wan2.6-i2v-flash:不超过 1500 个字符。
示例值:一只小猫在草地上奔跑。
首帧图像的 URL 或 Base64 编码数据。模型将基于该图像生成视频,输出视频宽高比尽量与输入图像保持一致。
图像限制:
- 格式: JPEG、JPG、PNG(不支持透明通道)、BMP、WEBP
- 分辨率: 宽高均需在
[240, 8000]像素之间 - 文件大小: 不超过 20MB
音频文件的 URL,模型将使用该音频生成视频(如口型同步、背景音乐等)。
- 传入音频: 模型以该音频为驱动源生成视频。
- 未传入音频: 模型将根据视频画面内容,自动生成匹配的背景音乐或音效。
音频限制:
- 格式: wav、mp3
- 时长: 3s~30s
- 文件大小: 不超过 15MB
- 截断处理: 若音频长度超过
duration值,自动截取前duration秒,其余部分丢弃。若音频长度不足视频时长,超出音频长度部分为无声。例如,音频为 3 秒,视频时长为 5 秒,输出视频前 3 秒有声,后 2 秒无声。
parametersobject(可选)
视频处理参数,如分辨率、时长、镜头类型等。
指定生成的视频分辨率档位,用于调整视频清晰度(总像素)。直接影响费用。
模型根据所选档位自动缩放至相近总像素,视频宽高比将尽量与输入图像 img_url 的宽高比保持一致。
wan2.6-i2v-flash、wan2.6-i2v:可选值720P、1080P。默认值为1080P。
示例值:720P
生成视频的时长,单位为秒,按秒计费。
wan2.6-i2v-flash、wan2.6-i2v:取值为[2, 15]之间的整数,默认值为5
示例值:5
是否开启 prompt 智能改写。开启后使用大模型对输入 prompt 进行智能改写。对于较短的 prompt 生成效果提升明显,但会增加耗时。
true:默认值,开启智能改写false:不开启智能改写
说明:wan2.6 模型无论 prompt_extend 取值如何,查询结果中均不返回 actual_prompt 字段。
指定生成视频的镜头类型,即视频是由一个连续镜头还是多个切换镜头组成。仅 wan2.6 系列支持。
生效条件:仅当 prompt_extend=true 时生效。
参数优先级:shot_type > prompt。例如,若 shot_type 设置为 single,即使 prompt 中包含「生成多镜头视频」,模型仍会输出单镜头视频。
single:默认值,输出单镜头视频multi:输出多镜头视频
启用多镜头叙事时,需同时设置 prompt_extend=true 与 shot_type=multi。
当希望严格控制视频的叙事结构(如产品展示用单镜头、故事短片用多镜头),可通过此参数指定。
是否生成有声视频。**仅支持模型:wan2.6-i2v-flash。**有声与无声价格不同。
参数优先级:audio > audio_url。当 audio=false 时,即使传入 audio_url,输出仍为无声视频,且按无声视频计费。
true:默认值,输出有声视频false:输出无声视频。生成无声视频时,必须显式设置parameters.audio = false
Responses
200: 成功创建任务
Content-Type: application/json
400: 请求参数错误
Content-Type: application/json
429: 请求频率限制
Content-Type: application/json
请求示例
curl -X POST "https://api.autorouter.top/api/v1/services/aigc/video-generation/video-synthesis" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer sk-xxxxxx" \
-H "X-DashScope-Async: enable" \
-d '{
"model": "wan2.6-i2v-flash",
"input": {
"prompt": "一幅都市奇幻艺术的场景。一个充满动感的涂鸦艺术角色。一个由喷漆所画成的少年,正从一面混凝土墙上活过来。他一边用极快的语速演唱一首英文rap,一边摆着一个经典的、充满活力的说唱歌手姿势。场景设定在夜晚一个充满都市感的铁路桥下。灯光来自一盏孤零零的街灯,营造出电影般的氛围,充满高能量和惊人的细节。视频的音频部分完全由他的rap构成,没有其他对话或杂音。",
"img_url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/wpimhv/rap.png",
"audio_url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/ozwpvi/rap.mp3"
},
"parameters": {
"resolution": "720P",
"prompt_extend": true,
"duration": 10,
"shot_type": "multi",
"watermark": true
}
}'响应示例
{
"output": {
"task_status": "PENDING",
"task_id": "0385dc79-5ff8-4d82-bcb6-xxxxxx"
},
"request_id": "4909100c-7b5a-9f92-bfe5-xxxxxx"
}响应字段说明:
| Name | Type | Description |
|---|---|---|
output | object | 任务输出信息 |
output.task_id | string | 任务 ID,可用于查询任务状态,有效期 24 小时 |
output.task_status | string | 任务状态。枚举值:PENDING(排队中)、RUNNING(处理中)、SUCCEEDED(成功)、FAILED(失败)、CANCELED(已取消)、UNKNOWN(不存在或状态未知) |
request_id | string | 本次请求的唯一标识,用于追踪与排查问题 |
code | string | 错误码,仅请求失败时返回 |
message | string | 错误信息,仅请求失败时返回 |
GET /api/v1/tasks/{task_id}
根据任务ID查询结果
根据创建任务时返回的 task_id 查询任务状态与结果。查询有效期 24 小时。
Headers
| Name | Type | Required | Description |
|---|---|---|---|
Authorization | string | Yes | 请求身份认证。格式:Bearer sk-xxxxxx |
Path Parameters
| Name | Type | Required | Description |
|---|---|---|---|
task_id | string | Yes | 任务 ID |
Responses
200: 成功查询任务
Content-Type: application/json
400: 请求参数错误
Content-Type: application/json
429: 请求频率限制
Content-Type: application/json
请求示例
curl -X GET "https://api.autorouter.top/api/v1/tasks/{task_id}" \
-H "Authorization: Bearer sk-xxxxxx"响应示例
{
"request_id": "2ca1c497-f9e0-449d-9a3f-xxxxxx",
"output": {
"task_id": "af6efbc0-4bef-4194-8246-xxxxxx",
"task_status": "SUCCEEDED",
"submit_time": "2025-09-25 11:07:28.590",
"scheduled_time": "2025-09-25 11:07:35.349",
"end_time": "2025-09-25 11:17:11.650",
"orig_prompt": "一幅都市奇幻艺术的场景。一个充满动感的涂鸦艺术角色。一个由喷漆所画成的少年,正从一面混凝土墙上活过来。他一边用极快的语速演唱一首英文rap,一边摆着一个经典的、充满活力的说唱歌手姿势。场景设定在夜晚一个充满都市感的铁路桥下。灯光来自一盏孤零零的街灯,营造出电影般的氛围,充满高能量和惊人的细节。视频的音频部分完全由他的rap构成,没有其他对话或杂音。",
"video_url": "https://dashscope-result-sh.oss-cn-shanghai.aliyuncs.com/xxx.mp4?Expires=xxx"
},
"usage": {
"duration": 10,
"input_video_duration": 0,
"output_video_duration": 10,
"video_count": 1,
"SR": 720,
"audio": true
}
}响应字段说明:
| Name | Type | Description |
|---|---|---|
output | object | 任务输出信息 |
output.task_id | string | 任务 ID,查询有效期 24 小时 |
output.task_status | string | 任务状态。枚举值:PENDING(排队中)、RUNNING(处理中)、SUCCEEDED(成功)、FAILED(失败)、CANCELED(已取消)、UNKNOWN(不存在或状态未知)。轮询过程中状态流转一般为 PENDING → RUNNING → SUCCEEDED / FAILED |
output.submit_time | string | 任务提交时间,格式 YYYY-MM-DD HH:mm:ss.SSS |
output.scheduled_time | string | 任务执行时间,格式 YYYY-MM-DD HH:mm:ss.SSS |
output.end_time | string | 任务完成时间,格式 YYYY-MM-DD HH:mm:ss.SSS |
output.video_url | string | 视频下载 URL,仅 task_status 为 SUCCEEDED 时返回。链接有效期 24 小时,视频为 MP4(H.264) |
output.orig_prompt | string | 原始提示词,对应请求参数 prompt |
output.code | string | 错误码,仅任务失败时返回 |
output.message | string | 错误信息,仅任务失败时返回 |
usage | object | 输出统计信息,仅成功时返回 |
usage.input_video_duration | integer | 输入视频时长(秒)。图生视频不支持传入视频,固定为 0 |
usage.output_video_duration | integer | 输出视频时长(秒),等同于请求参数 duration |
usage.duration | integer | 用于计费的总视频时长(秒),值为 input_video_duration + output_video_duration |
usage.SR | integer | 输出视频分辨率档位。示例值:720 |
usage.video_count | integer | 输出视频数量,固定为 1 |
usage.audio | boolean | 输出视频是否为有声视频。仅 wan2.6-i2v-flash 返回 |
request_id | string | 本次请求的唯一标识,用于追踪与排查问题 |
错误处理
HTTP 400 参数错误(提交前拦截,不扣费)
AutoRouter 在提交到上游前会对必填字段做基础校验:
| 场景 | 响应 |
|---|---|
未传 input.img_url | {"code":"InvalidParameter","message":"...","request_id":"..."} |
| 未知模型名 | {"code":"InvalidParameter","message":"unknown model: ...","request_id":"..."} |
HTTP 401 / 403 鉴权错误
401 Unauthorized:API Key 无效或已过期403 Forbidden:API Key 无权访问此模型(检查 token 的模型白名单)
HTTP 402 余额不足
返回 insufficient user quota。请前往 AutoRouter 控制台充值。
任务 FAILED 状态
任务成功提交但上游生成失败(output.task_status == "FAILED"),常见原因见 output.code / output.message:
| 原因 | 处理建议 |
|---|---|
| 内容审核失败 | 调整 prompt,避免敏感内容 |
| 图像 / 音频 URL 不可访问 | 确保 URL 公网可访问、未过期 |
| 媒体文件不符规格 | 参考 Request Body 中图像、音频限制 |
| 参数组合非法(如 resolution 不在可选列表、duration 超范围) | 按 Request Body 规范传参 |
| 多镜头未生效 | 确认已同时设置 prompt_extend=true 与 shot_type=multi |
| 无声视频未显式关闭 audio | wan2.6-i2v-flash 生成无声视频时须设置 parameters.audio = false |
任务 FAILED 时 AutoRouter 会自动退款到你的账户,可在日志页面查询退款记录。