API 文档AI 模型接口视频万相 2.6

图生视频

基于首帧图像与文本提示词生成流畅视频。异步任务接口,提交后返回 task_id,需轮询任务状态获取结果。

根据首帧图像文本提示词生成一段流畅视频。支持自动配音、传入自定义音频、多镜头叙事。最长 15 秒、最高 1080P 分辨率。

异步任务型接口:提交后立即返回 task_id,需轮询任务状态,成功后再下载视频。

Base URL

  • https://api.autorouter.top — Production

Authentication

BearerAuth: http (bearer) 使用 Bearer Token 认证。 格式: Authorization: Bearer sk-xxxxxx

Endpoints

POST /api/v1/services/aigc/video-generation/video-synthesis

创建视频生成任务

基于首帧图像与文本提示词创建视频生成任务。

请求头需设置 X-DashScope-Async: enable

Request Body

Content-Type: application/json

Example:

{
  "model": "wan2.6-i2v-flash",
  "input": {
    "prompt": "一幅都市奇幻艺术的场景。一个充满动感的涂鸦艺术角色。一个由喷漆所画成的少年,正从一面混凝土墙上活过来。他一边用极快的语速演唱一首英文rap,一边摆着一个经典的、充满活力的说唱歌手姿势。场景设定在夜晚一个充满都市感的铁路桥下。灯光来自一盏孤零零的街灯,营造出电影般的氛围,充满高能量和惊人的细节。视频的音频部分完全由他的rap构成,没有其他对话或杂音。",
    "img_url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/wpimhv/rap.png",
    "audio_url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/ozwpvi/rap.mp3"
  },
  "parameters": {
    "resolution": "720P",
    "prompt_extend": true,
    "duration": 10,
    "shot_type": "multi",
    "watermark": true
  }
}

Properties:

NameTypeRequiredDescription
modelstringYes模型名称。可选值:wan2.6-i2vwan2.6-i2v-flash
inputobjectYes输入的基本信息,如提示词、首帧图像等
input.promptstringNo文本提示词。用来描述生成视频中期望包含的元素和视觉特点。详见下方说明
input.negative_promptstringNo反向提示词,用于描述不希望在视频画面中出现的内容。支持中英文,长度不超过 500 个字符,超过部分会自动截断
input.img_urlstringYes首帧图像的 URL 或 Base64 编码数据。详见下方说明
input.audio_urlstringNo音频文件 URL,模型将使用该音频生成视频。详见下方说明
parametersobjectNo视频处理参数,如分辨率、时长、镜头类型等
parameters.resolutionstringNo分辨率档位,用于控制视频清晰度(总像素),直接影响费用。详见下方说明
parameters.durationintegerNo视频时长(秒),按秒计费。取值 [2, 15],默认 5
parameters.prompt_extendbooleanNo是否开启 prompt 智能改写。开启后使用大模型对输入 prompt 进行智能改写,对较短 prompt 提升明显,但会增加耗时。true(默认)开启,false 不开启
parameters.shot_typestringNo镜头类型。仅 wan2.6 系列支持,且仅当 prompt_extend=true 时生效。single(默认)单镜头,multi 多镜头。优先级高于 prompt
parameters.audiobooleanNo是否生成有声视频。仅 wan2.6-i2v-flash 支持。true(默认)有声,false 无声。有声与无声价格不同
parameters.watermarkbooleanNo是否添加水印(右下角固定文案 "AI生成")。false(默认)不添加,true 添加
parameters.seedintegerNo随机数种子,取值 [0, 2147483647]。未指定时系统自动生成。固定 seed 可提升可复现性,但不保证完全一致

inputobject(必选)

输入的基本信息,如提示词、首帧图像等。

promptstring(可选)

文本提示词。用来描述生成视频中期望包含的元素和视觉特点。

支持中英文,每个汉字、字母、标点占一个字符,超过部分会自动截断。

  • wan2.6-i2vwan2.6-i2v-flash:不超过 1500 个字符。

示例值:一只小猫在草地上奔跑。

img_urlstring(必选)

首帧图像的 URL 或 Base64 编码数据。模型将基于该图像生成视频,输出视频宽高比尽量与输入图像保持一致。

图像限制:

  • 格式: JPEG、JPG、PNG(不支持透明通道)、BMP、WEBP
  • 分辨率: 宽高均需在 [240, 8000] 像素之间
  • 文件大小: 不超过 20MB

audio_urlstring(可选)

音频文件的 URL,模型将使用该音频生成视频(如口型同步、背景音乐等)。

  • 传入音频: 模型以该音频为驱动源生成视频。
  • 未传入音频: 模型将根据视频画面内容,自动生成匹配的背景音乐或音效。

音频限制:

  • 格式: wav、mp3
  • 时长: 3s~30s
  • 文件大小: 不超过 15MB
  • 截断处理: 若音频长度超过 duration 值,自动截取前 duration 秒,其余部分丢弃。若音频长度不足视频时长,超出音频长度部分为无声。例如,音频为 3 秒,视频时长为 5 秒,输出视频前 3 秒有声,后 2 秒无声。

parametersobject(可选)

视频处理参数,如分辨率、时长、镜头类型等。

resolutionstring(可选)

指定生成的视频分辨率档位,用于调整视频清晰度(总像素)。直接影响费用。

模型根据所选档位自动缩放至相近总像素,视频宽高比将尽量与输入图像 img_url 的宽高比保持一致

  • wan2.6-i2v-flashwan2.6-i2v:可选值 720P1080P。默认值为 1080P

示例值:720P

durationinteger(可选)

生成视频的时长,单位为秒,按秒计费。

  • wan2.6-i2v-flashwan2.6-i2v:取值为 [2, 15] 之间的整数,默认值为 5

示例值:5

prompt_extendboolean(可选)

是否开启 prompt 智能改写。开启后使用大模型对输入 prompt 进行智能改写。对于较短的 prompt 生成效果提升明显,但会增加耗时。

  • true:默认值,开启智能改写
  • false:不开启智能改写

说明:wan2.6 模型无论 prompt_extend 取值如何,查询结果中均不返回 actual_prompt 字段。

shot_typestring(可选)

指定生成视频的镜头类型,即视频是由一个连续镜头还是多个切换镜头组成。仅 wan2.6 系列支持。

生效条件:仅当 prompt_extend=true 时生效。

参数优先级:shot_type > prompt。例如,若 shot_type 设置为 single,即使 prompt 中包含「生成多镜头视频」,模型仍会输出单镜头视频。

  • single:默认值,输出单镜头视频
  • multi:输出多镜头视频

启用多镜头叙事时,需同时设置 prompt_extend=trueshot_type=multi

当希望严格控制视频的叙事结构(如产品展示用单镜头、故事短片用多镜头),可通过此参数指定。

audioboolean(可选)

是否生成有声视频。**仅支持模型:wan2.6-i2v-flash。**有声与无声价格不同。

参数优先级:audio > audio_url。当 audio=false 时,即使传入 audio_url,输出仍为无声视频,且按无声视频计费。

  • true:默认值,输出有声视频
  • false:输出无声视频。生成无声视频时,必须显式设置 parameters.audio = false

Responses

200: 成功创建任务

Content-Type: application/json

400: 请求参数错误

Content-Type: application/json

429: 请求频率限制

Content-Type: application/json

请求示例

curl -X POST "https://api.autorouter.top/api/v1/services/aigc/video-generation/video-synthesis" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer sk-xxxxxx" \
  -H "X-DashScope-Async: enable" \
  -d '{
  "model": "wan2.6-i2v-flash",
  "input": {
    "prompt": "一幅都市奇幻艺术的场景。一个充满动感的涂鸦艺术角色。一个由喷漆所画成的少年,正从一面混凝土墙上活过来。他一边用极快的语速演唱一首英文rap,一边摆着一个经典的、充满活力的说唱歌手姿势。场景设定在夜晚一个充满都市感的铁路桥下。灯光来自一盏孤零零的街灯,营造出电影般的氛围,充满高能量和惊人的细节。视频的音频部分完全由他的rap构成,没有其他对话或杂音。",
    "img_url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/wpimhv/rap.png",
    "audio_url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/ozwpvi/rap.mp3"
  },
  "parameters": {
    "resolution": "720P",
    "prompt_extend": true,
    "duration": 10,
    "shot_type": "multi",
    "watermark": true
  }
}'

响应示例

{
  "output": {
    "task_status": "PENDING",
    "task_id": "0385dc79-5ff8-4d82-bcb6-xxxxxx"
  },
  "request_id": "4909100c-7b5a-9f92-bfe5-xxxxxx"
}

响应字段说明:

NameTypeDescription
outputobject任务输出信息
output.task_idstring任务 ID,可用于查询任务状态,有效期 24 小时
output.task_statusstring任务状态。枚举值:PENDING(排队中)、RUNNING(处理中)、SUCCEEDED(成功)、FAILED(失败)、CANCELED(已取消)、UNKNOWN(不存在或状态未知)
request_idstring本次请求的唯一标识,用于追踪与排查问题
codestring错误码,仅请求失败时返回
messagestring错误信息,仅请求失败时返回

GET /api/v1/tasks/{task_id}

根据任务ID查询结果

根据创建任务时返回的 task_id 查询任务状态与结果。查询有效期 24 小时。

Headers

NameTypeRequiredDescription
AuthorizationstringYes请求身份认证。格式:Bearer sk-xxxxxx

Path Parameters

NameTypeRequiredDescription
task_idstringYes任务 ID

Responses

200: 成功查询任务

Content-Type: application/json

400: 请求参数错误

Content-Type: application/json

429: 请求频率限制

Content-Type: application/json

请求示例

curl -X GET "https://api.autorouter.top/api/v1/tasks/{task_id}" \
  -H "Authorization: Bearer sk-xxxxxx"

响应示例

{
  "request_id": "2ca1c497-f9e0-449d-9a3f-xxxxxx",
  "output": {
    "task_id": "af6efbc0-4bef-4194-8246-xxxxxx",
    "task_status": "SUCCEEDED",
    "submit_time": "2025-09-25 11:07:28.590",
    "scheduled_time": "2025-09-25 11:07:35.349",
    "end_time": "2025-09-25 11:17:11.650",
    "orig_prompt": "一幅都市奇幻艺术的场景。一个充满动感的涂鸦艺术角色。一个由喷漆所画成的少年,正从一面混凝土墙上活过来。他一边用极快的语速演唱一首英文rap,一边摆着一个经典的、充满活力的说唱歌手姿势。场景设定在夜晚一个充满都市感的铁路桥下。灯光来自一盏孤零零的街灯,营造出电影般的氛围,充满高能量和惊人的细节。视频的音频部分完全由他的rap构成,没有其他对话或杂音。",
    "video_url": "https://dashscope-result-sh.oss-cn-shanghai.aliyuncs.com/xxx.mp4?Expires=xxx"
  },
  "usage": {
    "duration": 10,
    "input_video_duration": 0,
    "output_video_duration": 10,
    "video_count": 1,
    "SR": 720,
    "audio": true
  }
}

响应字段说明:

NameTypeDescription
outputobject任务输出信息
output.task_idstring任务 ID,查询有效期 24 小时
output.task_statusstring任务状态。枚举值:PENDING(排队中)、RUNNING(处理中)、SUCCEEDED(成功)、FAILED(失败)、CANCELED(已取消)、UNKNOWN(不存在或状态未知)。轮询过程中状态流转一般为 PENDINGRUNNINGSUCCEEDED / FAILED
output.submit_timestring任务提交时间,格式 YYYY-MM-DD HH:mm:ss.SSS
output.scheduled_timestring任务执行时间,格式 YYYY-MM-DD HH:mm:ss.SSS
output.end_timestring任务完成时间,格式 YYYY-MM-DD HH:mm:ss.SSS
output.video_urlstring视频下载 URL,仅 task_statusSUCCEEDED 时返回。链接有效期 24 小时,视频为 MP4(H.264)
output.orig_promptstring原始提示词,对应请求参数 prompt
output.codestring错误码,仅任务失败时返回
output.messagestring错误信息,仅任务失败时返回
usageobject输出统计信息,仅成功时返回
usage.input_video_durationinteger输入视频时长(秒)。图生视频不支持传入视频,固定为 0
usage.output_video_durationinteger输出视频时长(秒),等同于请求参数 duration
usage.durationinteger用于计费的总视频时长(秒),值为 input_video_duration + output_video_duration
usage.SRinteger输出视频分辨率档位。示例值:720
usage.video_countinteger输出视频数量,固定为 1
usage.audioboolean输出视频是否为有声视频。仅 wan2.6-i2v-flash 返回
request_idstring本次请求的唯一标识,用于追踪与排查问题

错误处理

HTTP 400 参数错误(提交前拦截,不扣费)

AutoRouter 在提交到上游前会对必填字段做基础校验:

场景响应
未传 input.img_url{"code":"InvalidParameter","message":"...","request_id":"..."}
未知模型名{"code":"InvalidParameter","message":"unknown model: ...","request_id":"..."}

HTTP 401 / 403 鉴权错误

  • 401 Unauthorized:API Key 无效或已过期
  • 403 Forbidden:API Key 无权访问此模型(检查 token 的模型白名单)

HTTP 402 余额不足

返回 insufficient user quota。请前往 AutoRouter 控制台充值。

任务 FAILED 状态

任务成功提交但上游生成失败(output.task_status == "FAILED"),常见原因见 output.code / output.message

原因处理建议
内容审核失败调整 prompt,避免敏感内容
图像 / 音频 URL 不可访问确保 URL 公网可访问、未过期
媒体文件不符规格参考 Request Body 中图像、音频限制
参数组合非法(如 resolution 不在可选列表、duration 超范围)按 Request Body 规范传参
多镜头未生效确认已同时设置 prompt_extend=trueshot_type=multi
无声视频未显式关闭 audiowan2.6-i2v-flash 生成无声视频时须设置 parameters.audio = false

任务 FAILED 时 AutoRouter 会自动退款到你的账户,可在日志页面查询退款记录。

目录