典名词元典名词元首页
API 文档三方工具教程
AI 模型接口视频万相

参考生视频2.6

POST/api/v1/video/generation

Header Parameters

Authorization*string

格式: Authorization: Bearer sk-xxxxxx

X-DashScope-Async*string

异步处理配置参数。HTTP请求只支持异步,必须设置为enable。

Request Body

application/json

model*string

模型名称,固定值:

wan2.6-r2v-flash

wan2.6-r2v

Value in"wan2.6-r2v-flash" | "wan2.6-r2v"
input*object

输入的基本信息,如提示词等。

prompt?string

文本提示词。用来描述生成视频中期望包含的元素和视觉特点。

支持中英文,每个汉字、字母、标点占一个字符,超过部分会自动截断。

wan2.6-r2v-flash:长度不超过1500个字符。

wan2.6-r2v:长度不超过1500个字符。

角色引用说明:通过“character1、character2”这类标识引用参考角色,每个参考(视频或图像)仅包含单一角色。模型仅通过此方式识别参考中的角色。

示例值:character1在沙发上开心地看电影。

negative_prompt?string

反向提示词,用来描述不希望在视频画面中出现的内容,可以对视频画面进行限制。

支持中英文,长度不超过500个字符,超过部分会自动截断。

示例值:低分辨率、错误、最差质量、低质量、残缺、多余的手指、比例不良等。

reference_urls*array<string>

上传的参考文件 URL 数组,支持传入视频和图像。用于提取角色形象与音色(如有),以生成符合参考特征的视频。

每个 URL 可指向 一张图像 或 一段视频:

图像数量:0~5。

视频数量:0~3。

总数限制:图像 + 视频 ≤ 5。

传入多个参考文件时,按照数组顺序定义角色的顺序。即第 1 个 URL 对应 character1,第 2 个对应 character2,以此类推。

每个参考文件仅包含一个主体角色。例如 character1 为小女孩,character2 为闹钟。

[]?string
parameters*object

视频处理参数,如设置视频分辨率、设置视频时长、开启prompt智能改写、添加水印等。

size?string

指定生成的视频分辨率,格式为宽*高。该参数的默认值和可用枚举值依赖于 model 参数,规则如下:

wan2.6-r2v-flash:默认值为 1920*1080(1080P)。可选分辨率:

720P、1080P对应的所有分辨率。

wan2.6-r2v:默认值为 1920*1080(1080P)。可选分辨率:

720P、1080P对应的所有分辨率。

720P档位:可选的视频分辨率及其对应的视频宽高比为:

1280*720:16:9。

720*1280:9:16。

960*960:1:1。

1088*832:4:3。

832*1088:3:4。

1080P档位:可选的视频分辨率及其对应的视频宽高比为:

1920*1080: 16:9。

1080*1920: 9:16。

1440*1440: 1:1。

1632*1248: 4:3。

1248*1632: 3:4。

duration?integer

生成视频的时长,单位为秒。

wan2.6-r2v-flash:取值为[2, 10]之间的整数。默认值为5。

wan2.6-r2v:取值为[2, 10]之间的整数。默认值为5。

示例值:5。

shot_type?string

指定生成视频的镜头指定生成视频的镜头类型,即视频是由一个连续镜头还是多个切换镜头组成。

参数优先级:shot_type > prompt。例如,若 shot_type设置为"single",即使 prompt 中包含“生成多镜头视频”,模型仍会输出单镜头视频。

可选值:

single:默认值,输出单镜头视频

multi:输出多镜头视频。

示例值:single。类型,即视频是由一个连续镜头还是多个切换镜头组成。

参数优先级:shot_type > prompt。例如,若 shot_type设置为"single",即使 prompt 中包含“生成多镜头视频”,模型仍会输出单镜头视频。

可选值:

single:默认值,输出单镜头视频

multi:输出多镜头视频。

audio?boolean

支持模型:wan2.6-r2v-flash。

是否生成有声视频。

可选值:

true:默认值,输出有声视频。

false:输出无声视频。

watermark?string

是否添加水印标识,水印位于视频右下角,文案固定为“AI生成”。

false:默认值,不添加水印。

true:添加水印。

seed?string

随机数种子,取值范围为[0, 2147483647]。

Response Body

application/json

curl -X POST "https://api.aa.com.cn/api/v1/video/generation" \  -H "Authorization: string" \  -H "X-DashScope-Async: string" \  -H "Content-Type: application/json" \  -d '{    "model": "wan2.6-r2v-flash",    "input": {      "prompt": "string",      "negative_prompt": "string",      "reference_urls": [        "string"      ]    },    "parameters": {      "size": "string",      "duration": 0,      "shot_type": "string",      "audio": true,      "watermark": "string",      "seed": "string"    }  }'
{
  "code": 0,
  "data": {
    "urls": [
      "string"
    ],
    "usage": {
      "images": 0,
      "seconds": 0,
      "input_tokens": 0,
      "total_tokens": 0,
      "output_tokens": 0
    },
    "expired": "string",
    "task_id": "string",
    "task_status": "string"
  },
  "message": "string",
  "request_id": "string"
}