典名词元典名词元首页
API 文档三方工具教程
AI 模型接口视频万相

图生视频2.7

POST/api/v1/video/generation

Header Parameters

Authorization*string

格式: Authorization: Bearer sk-xxxxxx

X-DashScope-Async*string

异步处理配置参数。HTTP请求只支持异步,必须设置为enable。

Request Body

application/json

model*string

模型名称,固定值:

wan2.7-i2v

Value in"wan2.7-i2v"
input*object

输入的基本信息,如提示词等。

prompt*string

文本提示词。用来描述生成图像中期望包含的元素和视觉特点。

支持中英文,每个汉字/字母占一个字符,超过部分会自动截断。长度限制因模型版本而异:

wan2.7-i2v:不超过5000个字符。

negative_prompt?string

反向提示词,用来描述不希望在视频画面中看到的内容,可以对视频画面进行限制。

支持中英文,长度不超过500个字符,超过部分会自动截断。

示例值:低分辨率、错误、最差质量、低质量、残缺、多余的手指、比例不良等。

media*array<object>

媒体素材列表,用于指定视频生成所需的参考素材(图像、音频和视频)。

数组的每个元素为一个媒体对象,包含 type 与 url 字段。

仅支持以下特定的素材组合,非法组合将报错。

首帧生视频:

首帧:first_frame

首帧+音频:first_frame+driving_audio

首尾帧生视频:

首帧+尾帧:first_frame+last_frame

首帧+尾帧+音频:first_frame+last_frame+driving_audio

视频续写:

首段视频续写:first_clip

首段视频+尾帧续写:first_clip+last_frame

[]?object
type*string

媒体素材类型。可选值为:

first_frame:首帧。

last_frame:尾帧。

driving_audio:驱动音频。

first_clip:首视频片段。

使用限制:每种 type 在 media 数组中最多出现一次(例如:不可同时传入两个 first_frame)。

url*string

传入图像(type=first_frame或last_frame):

首帧或尾帧URL,或 Base64 编码数据。目前支持首帧生视频、首尾帧生视频。

图像限制:

格式:JPEG、JPG、PNG(不支持透明通道)、BMP、WEBP。

分辨率:宽和高的范围为[240, 8000]像素。

宽高比:1:8~8:1。

文件大小:不超过20MB。

传入音频(type=driving_audio):

音频文件的 URL。

传入音频:模型将以该音频为驱动源生成视频(如口型同步、动作卡点等)。

未传入音频:模型将根据视频画面内容,自动生成匹配的背景音乐或音效。

音频限制:

格式:wav、mp3。

时长:2~30s。

文件大小:不超过15MB。

截断处理:若音频长度超过 duration 值(如5秒),自动截取前5秒,其余部分丢弃。若音频长度不足视频时长,超出音频长度部分为无声视频。例如,音频为3秒,视频时长为5秒,输出视频前3秒有声,后2秒无声。

传入视频(type=first_clip):

视频文件的 URL。模型将基于该视频内容进行续写生成,续写时长的上限由 duration 参数控制。

例如:当duration=15时,输入视频 3 秒,则模型续写生成 12 秒,最终输出视频总时长 15 秒, 按 15 秒计费。

视频限制:

格式:mp4、mov。

时长:2~10s。

分辨率:宽和高的范围为[240, 4096]像素。

宽高比:1:8~8:1。

文件大小:不超过100MB。

parameters*object

视频处理参数,如设置视频分辨率、设置视频时长、开启prompt智能改写、添加水印等。

resolution?string

生成视频的分辨率档位,用于控制视频的清晰度(总像素)。

wan2.7-i2v:可选值:720P、1080P。默认值为1080P。

ratio?string

生成视频的宽高比。

16:9(默认值)

9:16

1:1

4:3

3:4

不同宽高比对应的输出视频分辨率(宽高像素值)

720P:

16:9:1280*720

9:16:720*1280

1:1:960*960

4:3:1104*832

3:4:832*1104

1080P

16:9:1920*1080

9:16:1080*1920

1:1:1440*1440

4:3:1648*1248

3:4:1248*1648

duration?integer

生成视频的时长,单位为秒。

wan2.7-i2v:取值为[2, 15]之间的整数。默认值为5。

prompt_extend?boolean

是否开启prompt智能改写。开启后使用大模型对输入prompt进行智能改写。对于较短的prompt生成效果提升明显,但会增加耗时。

true:默认值,开启智能改写。

false:不开启智能改写。

watermark?string

是否添加水印标识,水印位于视频右下角,文案固定为“AI生成”。

false:默认值,不添加水印。

true:添加水印。

seed?string

随机数种子,取值范围为[0, 2147483647]。

Response Body

application/json

curl -X POST "https://api.aa.com.cn/api/v1/video/generation" \  -H "Authorization: string" \  -H "X-DashScope-Async: string" \  -H "Content-Type: application/json" \  -d '{    "model": "wan2.7-i2v",    "input": {      "prompt": "string",      "negative_prompt": "string",      "media": [        {          "type": "string",          "url": "string"        }      ]    },    "parameters": {      "resolution": "string",      "ratio": "string",      "duration": 0,      "prompt_extend": true,      "watermark": "string",      "seed": "string"    }  }'
{
  "code": 0,
  "data": {
    "urls": [
      "string"
    ],
    "usage": {
      "images": 0,
      "seconds": 0,
      "input_tokens": 0,
      "total_tokens": 0,
      "output_tokens": 0
    },
    "expired": "string",
    "task_id": "string",
    "task_status": "string"
  },
  "message": "string",
  "request_id": "string"
}