典名词元典名词元首页
API 文档三方工具教程
AI 模型接口视频万相

视频编辑2.7

POST/api/v1/video/generation

Header Parameters

Authorization*string

格式: Authorization: Bearer sk-xxxxxx

X-DashScope-Async*string

异步处理配置参数。HTTP请求只支持异步,必须设置为enable。

Request Body

application/json

model*string

模型名称,固定值:

wan2.7-videoedit

Value in"wan2.7-videoedit"
input*object

输入的基本信息,如提示词等。

prompt*string

文本提示词。用来描述生成视频中期望包含的元素和视觉特点。

支持中英文,每个汉字/字母占一个字符,超过部分会自动截断。

wan2.7-videoedit:长度不超过5000个字符。

示例值:为人物换上酷闪的衣服,再戴参考图里的帽子。

negative_prompt?string

反向提示词,用来描述不希望在视频画面中看到的内容,可以对视频画面进行限制。

支持中英文,长度不超过500个字符,超过部分会自动截断。

示例值:低分辨率、错误、最差质量、低质量、残缺、多余的手指、比例不良等。

media*array<object>

媒体素材数组,素材包括图像、视频和音频。支持图像/视频输入作为视觉参考,图像支持多视图,常见参考角色、道具、场景等。

数组中每个元素为一个媒体对象,包含 type 与 url 字段。

按照数组顺序定义prompt中角色引用的顺序。图和视频分别计数,即可同时存在图1、视频1。

数组中的第 1 个reference_video 对应 视频1,第 2 个对应 视频2,以此类推。

数组中的第 1 个reference_image对应 图1,第 2 个对应 图2,以此类推。

[]?object
type*string

媒体素材类型。可选值为:

video:必传。待编辑的视频。

reference_image:可选。参考图像。

素材限制:

视频有且仅有1个。

参考图像最多传入4张。

url*string

传入视频(type=video):

待编辑的视频文件的 URL。

视频限制:

格式:mp4、mov。

时长:2~10s。

分辨率:宽度和高度范围为[240,4096]像素。

宽高比:1:8~8:1。

文件大小:不超过100MB。

传入图像(type=reference_image):

参考图像URL或 Base64 编码数据。

图像限制:

格式:JPEG、JPG、PNG(不支持透明通道)、BMP、WEBP。

分辨率:宽度和高度范围为[240, 8000]像素。

宽高比:1:8~8:1。

文件大小:不超过20MB。

parameters*object

视频处理参数,如设置视频分辨率、设置视频时长、开启prompt智能改写、添加水印等。

resolution?string

生成视频的分辨率档位,用于控制视频的清晰度(总像素)。

wan2.7-videoedit:可选值:720P、1080P。默认值为1080P。

ratio?string

生成视频的宽高比。

生效逻辑:

不传 ratio 参数:以输入视频的宽高比生成近似比例的视频。

传入ratio参数:按指定的 ratio 生成视频。

可选值为:

16:9

9:16

1:1

4:3

3:4

不同宽高比对应的输出视频分辨率(宽高像素值)见下方

720P

16:9-->1280*720

9:16-->720*1280

1:1-->960*960

4:3-->1104*832

3:4-->832*1104

1080P

16:9-->1920*1080

9:16-->1080*1920

1:1-->1440*1440

4:3-->1648*1248

3:4-->1248*1648

duration?integer

生成视频的时长,单位为秒。

使用建议:此参数仅在需要“截断视频”时才需配置。如果希望输出视频与输入视频时长一致,无需设置(或传入默认值 0)。

使用规则:

默认行为:默认值为 0,代表直接使用输入视频的时长,不进行截断。

截断生效:当传入指定时长时,系统会从原视频的 0 秒起,截取至 duration 设置的长度。

取值范围:支持 [2, 10] 之间的整数。

audio_setting?string

视频声音设置。

auto (默认):模型根据 prompt 内容智能判断。若提示词涉及声音描述,可能重新生成音频;否则可能保留输入素材的原声。

origin:强制保留输入视频的原声,不重新生成。

prompt_extend?boolean

是否开启prompt智能改写。开启后使用大模型对输入prompt进行智能改写。对于较短的prompt生成效果提升明显,但会增加耗时。

true:默认值,开启智能改写。

false:不开启智能改写。

watermark?string

是否添加水印标识,水印位于视频右下角,文案固定为“AI生成”。

false:默认值,不添加水印。

true:添加水印。

seed?string

随机数种子,取值范围为[0, 2147483647]。

Response Body

application/json

curl -X POST "https://api.aa.com.cn/api/v1/video/generation" \  -H "Authorization: string" \  -H "X-DashScope-Async: string" \  -H "Content-Type: application/json" \  -d '{    "model": "wan2.7-videoedit",    "input": {      "prompt": "string",      "negative_prompt": "string",      "media": [        {          "type": "string",          "url": "string"        }      ]    },    "parameters": {      "resolution": "string",      "ratio": "string",      "duration": 0,      "audio_setting": "string",      "prompt_extend": true,      "watermark": "string",      "seed": "string"    }  }'
{
  "code": 0,
  "data": {
    "urls": [
      "string"
    ],
    "usage": {
      "images": 0,
      "seconds": 0,
      "input_tokens": 0,
      "total_tokens": 0,
      "output_tokens": 0
    },
    "expired": "string",
    "task_id": "string",
    "task_status": "string"
  },
  "message": "string",
  "request_id": "string"
}