典名词元典名词元首页
API 文档三方工具教程
AI 模型接口视频Vidu

单图/首尾帧/参考帧/智能多帧生视频VQ2P

POST/api/v1/video/generation

Header Parameters

Authorization*string

格式: Authorization: Bearer sk-xxxxxx

Request Body

application/json

_action*string

固定值i2v

model*string

模型名称, 支持:

viduq2-pro

resolution?string

分辨率,支持:

540p / 720p / 1080p

参考生视频非主体调用模式默认720p

参考生视频主体调用模式默认720p

seed?integer

随机种子

bgm?boolean

是否开启背景音乐,默认 false

参考生视频非主体调用模式中9秒和10秒不生效

image*object

图片信息(仅单图生视频模式支持)

imageUrl*string

图片链接

prompt*string

生成的提示文本(智能多帧生视频模式为“占位文本,输入文字占位即可(后续调整)”)

duration?integer

视频时长,单位 s(智能多帧生视频不支持)

单图生视频模式: [1,10]

首尾帧生视频模式:[1,8]

参考生视频非主体调用模式:[1,10]

参考生视频主体调用模式:可选 0-10(0秒时为自动推荐))

voiceId?string

音色id(仅单图生视频模式支持)

headtailImages*object

首尾帧图片信息(仅参考生视频模式支持)

headImage*string

首帧图片信息

tailmage*string

尾帧图片信息

characterImages*array<object>

参考图片信息(仅参考生视频非主体调用模式支持)

说明:如果不上传视频,则支持上传1-7张图,如果上传视频则支持1-4张图

[]?object
imageUrl*string

图片链接

videos*array<object>

视频信息(仅参考生视频非主体调用模式支持)

说明:支持上传1~2个视频

[]?object
videoUrl*string

视频链接

mediaId*string

媒资 ID

aspectRatio?string

比例,默认 16:9

参考生视频非主体调用模式:16:9 / 9:16 / 3:4 / 4:3 / 1:1

参考生视频主体调用模式支持:16:9 / 9:16 / 1:1

subjects*array<object>

参考主体信息(仅参考生视频主体调用模式支持)

说明:serverId模式:主体接口返回的id,可以使用视频主体、文字主体和图片主体。图片或文字主体最多不超过4个。视频主体最多不超过2个

[]?object
images*array<object>

参考主体图片信息

[]?object
imageUrl*string

图片url地址

serverId*string

参考主体标识信息,需调用创建主体接口生成

id*string

prompt的标识信息,@xxx 在prompt使用。 传入serverId时,该参数值需设置为主体的elementName。

voiceId?string

参考主体音色,非必填

audio?boolean

是否开启声音(仅参考生视频主体调用模式支持)

false:不需要音视频直出,输出静音视频

true:需要音视频直出,输出带台词以及背景音的视频

注1:该参数为true时,voice_id参数才生效

movementAmplitude?string

运动幅度,非必填,默认 auto(仅参考生视频主体调用模式支持):

auto

small

medium

large

startImage*object

首帧图像(仅智能多帧生视频模式使用,必填。说明:支持 png、jpeg、jpg、webp 格式,图片大小不超过 50 MB,图片比例需要小于 1:4 或者 4:1)

imageUrl*string

图片链接

imageSettings*array<object>

智能多帧配置(仅智能多帧生视频模式使用,必填。说明:每个任务最少 2 帧,最多 9 帧)

[]?object
keyImage*object

关键帧图片,作为该段视频的尾帧/下一段的首帧

imageUrl*string

图片链接

prompt?string

延长提示词,用于控制延长的视频内容,最大长度 1500 字符

duration?integer

多帧时长,不同关键帧之间的视频时长,默认 5 秒,可选项为 2~7 秒

metaData?string

元数据标识,JSON 格式字符串,透传字段(仅智能多帧生视频模式支持,非必填)

callbackUrl?string

回调地址(仅智能多帧生视频模式支持,非必填)

payload?string

透传参数,不做任何处理,仅数据传输,最多 1048576 个字符(仅智能多帧生视频模式支持,非必填)

Response Body

application/json

curl -X POST "https://api.aa.com.cn/api/v1/video/generation" \  -H "Authorization: string" \  -H "Content-Type: application/json" \  -d '{    "_action": "string",    "model": "string",    "resolution": "string",    "seed": 0,    "bgm": true,    "image": {      "imageUrl": "string"    },    "prompt": "string",    "duration": 0,    "voiceId": "string",    "headtailImages": {      "headImage": "string",      "tailmage": "string"    },    "characterImages": [      {        "imageUrl": "string"      }    ],    "videos": [      {        "videoUrl": "string",        "mediaId": "string"      }    ],    "aspectRatio": "string",    "subjects": [      {        "images": [          {            "imageUrl": "string"          }        ],        "serverId": "string",        "id": "string",        "voiceId": "string"      }    ],    "audio": true,    "movementAmplitude": "string",    "startImage": {      "imageUrl": "string"    },    "imageSettings": [      {        "keyImage": {          "imageUrl": "string"        },        "prompt": "string",        "duration": 0      }    ],    "metaData": "string",    "callbackUrl": "string",    "payload": "string"  }'
{
  "code": 0,
  "data": {
    "urls": [
      "string"
    ],
    "usage": {
      "images": 0,
      "seconds": 0,
      "input_tokens": 0,
      "total_tokens": 0,
      "output_tokens": 0
    },
    "expired": "string",
    "task_id": "string",
    "task_status": "string"
  },
  "message": "string",
  "request_id": "string"
}