典名词元典名词元首页
API 文档三方工具教程
AI 模型接口视频豆包

视频生成

POST/api/v1/video/generation

Header Parameters

Authorization?string

格式: Authorization: Bearer sk-xxxxxx

Request Body

application/json

model*string

模型名称,固定值:

doubao-seedance-2-0-260128

doubao-seedance-2-0-fast-260128

doubao-seedance-1-5-pro-251215

Value in"doubao-seedance-2-0-260128" | "doubao-seedance-2-0-fast-260128" | "doubao-seedance-1-5-pro-251215"
content*array<object>

输入给模型,生成视频的信息,支持文本、图片、音频、视频、样片任务 ID。支持以下几种组合:

文本

文本(可选)+ 图片

文本(可选)+ 视频

文本(可选)+ 图片 + 音频

文本(可选)+ 图片 + 视频

文本(可选)+ 视频 + 音频

文本(可选)+ 图片 + 视频 + 音频

视频:其中视频指已成功生成的样片视频,模型可基于样片生成高质量正式视频。

[]?object
type*string

输入内容的类型:

text/image_url/video_url/audio_url/draft_task

text?string

输入给模型的文本提示词,描述期望生成的视频。

提示词语言支持:所有模型均支持中英文提示词;seedance 2.0 及 seedance 2.0 fast 额外支持日语、印尼语、西班牙语、葡萄牙语。

提示词字数建议:中文提示词不超过500字,英文提示词不超过1000词。字数过多易导致信息分散,模型可能忽略细节、仅关注重点,进而造成视频缺失部分元素。

role?string

图片的位置或用途。

图生视频-首帧

支持模型:所有图生视频模型

字段role取值:需要传入1个image_url对象,且字段role可不填,或字段role为:first_frame

图生视频-首尾帧

支持模型:Seedance 2.0 系列,Seedance 1.5 pro

字段role取值:需要传入2个image_url对象,且字段role必填。

首帧图片对应的字段role为:first_frame

尾帧图片对应的字段role为:last_frame

图生视频-参考图

支持模型:Seedance 2.0 系列(1~9 张图片)

字段role取值:必填,每张参考图对应的字段 role 均为:reference_image

image_url?object
url*string

图片信息,可以是图片URL/图片Base64 编码/素材ID。

传入单张图片要求

格式:jpeg、png、webp、bmp、tiff、gif。其中,Seedance 1.5 pro 和 Seedance 2.0 系列模型新增支持 heic 和 heif。

宽高比(宽/高): (0.4, 2.5)

宽高长度(px):(300, 6000)

大小:单张图片小于 30 MB。请求体大小不超过 64 MB。大文件请勿使用Base64编码。

图片数量:

图生视频-首帧:1 张

图生视频-首尾帧:2 张

Seedance 2.0 系列 多模态参考生视频:1~9 张

video_url?object
url*string

填入视频的公网 URL或虚拟人像视频的 ID

传入单个视频要求

视频格式:mp4、mov,支持编码格式见下表。

分辨率:480p,720p,1080p

时长:单个视频时长 [2, 15] s,最多传入 3 个参考视频,所有视频总时长不超过 15s。

尺寸:

宽高比(宽/高):[0.4, 2.5]

宽高长度(px):[300, 6000]

总像素数:[640×640=409600, 2206×946=2086876],即宽和高的乘积符合 [409600, 2086876] 的区间要求。

大小:单个视频不超过 50 MB。

帧率 (FPS):[24, 60]

audio_url?object
url*string

填入音频公网URL/Base64编码

传入单个音频要求

格式:wav、mp3

时长:单个音频时长 [2, 15] s,最多传入 3 段参考音频,所有音频总时长不超过 15 s。

大小:单个音频不超过 15 MB,请求体大小不超过 64 MB。大文件请勿使用Base64编码。

draft_task?object

基于样片任务 ID,生成正式视频。仅 Seedance 1.5 pro 支持该功能。

id*string

样片任务 ID。平台将自动复用 Draft 视频使用的用户输入(model、content.text、content.image_url、generate_audio、seed、ratio、duration、camera_fixed ),生成正式视频。其余参数支持指定,不指定将使用本模型的默认值。

callback_url?string

填写本次生成任务结果的回调通知地址。当视频生成任务有状态变化时,方舟将向此地址推送 POST 请求。

回调请求内容结构与查询任务API的返回体一致。

回调返回的 status 包括以下状态:

queued:排队中。

running:任务运行中。

succeeded: 任务成功。(如发送失败,即5秒内没有接收到成功发送的信息,回调三次)

failed:任务失败。(如发送失败,即5秒内没有接收到成功发送的信息,回调三次)

expired:任务超时,即任务处于运行中或排队中状态超过过期时间。可通过 execution_expires_after 字段设置过期时间。

return_last_frame?boolean

true:返回生成视频的尾帧图像。设置为 true 后,可通过 查询视频生成任务接口 获取视频的尾帧图像。尾帧图像的格式为 png,宽高像素值与生成的视频保持一致,无水印。

使用该参数可实现生成多个连续视频:以上一个生成视频的尾帧作为下一个视频任务的首帧,快速生成多个连续视频,调用示例详见 教程。

false:不返回生成视频的尾帧图像。

execution_expires_after?integer

任务超时阈值。指定任务提交后的过期时间(单位:秒),从 created at 时间戳开始计算。默认值 172800 秒,即 48 小时。取值范围:[3600,259200]。

不论使用哪种 service_tier,都建议根据业务场景设置合适的超时时间。超过该时间后任务会被自动终止,并标记为expired状态。

generate_audio?boolean

控制生成的视频是否包含与画面同步的声音。(仅Seedance2.0系列、 Seedance 1.5 pro 支持)

注意:生成的有声视频均为单声道、和传入的音频声道数无关。

true:模型输出的视频包含同步音频。模型会基于文本提示词与视觉内容,自动生成与之匹配的人声、音效及背景音乐。建议将对话部分置于双引号内,以优化音频生成效果。例如:男人叫住女人说:“你记住,以后不可以用手指指月亮。”

false:模型输出的视频为无声视频。

draft?boolean

控制是否开启样片模式。(仅 Seedance 1.5 pro 支持)

true:开启样片模式,生成一段预览视频,快速验证场景结构、镜头调度、主体动作与 prompt 意图是否符合预期。消耗 token 数较正常视频更少,使用成本更低。

false:关闭样片模式,正常生成一段视频。

开启样片模式后,将使用 480p 分辨率生成 Draft 视频(使用其他分辨率会报错),不支持返回尾帧功能,不支持离线推理功能。

tools?array<object>

配置模型要调用的工具。

仅 Seedance 2.0 系列 支持

[]?object
type*string

指定使用的工具类型

safety_identifier?string

终端用户的唯一标识符,用于协助平台检测您的应用中可能违反火山方舟使用政策的用户。该标识符为英文字符串,需保证对单个用户固定且唯一,长度不超过 64 个字符。推荐传入对用户名、用户 ID 或邮箱进行哈希处理后生成的字符串,避免泄露用户隐私信息。

priority?string

仅 Seedance 2.0 系列支持

设置当前请求的执行优先级,决定其在队列中的排序位置。取值范围:0~9,数值越大,优先级越高。

默认情况下,请求按 FIFO(First In, First Out,先进先出)顺序执行。设置较高优先级后,该请求将插队到同 Endpoint(推理接入点)下所有低优先级请求之前。

说明:

相同优先级的请求之间仍按 FIFO 排序。

优先级仅影响排队顺序,不会中断正在执行中(status=running)的任务。

优先级仅在同一 Endpoint 内生效,不影响其他 Endpoint。

离线推理模式(service_tier=flex)不支持配置优先级。

resolution*string

视频分辨率,枚举值:

480p

720p

1080p:Seedance 2.0 fast 不支持

Seedance 1.5 pro、Seedance 1.0 lite 默认值:720p

Seedance 1.0 pro & pro-fast 默认值:1080p

ratio*string

生成视频的宽高比例。不同宽高比对应的宽高像素值见下方表格。

16:9

4:3

1:1

3:4

9:16

21:9

adaptive:根据输入自动选择最合适的宽高比

文生视频:默认值 16:9( Seedance 1.5 Pro 默认值为 adaptive)

图生视频:默认值 adaptive(参考图生视频场景默认值为 16:9)

duration?integer

生成视频时长,单位:秒。

duration 和 frames 二选一即可,frames 的优先级高于 duration。如果您希望生成整数秒的视频,建议指定 duration

Seedance 1.5 pro: [4,12] 或设置为-1

Seedance 2.0 系列: [4,15] 或设置为-1

seed?integer

种子整数,用于控制生成内容的随机性。

取值范围:[-1, 2^32-1]之间的整数。

camera_fixed?boolean

是否固定摄像头(参考图场景不支持,Seedance 2.0 系列 暂不支持)。枚举值:

true:固定摄像头。平台会在用户提示词中追加固定摄像头,实际效果不保证。

false:不固定摄像头。

watermark*boolean

生成视频是否包含水印。枚举值:

false:不含水印。

true:含有水印。

Response Body

application/json

curl -X POST "https://api.aa.com.cn/api/v1/video/generation" \  -H "Authorization: string" \  -H "Content-Type: application/json" \  -d '{    "model": "doubao-seedance-2-0-260128",    "content": [      {        "type": "string",        "text": "string",        "role": "string",        "image_url": {          "url": "string"        },        "video_url": {          "url": "string"        },        "audio_url": {          "url": "string"        },        "draft_task": {          "id": "string"        }      }    ],    "callback_url": "string",    "return_last_frame": true,    "execution_expires_after": 0,    "generate_audio": true,    "draft": true,    "tools": [      {        "type": "string"      }    ],    "safety_identifier": "string",    "priority": "string",    "resolution": "string",    "ratio": "string",    "duration": 0,    "seed": 0,    "camera_fixed": true,    "watermark": true  }'
{
  "code": 0,
  "data": {
    "urls": [
      "string"
    ],
    "usage": {
      "images": 0,
      "seconds": 0,
      "input_tokens": 0,
      "total_tokens": 0,
      "output_tokens": 0
    },
    "expired": "string",
    "task_id": "string",
    "task_status": "string"
  },
  "message": "string",
  "request_id": "string"
}