典名词元典名词元首页
API 文档三方工具教程
AI 模型接口图像万相

图像生成与编辑同异步调用2.7

POST/api/v1/image/generation

Header Parameters

Authorization*string

使用 Bearer Token 认证。 格式: Authorization: Bearer sk-xxxxxx

X-DashScope-Async?string

异步处理配置参数,必须设置为enable。

Request Body

application/json

model*string

模型名称。固定值:

wan2.7-image

wan2.7-image-pro

Value in"wan2.7-image" | "wan2.7-image-pro"
input*object

输入的基本信息。

messages*array<object>

请求内容数组。当前仅支持单轮对话,即传入一组role、content参数,不支持多轮对话。

[]?object
role*string

消息的角色。此参数固定设置为user。

content*array<object>

消息内容数组。

[]?object
text*string

正向提示词用于描述您期望生成的图像内容、风格和构图。

支持中英文,长度不超过2000个字符,每个汉字、字母、数字或符号计为一个字符,超过部分会自动截断。

示例值:参考这个风格的图片,生成番茄炒蛋。

注意:content数组中,必须且只能包含一个含 text 字段的对象。

image?string

输入图像的URL或Base64编码字符串。

图像限制:

图像格式:JPEG、JPG、PNG(不支持透明通道)、BMP、WEBP。

图像分辨率:图像的宽高范围均为[240, 8000]像素,宽高比范围[1:8, 8:1]。

文件大小:不超过20MB。

图像数量限制:

可传入0-9张图片。

当输入多张图像时,需在content数组中传入多个image对象,并按照数组顺序定义图像顺序。

parameters?object

图像处理参数。

bbox_list?array<string>

交互式编辑框选区域。

对应关系:列表长度必须与输入图片数量一致。若某张图片无需编辑,请在对应位置传入空列表 []。

坐标格式:[x1, y1, x2, y2](左上角 x, 左上角 y, 右下角 x, 右下角 y),使用原图绝对像素坐标,左上角坐标为(0,0)。

限制条件:单张图片最多支持 2 个边界框。

[]?string
enable_sequential?boolean

控制生图模式:

false:默认值。

true :启用组图输出模式。

size?string

关于输出图片分辨率参数,支持以下两种方式,不可混用:

模型:wan2.7-image-pro

方式一:指定输出图片的分辨率(推荐)

支持 1K、2K(默认)、4K 三种规格

适用范围:

文生图(无图片输入,非组图生成):支持1K、2K、4K。

其他场景:支持1K、2K。

各规格总像素:1K:10241024、2K:20482048、4K:4096*4096

图像比例:

当有图片输入时:输出宽高比与输入图像(多图输入时为最后一张)一致,并缩放到选定分辨率。

当没有图片输入时:输出为正方形。

方式二:指定生成图像的宽高像素值

文生图:总像素在 [768768, 40964096] 之间,宽高比范围为 [1:8, 8:1]。

其他场景:总像素在 [768768, 20482048] 之间,宽高比范围为 [1:8, 8:1]。

模型:wan2.7-image

方式一:指定输出图片的分辨率(推荐)

支持1K、2K(默认)两种规格,不支持4K。

方式二:指定生成图像的宽高像素值

所有场景下,总像素在 [768768, 20482048] 之间,宽高比范围为 [1:8, 8:1]。

输出图片的像素值可能和指定像素值存在微小差异。

n?integer

关闭组图模式时,该数值代表生成图像数量,取值范围 1-4,默认为 1;

开启组图模式时,该数值代表最大生成图像数量,取值范围 1-12,默认为 12。实际数量由模型决定且不超过 n。

thinking_mode?boolean

是否开启思考模式,默认为true(开启)。仅在关闭组图模式且无图片输入时生效。开启时,模型将增强推理能力以提升出图质量,但会增加生成耗时。

color_palette?array<object>

自定义颜色主题,一个包含颜色(hex)和占比(ratio)的对象数组,需要包含 3 至 10 种颜色,推荐设置为 8 种。

仅当关闭组图模式(enable_sequential=false)时可用。

[]?object
hex?string

十六进制(HEX)格式的色值。

ratio?string

颜色所占的百分比,需精确到小数点后两位(如"25.00%")。所有 ratio 值相加总和必须为 100.00%。

watermark?boolean

是否添加水印标识,水印位于图片右下角,文案固定为"AI 生成”。

false:默认值,不添加水印。

true:添加水印。

seed?integer

随机数种子,取值范围[0,2147483647]。

使用相同的seed参数值可使生成内容保持相对稳定。若不提供,算法将自动使用随机数种子。

注意:模型生成过程具有概率性,即使使用相同的seed,也不能保证每次生成结果完全一致。

Response Body

application/json

curl -X POST "https://api.aa.com.cn/api/v1/image/generation" \  -H "Authorization: string" \  -H "X-DashScope-Async: string" \  -H "Content-Type: application/json" \  -d '{    "model": "wan2.7-image",    "input": {      "messages": [        {          "role": "string",          "content": [            {              "text": "string",              "image": "string"            }          ]        }      ]    },    "parameters": {      "bbox_list": [        "string"      ],      "enable_sequential": true,      "size": "string",      "n": 0,      "thinking_mode": true,      "color_palette": [        {          "hex": "string",          "ratio": "string"        }      ],      "watermark": true,      "seed": 0    }  }'
{
  "code": 0,
  "data": {
    "urls": [
      "string"
    ],
    "usage": {
      "images": 0,
      "seconds": 0,
      "input_tokens": 0,
      "total_tokens": 0,
      "output_tokens": 0
    },
    "expired": "string",
    "task_id": "string",
    "task_status": "string"
  },
  "message": "string",
  "request_id": "string"
}