Wan 图像编辑
调用 Ali wan2.7-image-pro 执行图像编辑。
公开调用方案保留顶层 model、input、response_format,并将 size、n、watermark、negative_prompt、seed、bbox_list 设计为顶层字段。输入图片位于 input.messages[0].content[].image,编辑指令位于同一数组中的 text。请求体不接受顶层 parameters。
授权
在请求头中传入 Authorization: Bearer <token>。
请求体
模型名称。可选值:wan2.7-image-pro。
wan2.7-image-pro 统一响应格式。支持的值:url 或 b64_json。
url, b64_json 关于输出图片分辨率参数,支持以下两种方式,不可混用:
方式一:指定输出图片的分辨率(推荐) 支持 1K、2K(默认)、4K 三种规格。
- 文生图(无图片输入,非组图生成):支持 1K、2K、4K。
- 其他场景:支持 1K、2K。
- 各规格总像素:1K:1024×1024、2K:2048×2048、4K:4096×4096。
- 当有图片输入时:输出宽高比与输入图像(多图输入时为最后一张)一致,并缩放到选定分辨率。
- 当没有图片输入时:输出为正方形。
方式二:指定生成图像的宽高像素值
格式:{width}*{height},例如 1024*768。
- 文生图:总像素在 [768×768, 4096×4096] 之间,宽高比范围 [1:8, 8:1]。
- 其他场景:总像素在 [768×768, 2048×2048] 之间,宽高比范围 [1:8, 8:1]。
注意:输出图片的像素值可能和指定像素值存在微小差异。
重要:n 直接影响费用。费用 = 单价 × 成功生成的图片张数,请在调用前确认模型价格。
关闭组图模式时,该数值代表生成图像数量,取值范围 1-4,默认为 1;
开启组图模式时,该数值代表最大生成图像数量,取值范围 1-12,默认为 12。实际数量由模型决定且不超过 n。
1 <= x <= 12是否添加水印标识,水印位于图片右下角,文案固定为 "AI生成"。false(默认值):不添加水印。true:添加水印。
反向提示词,描述输出中应避免的内容。
随机数种子,取值范围 [0, 2147483647]。
使用相同的 seed 参数值可使生成内容保持相对稳定。若不提供,算法将自动使用随机数种子。
注意:模型生成过程具有概率性,即使使用相同的 seed,也不能保证每次生成结果完全一致。
0 <= x <= 2147483647交互式编辑框选区域。
对应关系:列表长度必须与输入图片数量一致。若某张图片无需编辑,请在对应位置传入空列表 []。
坐标格式:[x1, y1, x2, y2](左上角 x, 左上角 y, 右下角 x, 右下角 y),使用原图绝对像素坐标,左上角坐标为(0,0)。
限制条件:单张图片最多支持 2 个边界框。
示例:输入 3 张图片,其中第 2 张无框选,第 1 张有两个框选: