Qwen 图像编辑
调用 Ali qwen-image-2.0-pro 执行单图编辑或多图融合。
公开调用方案保留顶层 model、input、response_format,并将 n、size、watermark、prompt_extend、negative_prompt、seed 设计为顶层字段。输入图片位于 input.messages[0].content[].image,编辑指令位于同一数组中的 text。请求体不接受顶层 parameters。
授权
在请求头中传入 Authorization: Bearer <token>。
请求体
模型名称。示例值:qwen-image-2.0-pro。
qwen-image-2.0-pro 响应格式。url 返回图片下载链接;b64_json 返回 Base64 编码的图片数据。默认值为 url。
url, b64_json 输出图像数量,默认值为 1。对于 qwen-image-2.0 系列模型,可选择输出 1-6 张图片。
1 <= x <= 6输出图像分辨率,格式为 宽*高,例如 1024*1536。qwen-image-2.0 系列模型输出图像总像素需在 512*512 至 2048*2048 之间。默认总像素接近 1024*1024,宽高比贴近输入图片(多图时以最后一张为准)。推荐常用分辨率:1:1 1024*1024、1536*1536;2:3 768*1152、1024*1536;3:2 1152*768、1536*1024;3:4 960*1280、1080*1440;4:3 1280*960、1440*1080;9:16 720*1280、1080*1920;16:9 1280*720、1920*1080;21:9 1344*576、2048*872。
是否在图像右下角添加 "Qwen-Image" 水印。默认值为 false。
是否开启提示词智能改写,默认值为 true。开启后,模型会优化正向提示词(text),对描述较简单的提示词效果提升明显。
反向提示词,用于描述不希望在图像中出现的内容,对画面进行限制。支持中英文,长度不超过 500 个字符,超出部分将自动截断。示例值:低分辨率,低画质,肢体畸形,手指畸形,画面过饱和,蜡像感,人脸无细节,过度光滑,画面具有AI感。构图混乱。文字模糊,扭曲。
500随机数种子,取值范围 [0, 2147483647]。使用相同的 seed 参数值可使生成内容保持相对稳定。若不提供,算法将自动使用随机数种子。注意:模型生成过程具有概率性,即使使用相同的 seed,也不能保证每次生成结果完全一致。
0 <= x <= 2147483647