wan2.7-i2v 首尾帧图生视频
提交一个异步的 Ali wan2.7-i2v 首尾帧生视频任务。
使用 first_frame 指定首帧图像,last_frame 指定尾帧图像,可选搭配 driving_audio 驱动音频。
支持的 media 组合为:
first_frame + last_framefirst_frame + last_frame + driving_audio
本能力下 prompt 为可选字段。size 仅支持 720P 与 1080P。seconds 仅支持 2 到 15 的整数字符串。还支持官方字段 negative_prompt、prompt_extend、watermark 与 seed。
授权
在请求头中传入 Authorization: Bearer <token>。
请求体
模型名称。可选值:wan2.7-i2v。
wan2.7-i2v 媒体素材列表,用于指定视频生成所需的参考素材(图像、音频和视频)。数组的每个元素为一个媒体对象,包含 type 与 url 字段。
素材组合(仅支持以下特定的组合,非法组合将报错):
- 首尾帧生视频:
first_frame+last_frame - 首尾帧+音频:
first_frame+last_frame+driving_audio
每种 type 在 media 数组中最多出现一次(例如:不可同时传入两个 first_frame)。
文本提示词。用来描述生成视频中期望包含的元素和视觉特点。支持中英文,长度不超过5000个字符。每个汉字/字母占一个字符,超过部分会自动截断。
指定生成的视频分辨率档位,用于控制视频的清晰度(总像素)。
模型根据选择的分辨率档位,自动缩放至相近总像素。视频宽高比尽量与输入素材(首帧或首段视频)保持一致。
720P, 1080P 视频时长的字符串形式。当前支持 2 到 15 的整数字符串。
2, 3, 4, 5, 6, 7, 8, 9, 10, 11, 12, 13, 14, 15 反向提示词,用来描述不希望在视频画面中看到的内容,可以对视频画面进行限制。支持中英文,长度不超过500个字符,超过部分会自动截断。示例值:低分辨率、错误、最差质量、低质量、残缺、多余的手指、比例不良等。
是否开启 prompt 智能改写。开启后使用大模型对输入 prompt 进行智能改写。对于较短的 prompt 生成效果提升明显,但会增加耗时。true(默认值):开启智能改写。false:不开启智能改写。
是否添加水印标识,水印位于视频右下角,文案固定为 "AI生成"。false(默认值):不添加水印。true:添加水印。
随机数种子,取值范围为 [0, 2147483647]。未指定时,系统自动生成随机种子。若需提升生成结果的可复现性,建议固定 seed 值。请注意,由于模型生成具有概率性,即使使用相同 seed,也不能保证每次生成结果完全一致。
0 <= x <= 2147483647