Skip to main content
POST

授权

Authorization
string
header
必填

在请求头中传入 Authorization: Bearer <token>

请求体

application/json
model
enum<string>
必填

模型名称。可选值:wan2.7-r2v

可用选项:
wan2.7-r2v
prompt
string
必填

文本提示词。用来描述生成视频中期望包含的元素和视觉特点。

支持中英文,每个汉字、字母、标点占一个字符,超过部分会自动截断。

wan2.7-r2v:不超过5000个字符。

参考指代: 当为中文提示词时,参考图片时通过"图1、图2"这类标识指代,参考视频时通过"视频1、视频2"这类标识指代。英文提示词则写为"Image 1"、"Video 1"这类标识。英文字母和数字之间有空格,首字母大写。顺序与 media 数组顺序一致。图和视频分别计数,即同时存在图1、视频1等标识。若参考素材有且仅有一张图片或一个视频,则可简化表述为"参考图片"或"参考视频"。

画面描述: 假设参考图1是一只猫,图2是一个房间,要描述猫在房间里玩耍,支持两种写法:一种是直接使用标识指代(如"图1在图2里玩耍");另一种是结合主体与场景补充说明(如"图1的猫在图2的房间里玩耍")。

多宫格(故事板图像): 当参考图片为多宫格(故事板图像)时,提示词建议按照多分镜的形式描述画面内容。无需描述每个宫格,提供关键分镜内容即可,模型将自动识别宫格逻辑并智能补全镜头内容。为达到更好的效果,建议单次仅输入一张多宫格图。

media
object[]
必填

媒体素材数组,素材包括图像、视频和音频。支持图像/视频输入作为视觉参考,图像支持多视图,常见参考角色、道具、场景等。

数组中每个元素为一个媒体对象,包含 typeurl 字段。

按照数组顺序定义 prompt 中角色引用的顺序。图和视频分别计数,即可同时存在图1、视频1。

  • 数组中的第 1 个 reference_video 对应 视频1,第 2 个对应 视频2,以此类推。
  • 数组中的第 1 个 reference_image 对应 图1,第 2 个对应 图2,以此类推。
size
enum<string>
默认值:1080P

重要 size 直接影响费用,请在调用前确认模型价格。

生成视频的分辨率档位,用于控制视频的清晰度(总像素)。

wan2.7-r2v:可选值:720P1080P。默认值为 1080P

可用选项:
720P,
1080P
seconds
enum<string>
默认值:5

重要 seconds 直接影响费用,请在调用前确认模型价格。

生成视频的时长,单位为秒。

wan2.7-r2v:默认值为 5

  • 当参考素材中包含视频时:取值为 [2, 10] 之间的整数。
  • 当参考素材中不包含视频时:取值为 [2, 15] 之间的整数。
可用选项:
2,
3,
4,
5,
6,
7,
8,
9,
10,
11,
12,
13,
14,
15
ratio
enum<string>
默认值:16:9

生成视频的宽高比。

生效逻辑:

  • 未传入首帧图像:按指定的 ratio 参数生成视频。
  • 已传入首帧图像:自动忽略 ratio 参数,以首帧图像的宽高比生成近似比例的视频。

可选值为:

  • 16:9(默认值)
  • 9:16
  • 1:1
  • 4:3
  • 3:4

不同宽高比对应的输出视频分辨率(宽高像素值):

720P:

  • 16:9 → 1280×720
  • 9:16 → 720×1280
  • 1:1 → 960×960
  • 4:3 → 1104×832
  • 3:4 → 832×1104

1080P:

  • 16:9 → 1920×1080
  • 9:16 → 1080×1920
  • 1:1 → 1440×1440
  • 4:3 → 1648×1248
  • 3:4 → 1248×1648
可用选项:
16:9,
9:16,
1:1,
4:3,
3:4
negative_prompt
string

反向提示词,用来描述不希望在视频画面中出现的内容,可以对视频画面进行限制。

支持中英文,长度不超过500个字符,超过部分会自动截断。

示例值:低分辨率、错误、最差质量、低质量、残缺、多余的手指、比例不良等。

prompt_extend
boolean

是否开启 prompt 智能改写。开启后使用大模型对输入 prompt 进行智能改写。对于较短的 prompt 生成效果提升明显,但会增加耗时。

  • true:默认值,开启智能改写。
  • false:不开启智能改写。
watermark
boolean
默认值:false

是否添加水印标识,水印位于视频右下角,文案固定为 "AI生成"。

  • false:默认值,不添加水印。
  • true:添加水印。
seed
integer

随机数种子,取值范围为 [0, 2147483647]。

未指定时,系统自动生成随机种子。若需提升生成结果的可复现性,建议固定 seed 值。 请注意,由于模型生成具有概率性,即使使用相同 seed,也不能保证每次生成结果完全一致。

必填范围: 0 <= x <= 2147483647

响应

提交成功,返回统一的 OpenAI 风格视频任务对象。

id
string

公开任务 ID。

task_id
string

公开任务 ID 别名。

object
string
示例:

"video"

model
string

模型名称。

status
enum<string>

统一视频任务状态。

可用选项:
queued,
in_progress,
completed,
failed,
unknown
progress
integer

任务进度百分比。

created_at
integer<int64>

秒级 Unix 时间戳。