聊天补全
使用 OpenAI 兼容接口创建聊天补全。
POST
使用这个接口发起聊天补全请求。
所有请求都使用 Bearer Token 鉴权。基础地址为
https://api.kie.ai。授权
在请求头中传入 Authorization: Bearer <token>。
请求体
application/json
Chat Completions 请求体。
要调用的模型 ID,例如 gpt-4.1。
对话历史消息数组,按时间顺序排列。
采样温度。越低越稳定,越高越发散。
必填范围:
0 <= x <= 2核采样参数。通常与 temperature 二选一调优。
必填范围:
0 <= x <= 1部分兼容模型支持的 Top-K 采样参数。
要生成的候选响应数量。
是否启用流式输出。为 true 时响应内容类型为 text/event-stream。
流式响应附加选项。
停止序列。可以是单个字符串,也可以是字符串数组。
兼容旧接口的最大输出 token 数。
推荐使用的最大生成 token 数。显式传 0 也会按请求透传。
存在惩罚。值越高,越鼓励模型引入新话题。
必填范围:
-2 <= x <= 2频率惩罚。值越高,越抑制重复表达。
必填范围:
-2 <= x <= 2可供模型调用的工具定义列表。
控制模型如何选择工具。
可用选项:
none, auto, required 控制响应格式,例如纯文本、JSON 对象或 JSON Schema 约束输出。
部分模型支持的随机种子,用于提升结果可复现性。
推理强度,仅支持推理控制的模型生效。
可用选项:
low, medium, high 是否允许模型并行发起多个工具调用。
调用方用户标识。不同上游可能要求字符串或对象,本网关按原值透传。
与本次请求关联的自定义元数据。
是否允许上游存储该请求/响应数据。不同兼容目标可能返回布尔值或对象语义。
响应
请求成功。非流式时返回标准 JSON;流式时返回 SSE 事件流。