Skip to main content
POST
使用这个接口发起聊天补全请求。 所有请求都使用 Bearer Token 鉴权。基础地址为 https://api.kie.ai

授权

Authorization
string
header
必填

在请求头中传入 Authorization: Bearer <token>

请求体

application/json

Chat Completions 请求体。

model
string
必填

要调用的模型 ID,例如 gpt-4.1

messages
object[]
必填

对话历史消息数组,按时间顺序排列。

temperature
number
默认值:1

采样温度。越低越稳定,越高越发散。

必填范围: 0 <= x <= 2
top_p
number
默认值:0.95

核采样参数。通常与 temperature 二选一调优。

必填范围: 0 <= x <= 1
top_k
integer

部分兼容模型支持的 Top-K 采样参数。

n
integer

要生成的候选响应数量。

stream
boolean
默认值:true

是否启用流式输出。为 true 时响应内容类型为 text/event-stream

stream_options
object

流式响应附加选项。

stop

停止序列。可以是单个字符串,也可以是字符串数组。

max_tokens
integer

兼容旧接口的最大输出 token 数。

max_completion_tokens
integer

推荐使用的最大生成 token 数。显式传 0 也会按请求透传。

presence_penalty
number
默认值:0

存在惩罚。值越高,越鼓励模型引入新话题。

必填范围: -2 <= x <= 2
frequency_penalty
number
默认值:0

频率惩罚。值越高,越抑制重复表达。

必填范围: -2 <= x <= 2
tools
object[]

可供模型调用的工具定义列表。

tool_choice

控制模型如何选择工具。

可用选项:
none,
auto,
required
response_format
object

控制响应格式,例如纯文本、JSON 对象或 JSON Schema 约束输出。

seed
number

部分模型支持的随机种子,用于提升结果可复现性。

reasoning_effort
enum<string>

推理强度,仅支持推理控制的模型生效。

可用选项:
low,
medium,
high
parallel_tool_calls
boolean

是否允许模型并行发起多个工具调用。

user

调用方用户标识。不同上游可能要求字符串或对象,本网关按原值透传。

metadata
object

与本次请求关联的自定义元数据。

store

是否允许上游存储该请求/响应数据。不同兼容目标可能返回布尔值或对象语义。

响应

请求成功。非流式时返回标准 JSON;流式时返回 SSE 事件流。

非流式 Chat Completions 响应。

id
string

响应 ID。

object
string

对象类型,固定为 chat.completion

示例:

"chat.completion"

created
integer

Unix 时间戳(秒)。

model
string

实际使用的模型 ID。

choices
object[]

模型生成的候选结果列表。

usage
object

Token 用量统计。不同兼容格式返回的字段可能略有差异。

system_fingerprint
string | null

系统指纹。若上游未返回,该字段可能缺失或为 null