Skip to main content
POST
deepseek-v4-pro

授权

Authorization
string
header
必填

在请求头中传入 Authorization: Bearer <token>

请求体

application/json

DeepSeek chat completions 请求体。

model
enum<string>
必填

使用的模型的 ID。支持 deepseek-v4-pro

可用选项:
deepseek-v4-pro
示例:

"deepseek-v4-pro"

messages
(System message · object | User message · object | Assistant message · object | Tool message · object)[]
必填

对话的消息列表。

Minimum array length: 1

对话的消息列表中的单条消息。根据 role 的不同,分为 system、user、assistant、tool 四种消息类型。

thinking
object

控制思考模式与非思考模式的转换。

stream
boolean
默认值:false

如果设置为 true,将会以 SSE(server-sent events)的形式以流式发送消息增量。消息流以 data: [DONE] 结尾。

stream_options
object

流式输出相关选项。只有在 stream 参数为 true 时,才可设置此参数。

max_tokens
integer

限制一次请求中模型生成 completion 的最大 token 数。输入 token 和输出 token 的总长度受模型的上下文长度的限制。

stop

一个 string 或最多包含 16 个 string 的 list,在遇到这些词时,API 将停止生成更多的 token。

reasoning_effort
enum<string>

控制模型的推理强度。对普通请求,默认为 high。对一些复杂 Agent 类请求(如 Claude Code、OpenCode),自动设置为 max。出于兼容考虑 low、medium 会映射为 high,xhigh 会映射为 max。

可用选项:
high,
max
response_format
object

一个 object,指定模型必须输出的格式。

设置为 { "type": "json_object" } 以启用 JSON 模式,该模式保证模型生成的消息是有效的 JSON。

注意: 使用 JSON 模式时,你还必须通过系统或用户消息指示模型生成 JSON。否则,模型可能会生成不断的空白字符,直到生成达到令牌限制,从而导致请求长时间运行并显得“卡住”。此外,如果 finish_reason="length",这表示生成超过了 max_tokens 或对话超过了最大上下文长度,消息内容可能会被部分截断。

temperature
number
默认值:1

采样温度,介于 0 和 2 之间。更高的值,如 0.8,会使输出更随机,而更低的值,如 0.2,会使其更加集中和确定。我们通常建议可以更改这个值或者更改 top_p,但不建议同时对两者进行修改。

必填范围: 0 <= x <= 2
top_p
number
默认值:1

作为调节采样温度的替代方案,模型会考虑前 top_p 概率的 token 的结果。所以 0.1 就意味着只有包括在最高 10% 概率中的 token 会被考虑。我们通常建议修改这个值或者更改 temperature,但不建议同时对两者进行修改。

必填范围: 0 <= x <= 1
logprobs
boolean

是否返回所输出 token 的对数概率。如果为 true,则在 message 的 content 中返回每个输出 token 的对数概率。

top_logprobs
integer

一个介于 0 到 20 之间的整数 N,指定每个输出位置返回输出概率 top N 的 token,且返回这些 token 的对数概率。指定此参数时,logprobs 必须为 true。

必填范围: 0 <= x <= 20
tools
object[]

模型可能会调用的 tool 的列表。目前,仅支持 function 作为工具。使用此参数来提供以 JSON 作为输入参数的 function 列表。最多支持 128 个 function。

tool_choice

控制模型调用 tool 的行为。none 意味着模型不会调用任何 tool,而是生成一条消息。auto 意味着模型可以选择生成一条消息或调用一个或多个 tool。required 意味着模型必须调用一个或多个 tool。通过 {"type": "function", "function": {"name": "my_function"}} 指定特定 tool,会强制模型调用该 tool。

可用选项:
none,
auto,
required
user_id
string

您自定义的 user_id,可选字符集为 [a-zA-Z0-9-_],最大长度为 512。请不要在 user_id 中包含用户隐私信息。user_id 可用于区分您业务侧的用户身份,以帮助我们进行内容安全处理。 user_id 可用于 KVCache 缓存隔离,以进行隐私管理。 user_id 可用于我们对您业务侧用户进行调度隔离。

响应

调用成功。非流式模式返回 JSON;流式模式返回 SSE 事件流。

DeepSeek chat completions 成功响应。

id
string

该对话的唯一标识符。

object
string

对象的类型,其值为 chat.completion。

created
integer

创建聊天完成时的 Unix 时间戳(以秒为单位)。

model
string

生成该 completion 的模型名。

system_fingerprint
string

该指纹代表模型运行的后端配置。

choices
object[]

模型生成的 completion 的选择列表。

usage
object

该对话补全请求的用量信息。