Responses API
使用 Responses API 兼容格式创建模型响应。input 可传入字符串或消息数组;需要多轮上下文时可传入上一轮响应的 previous_response_id,也可把上一轮 output 中的消息、推理或工具调用项放回 input。
公开字段:model、input、instructions、previous_response_id、conversation、stream、store、tools、tool_choice、temperature、top_p、enable_thinking、reasoning、ocr_options。字段是否生效取决于模型和上游渠道能力。
授权
在请求头中传入 Authorization: Bearer <token>。
请求头
可选的上游会话缓存开关。仅在当前模型和上游渠道支持时生效。
enable 请求体
模型名称。请使用平台接口已公开且支持 Responses API 的模型;具体模型是否支持工具、OCR 或思考模式,取决于当前渠道能力。
MiniMax-M2.5, MiniMax-M2.5-highspeed, MiniMax-M2.7, MiniMax-M2.7-highspeed, MiniMax-M3, mimo-v2.5, mimo-v2.5-pro, qwen3-coder-plus, qwen3-max, qwen3.5-flash, qwen3.6-plus, deepseek-v3-2-251201, seed-1-6-250915, seed-1-6-flash-250715, seed-1-8-251228, seed-2-0-lite-260228, seed-2-0-mini-260215, seed-2-0-pro-260328 "qwen3.6-plus"
模型输入。可传入纯文本字符串,也可传入按对话顺序排列的消息数组。多轮工具调用时,可把上一轮响应中的 message、function_call、function_call_output 或 reasoning 项传回。
系统指令,插入到上下文起始位置。使用 previous_response_id 时,上一轮的 instructions 不会自动传入本轮上下文。
上一轮响应的 id。用于创建多轮对话,服务端会把上一轮输入和输出组合为上下文。不能与 conversation 同时使用。
当前响应所属的会话 ID。会话历史会作为上下文传入,本次输入和输出会在响应完成后添加到会话中。不能与 previous_response_id 同时使用。
是否启用流式输出。设置为 true 时返回 SSE 事件流。
是否存储本次响应。设为 false 时,该响应不能通过 previous_response_id 作为后续上下文使用。
模型生成响应时可调用的工具数组。可混合使用内置工具和自定义 function 工具。工具是否生效取决于模型和上游渠道支持情况。
- Option 1
- Option 2
- Option 3
- Option 4
控制模型如何选择工具。字符串模式支持 auto、none、required;对象模式用于限制模型只能在给定工具列表中选择。
auto, none, required 采样温度,控制输出随机性。建议不要同时设置 temperature 和 top_p。
0 <= x < 2核采样概率阈值,控制输出多样性。建议不要同时设置 temperature 和 top_p。
0 < x <= 1是否开启思考模式。该字段不是 OpenAI 标准字段,建议使用 reasoning.effort 替代。
控制模型的思考强度。设置后,模型可能在回复前生成 reasoning 类型输出项。
OCR 定制任务参数,仅适用于支持 OCR 的模型。定制任务结果会通过响应内容中的 ocr_result 返回。
响应
调用成功。非流式模式返回完整 Response 对象;流式模式返回 SSE 事件流。
本次响应的唯一标识符,可用于 previous_response_id。
本次请求的 Unix 时间戳(秒)。
固定为 response。
response 响应生成状态。
completed, failed, in_progress, cancelled, queued, incomplete 用于生成响应的模型 ID。
模型生成的输出项数组。数组中的元素类型和顺序取决于模型响应和工具调用情况。
- Option 1
- Option 2
- 函数调用
- Option 4
- Option 5
- Option 6
是否并行调用工具。
回显请求中的工具选择策略。
回显请求中的工具配置。
- Option 1
- Option 2
- Option 3
- Option 4
Token 用量统计。启用工具、缓存、OCR 或多模态输入时,可能返回额外明细字段。
生成失败时的错误对象;成功时通常为 null。