Skip to main content
POST
Chat Completions
创建一次模型响应,基于对话上下文(messages 数组)。 所有支持对话能力的模型(OpenAI / Claude / Gemini / DeepSeek / Qwen 等)都可通过此接口调用。

请求

鉴权

主要参数

messages 结构

支持的 role:system / user / assistant / tool(函数返回)。

响应

finish_reason 可能值:stop / length / tool_calls / content_filter

流式响应

stream: true 时,服务端按 SSE 格式推送 chunk:
stream_options.include_usage: true 后,会在最后多发一条带 usage 的 chunk:

函数调用

响应中:
执行工具后把结果追加到 messages:
再次调用 chat completions 即可让模型基于工具结果继续回答。

推理模型

对 o3 / GPT-5 系列,使用 reasoning_effort:
也可使用带后缀的模型 ID(o3-mini-low / -medium / -high),效果等价。

错误

常见错误见 错误码