通用对话接口
OpenAI Chat Completions 兼容格式,适用于 GPT / Claude / Gemini
POST
使用 OpenAI Chat Completions 兼容格式发起对话请求,可统一调用 GPT、Claude、Gemini 等文本与多模态模型。
接口说明
该接口用于以统一对话格式调用 OpenAI、Claude、Gemini 等上游模型。默认返回完整 JSON;如需边生成边展示,请在请求体中传入"stream": true。
模型可用范围取决于 API Key 的分组权限。完整模型清单以
GET /v1/models 返回为准。请求头
string
required
API Key 鉴权信息,格式为
Bearer YOUR_API_KEY。string
required
固定为
application/json。请求体
string
default:"gpt-5.5"
required
模型 ID,例如
gpt-5.5、gpt-5.4、claude-sonnet-4-6。可通过模型广场或 GET /v1/models 查询当前 API Key 可用模型。object[]
required
boolean
default:false
是否使用 SSE 流式返回,默认
false。boolean
流式模式下是否在结束前返回 token 用量信息。
number
采样温度,常用范围为
0 到 2。数值越高,输出越发散。integer
最大输出 token 数。
响应体
string
本次请求的唯一 ID。
string
对象类型。非流式响应通常为
chat.completion,流式片段通常为 chat.completion.chunk。string
实际参与生成的模型 ID。
object[]
模型输出结果数组。非流式响应中可读取
choices[0].message.content;流式响应中可逐段读取 choices[0].delta.content。object
token 用量统计,通常包含
prompt_tokens、completion_tokens 与 total_tokens。