Skip to main content
POST
使用 OpenAI Chat Completions 兼容格式发起对话请求,可统一调用 GPT、Claude、Gemini 等文本与多模态模型。

接口说明

该接口用于以统一对话格式调用 OpenAI、Claude、Gemini 等上游模型。默认返回完整 JSON;如需边生成边展示,请在请求体中传入 "stream": true
模型可用范围取决于 API Key 的分组权限。完整模型清单以 GET /v1/models 返回为准。

请求头

string
required
API Key 鉴权信息,格式为 Bearer YOUR_API_KEY
string
required
固定为 application/json

请求体

string
default:"gpt-5.5"
required
模型 ID,例如 gpt-5.5gpt-5.4claude-sonnet-4-6。可通过模型广场或 GET /v1/models 查询当前 API Key 可用模型。
object[]
required
对话消息数组,按顺序传入上下文。
string
required
消息角色,常用值为 systemuserassistant
string
required
消息内容。文本对话可传字符串;视觉模型可传 OpenAI 兼容的多模态数组。
boolean
default:false
是否使用 SSE 流式返回,默认 false
boolean
流式模式下是否在结束前返回 token 用量信息。
number
采样温度,常用范围为 02。数值越高,输出越发散。
integer
最大输出 token 数。

响应体

string
本次请求的唯一 ID。
string
对象类型。非流式响应通常为 chat.completion,流式片段通常为 chat.completion.chunk
string
实际参与生成的模型 ID。
object[]
模型输出结果数组。非流式响应中可读取 choices[0].message.content;流式响应中可逐段读取 choices[0].delta.content
object
token 用量统计,通常包含 prompt_tokenscompletion_tokenstotal_tokens

多模态输入

Vision 模型支持 OpenAI 兼容的图片输入格式:

错误码