Skip to main content
POST

授权

Authorization
string
header
必填

使用来自 https://omniall.ai/dashboard 的 Authorization: Bearer sk-...

请求体

application/json

OpenAI Chat Completions 请求体(POST /v1/chat/completions)。字段映射到网关 GeneralOpenAIRequest。

model
string
必填

模型广场 / GET /v1/models 中的模型 ID,须为当前 Key 可访问的模型。

示例:

"gpt-4o"

messages
object[]
必填

完整对话历史,按时间从早到晚。按需包含 system/user/assistant/tool 轮次。

stream
boolean
默认值:false

为 true 时返回 SSE(chat.completion.chunk),而非单个 JSON 对象。

stream_options
object

流式输出

temperature
number

采样温度(约 0–2)。越高越随机;0 更稳定。

必填范围: 0 <= x <= 2
top_p
number

核采样概率质量(0–1)。建议主要调 temperature 或 top_p 之一,勿同时大幅调整。

必填范围: 0 <= x <= 1
top_k
integer

上游模型支持时的 Top-K 采样(部分 OpenAI 模型会忽略)。

n
integer

为该提示生成多少条补全(费用随 n 增加)。

必填范围: x >= 1
max_tokens
integer

旧版补全最大 token。新版 OpenAI 模型请优先用 max_completion_tokens。

max_completion_tokens
integer

模型最多可生成的 token 数(新版 OpenAI 聊天模型推荐)。

stop

停止序列。生成到任一序列即结束。

presence_penalty
number

根据是否已出现过惩罚新 token(−2 到 2)。正值更鼓励新话题。

必填范围: -2 <= x <= 2
frequency_penalty
number

按词频惩罚 token(−2 到 2)。正值减少重复。

必填范围: -2 <= x <= 2
seed
number

厂商支持时的尽力确定性种子。

user
string

用于滥用监控的稳定终端用户 id(不透明字符串)。请勿放入密钥。

logit_bias
object

token-id → 偏置映射,用于封禁/增强特定 token(厂商相关)。

logprobs
boolean

是否返回输出 token 的对数概率。

top_logprobs
integer

启用 logprobs 时每个位置返回的最可能 token 数。

response_format
object

强制输出形态。json_object 要求合法 JSON;json_schema 要求符合你的 schema

tools
object[]

可供模型在 Agent 流程中使用的函数工具。

tool_choice

控制工具使用:none / auto / required,或强制某个函数。

可用选项:
none,
auto,
required
parallel_tool_calls
boolean

模型是否可在一轮内调用多个工具。

reasoning_effort
enum<string>

o 系列 / 兼容模型的推理强度(low / medium / high)。

可用选项:
low,
medium,
high
modalities
enum<string>[]

请求的输出模态,如 text、audio。

可用选项:
text,
audio
audio
object

使用音频模态时的音频输出设置。

web_search_options
object

模型支持搜索时的 OpenAI 风格联网选项。

enable_search

通义风格联网开关(视渠道/模型而定)。

厂商特定联网对象(如百度)。

search_parameters
object

xAI 搜索参数对象。

thinking
object

豆包 / 智谱思考控制。

enable_thinking

通义思考开关。

extra_body
object

额外厂商字段(OpenAI 兼容路径上有时用于 Gemini 相关选项)。

metadata
object

支持时任意元数据透传。

prediction
object

可预知部分答案时的预测输出提示,用于降低延迟。

响应

Chat Completions JSON;当 stream=true 时为 SSE 流。

非流式 Chat Completions 响应。

id
string

唯一补全 id。

object
string

非流式时固定为 chat.completion。

示例:

"chat.completion"

created
integer

补全创建时的 Unix 时间戳(秒)。

model
string

产出回答的模型(可能反映路由结果)。

choices
object[]

生成的候选(通常一条)。

usage
object

上游提供时的 token 用量。

system_fingerprint
string

上游提供时的系统指纹(可复现性信号)。