Skip to main content
POST
对话补全:Qwen3.8-Max(OpenAI 兼容)
右側 Playground 可直接除錯:在 AuthorizationBearer sk-your-api-key,預設示例已帶 reasoning_effort: "none",點擊發送即可看到響應。
模型預設開啟深度思考(預設 xhigh 檔,思考計入輸出計費)。示例預設關閉思考是為了讓除錯更快更省;需要複雜推理時刪掉 reasoning_effort 欄位並把 max_tokens 給到 4000+。概覽與完整實測資料見 Qwen3.8-Max 概覽

引數說明速查

三個容易踩的坑

1. max_tokens 管不住思考。 實測設 max_tokens=1,仍被計 1054 個輸出 token(其中 1045 個是思考)。控成本請用 reasoning_effort="none"2. 強制工具呼叫要關思考。 tool_choice"required" 或指定函式時,思考模式下會返回 400 或靜默不呼叫,需同時傳 reasoning_effort="none"3. thinking_budget 不生效。 傳任何數值都等同 low 檔,請改用 reasoning_effort

響應要點

  • 思考正文看 choices[0].message.reasoning_content(思考開啟時回顯)
  • 思考消耗看 usage.completion_tokens_details.reasoning_tokens;快取命中看 usage.prompt_tokens_details.cached_tokens
  • 部分上游線路不回顯這兩個欄位(實測約佔三分之一的請求),需要精確核算思考成本時請留意
  • reasoning_effort 七個合法值實測只對應四個真實檔位,傳 max 不會比 xhigh 想得更多
  • 傳入非法的 reasoning_effort 會返回 400 並列出全部合法值,不會靜默降級

相關文件

授權

Authorization
string
header
必填

在请求头中添加 Authorization: Bearer YOUR_API_KEY

主體

application/json
model
string
必填

固定 qwen3.8-max

messages
object[]
必填

OpenAI 标准消息数组

max_tokens
integer

可见回答的输出配额,范围 [1, 131072]。注意:不约束思考 tokens

reasoning_effort
enum<string>

思考分档,默认 xhigh。实测只有四个真实档位:none / minimal≡low / medium / high≡xhigh≡max

可用選項:
none,
minimal,
low,
medium,
high,
xhigh,
max
temperature
number

有效范围 [0.0, 2.0),传 2 即报 400

top_p
number

有效范围 (0.0, 1.0]

top_k
integer
stream
boolean

SSE 流式输出。本端点即使不带 stream_options 也会在末块回 usage

stop
string[]

停止序列,实测生效

response_format
object

结构化输出,json_schema 实测严格守约。建议同时设 reasoning_effort: none

tools
object[]

Function Call 工具列表,实测可用

tool_choice
any

auto / none 可直接用;required 或指定函数时需同时设 reasoning_effort: none

parallel_tool_calls
boolean

设为 false 可限制为单个工具调用,实测生效

n
integer

候选数量。大于 1 时需同时设 reasoning_effort: none

logprobs
boolean

回應

对话补全成功

id
string
model
string
choices
object[]
usage
object

用量统计。部分上游线路不回显 reasoning_tokens 与 cached_tokens