跳转到主要内容
POST
对话补全:Gemini 3.6 Flash(OpenAI 兼容)
右侧 Playground 可直接调试:在 AuthorizationBearer sk-your-api-key,默认示例 reasoning_effort: "low",点击发送即可看到响应。
模型默认开启深度思考(计入输出计费),调试建议保持 low;复杂任务改 high 并把 max_tokens 给到 4000+。搜索 grounding、代码执行等原生工具本端点不支持,请改用 原生在线调试。概览与实测数据见 Gemini 3.6 Flash 概览

参数说明速查

响应要点

  • 思考消耗看 usage.completion_tokens_details.reasoning_tokens(实测正常回显)
  • 思考正文(reasoning_content)本端点不回显;需要看思考过程请用原生端点 includeThoughts
  • 模型名拼写错误会返回错误而非静默降级,注意核对 gemini-3.6-flash

授权

Authorization
string
header
必填

在请求头中添加 Authorization: Bearer YOUR_API_KEY

请求体

application/json
model
string
必填

固定 gemini-3.6-flash

messages
object[]
必填

OpenAI 标准消息数组

max_tokens
integer

输出配额;开思考时建议 2000+(思考计入输出)

temperature
number
stream
boolean

SSE 流式输出

reasoning_effort
enum<string>

思考分档

可用选项:
low,
medium,
high
response_format
object

结构化输出,支持 json_schema

tools
object[]

Function Call 工具列表

响应

对话补全成功

id
string
model
string
choices
object[]
usage
object

用量统计