Skip to main content
POST
对话补全:Gemini 3.5 Flash-Lite(OpenAI 兼容)
右側 Playground 可直接除錯:在 AuthorizationBearer sk-your-api-key,點擊發送即可看到響應——預設零思考,速度很快。
需要深度推理傳 reasoning_effort: "high"(注意:本模型該端點不回顯 reasoning_tokens,精確觀測思考消耗請用 原生線上除錯)。搜尋 grounding、程式碼執行等原生工具本端點不支援。概覽與實測資料見 Gemini 3.5 Flash-Lite 概覽

引數說明速查

響應要點

  • 本模型 usage.completion_tokens_details.reasoning_tokens 不回顯(3.6 Flash 正常回顯)——思考消耗已計入 completion_tokens
  • 思考正文(reasoning_content)本端點不回顯
  • 模型名注意核對 gemini-3.5-flash-lite(三段小寫連字元)

授權

Authorization
string
header
必填

在请求头中添加 Authorization: Bearer YOUR_API_KEY

主體

application/json
model
string
必填

固定 gemini-3.5-flash-lite

messages
object[]
必填

OpenAI 标准消息数组

max_tokens
integer

输出配额;开思考时建议 2000+(思考计入输出)

temperature
number
stream
boolean

SSE 流式输出

reasoning_effort
enum<string>

思考分档

可用選項:
low,
medium,
high
response_format
object

结构化输出,支持 json_schema

tools
object[]

Function Call 工具列表

回應

对话补全成功

id
string
model
string
choices
object[]
usage
object

用量统计