Skip to main content
POST
Chat completion: Gemini 3.5 Flash-Lite (OpenAI-compatible)
右側のプレイグラウンドを使用してください。Bearer sk-your-api-keyAuthorization に設定して送信します。デフォルトでは推論を行わないため、応答は高速です。
深い推論を行うには reasoning_effort: "high" を指定してください(注: このエンドポイントでは、このモデルの reasoning_tokens は報告されません。正確な推論の観察には ネイティブ Playground をご利用ください)。検索グラウンディング、コード実行、およびその他のネイティブツールは、このエンドポイントでは利用できません。概要と測定データ: Gemini 3.5 Flash-Lite 概要

パラメータ早見表

レスポンス注記

  • usage.completion_tokens_details.reasoning_tokens はこのモデルでは報告されません(3.6 Flash では報告されます) — thinking の消費は completion_tokens に含まれます
  • thinking テキスト(reasoning_content)はこのエンドポイントではエコーされません
  • モデル名 gemini-3.5-flash-lite(小文字 3 セグメント、ハイフン区切り)を再確認してください

承認

Authorization
string
header
必須

Add Authorization: Bearer YOUR_API_KEY header

ボディ

application/json
model
string
必須

Fixed: gemini-3.5-flash-lite

messages
object[]
必須

Standard OpenAI messages array

max_tokens
integer

Output quota; 2000+ recommended with thinking on (thinking bills as output)

temperature
number
stream
boolean

SSE streaming

reasoning_effort
enum<string>

Thinking tier

利用可能なオプション:
low,
medium,
high
response_format
object

Structured output, json_schema supported

tools
object[]

Function-calling tool list

レスポンス

Success

id
string
model
string
choices
object[]
usage
object

Usage stats