Skip to main content
POST
Chat completion: Gemini 3.6 Flash (OpenAI-compatible)
右側のプレイグラウンドを使います: AuthorizationBearer sk-your-api-key を入れてください。デフォルトの例では reasoning_effort: "low" を使っています。送信するとレスポンスが表示されます。
Thinking はデフォルトで ON です(出力として課金されます)。デバッグでは low のままにしておき、複雑なタスクでは max_tokens を 4000 以上にして high に切り替えてください。検索 grounding、コード実行、その他のネイティブツールはこのエンドポイントでは利用できません — 代わりに ネイティブ プレイグラウンド を使ってください。概要と計測データ: Gemini 3.6 Flash 概要

パラメーターのクイックリファレンス

応答ノート

  • Thinking の消費は usage.completion_tokens_details.reasoning_tokens です(このモデルで報告されます)
  • Thinking テキスト(reasoning_content)はこのエンドポイントでは表示されません。思考を確認するには、ネイティブのエンドポイントの includeThoughts を使用してください
  • モデル名 gemini-3.6-flash を再確認してください。 টাইポがあると、サイレントなフォールバックではなくエラーになります

承認

Authorization
string
header
必須

Add Authorization: Bearer YOUR_API_KEY header

ボディ

application/json
model
string
必須

Fixed: gemini-3.6-flash

messages
object[]
必須

Standard OpenAI messages array

max_tokens
integer

Output quota; 2000+ recommended with thinking on (thinking bills as output)

temperature
number
stream
boolean

SSE streaming

reasoning_effort
enum<string>

Thinking tier

利用可能なオプション:
low,
medium,
high
response_format
object

Structured output, json_schema supported

tools
object[]

Function-calling tool list

レスポンス

Success

id
string
model
string
choices
object[]
usage
object

Usage stats