Skip to main content
Gemini 3.8 Flash(gemini-3.8-flash)是谷歌 2026 年 9 月 2 日推出的多模態文本模型,支援文本 / 影像 / 影片 / 音訊輸入。API易 已開通 Gemini 原生OpenAI 相容雙端點,並在上線前完成 150 例雙協議成對實測(以 gemini-3.7-flash 為參照)。
API易 已接入 Gemini 3.8 Flash:模型名 gemini-3.8-flashdefault / svip 分組可用。預設開啟深度思考(思考 tokens 計入輸出計費),對延遲和成本敏感的場景請調低思考檔位或關閉思考(詳見下方「思考控制」)。
官方規格尚未公佈:截至本頁釋出,谷歌的 Gemini API 模型列表與 DeepMind 模型卡都還沒有收錄 3.8 Flash,官方釋出部落格也未上線。因此上下文視窗、最大輸出、知識截止、官方基準分數本頁一律標註”官方未公佈”,不做轉述也不做推測。本頁所有”實測”標記的內容均來自 API易 自己的測試,官方材料釋出後會同步補齊。

核心優勢

比 3.6 Flash 便宜一半

輸入 $0.75 / 輸出 $3.75 每 1M tokens,是 3.6 Flash($1.50 / $7.50)的一半;與 3.7 Flash 逐項同價,從 3.7 平遷零成本變化。

上線前 150 例實測

與 3.7 Flash 成對同時發起、雙協議覆蓋,核心能力、推理、並行工具呼叫、圖片影片理解逐項對齊,未發現 3.8 獨有回退。

雙端點無縫接入

Gemini 原生格式(官方 SDK 直連,無需 Google API Key)與 OpenAI 相容格式(改 base_url 即用)同時開通。

遷移成本接近於零

從 3.7 Flash 只改模型名:請求結構、引數、返回欄位均不變,實測響應欄位集差異僅 1 組且無欄位型別變化。

模型資訊

實測能力矩陣

以下為 API易 2026 年 9 月 2 日的實測結果,共 150 份用例日誌、198 次呼叫,每個用例與 gemini-3.7-flash 同時發起以排除時段干擾:
搜尋 grounding 待確認:傳入 tools: [{"googleSearch": {}}] 時請求返回 200 且答案正確,但響應中沒有 groundingMetadata,說明該答案來自模型自身知識而非即時檢索。gemini-3.7-flash 在同一輪測試中表現完全相同,因此這更可能是鏈路層面的開通狀態、而非模型能力差異。依賴即時檢索的場景請先小流量驗證,不要按”已 grounding”設計。

定價

gemini-3.7-flash 逐項一致,從 3.7 平遷不涉及任何成本變化;相比 3.6 Flash($1.50 / $7.50)則直接減半
價格說明:思考 tokens 按輸出計費——這是控制思考檔位最直接的理由。谷歌尚未公佈 3.8 Flash 的官方定價;作為參考,3.7 Flash 現行的 $0.75 / $3.75 是谷歌自己的限時優惠價,官方註明有效期至 2026 年 12 月 31 日。API易 的模型價格與原廠逐項對齊,折扣通過充值加贈體現,詳見 充值優惠

思考控制

預設開啟深度思考:一句 1+1 也會先產生上百思考 tokens。實測三檔(同一道題、原生端點):
minimal 檔已被移除(3.6 Flash 有、3.8 沒有):原生端點傳 thinkingLevel: "minimal" 會直接返回 400 Thinking level is unsupported: THINKING_LEVEL_MINIMAL。要完全關閉思考請改用 thinkingConfig: {"thinkingBudget": 0}更需要注意 OpenAI 相容端:傳 reasoning_effort: "minimal" 不會報錯,返回 200,但實測仍消耗了 76 個思考 token 並計入輸出計費——即引數被靜默忽略、思考照常發生。從 3.6 Flash 遷移過來的程式碼若還帶著 minimal,在這一端不會有任何報錯提示你改。
需要檢視思考過程時傳 thinkingConfig: {"includeThoughts": true},響應中會返回帶 thought: true 標記的思考 part,用量看 usageMetadata.thoughtsTokenCount。OpenAI 相容端用 reasoning_effort(low / medium / high)分檔,消耗看 usage.completion_tokens_details.reasoning_tokens

呼叫示例

Gemini 原生格式(推薦,工具支援更全)

OpenAI 相容格式(存量程式碼零改造)

遷移指南

只改模型名。實測請求結構、引數與返回欄位均無變化,響應欄位集差異僅 1 組且無型別變化,客戶端不需要適配。價格逐項相同,用量預算可直接沿用。
價格直接減半(輸入 $1.50 → $0.75、輸出 $7.50 → $3.75),但有一處必改:thinkingLevel: "minimal" 已不支援,原生端點會返回 400,需改成 thinkingConfig: {"thinkingBudget": 0}。OpenAI 相容端的 reasoning_effort: "minimal" 不報錯但會被靜默忽略、思考照常計費,務必一併改掉。
官方未公佈,我們也不按 3.7 的數字推測。實測 14.5K 字元字首的長上下文定位任務正常通過。長上下文重度依賴的場景建議先小流量灰度,確認邊界後再全量切換;官方規格公佈後本頁會補齊。
不需要。API易 令牌(sk- 開頭)直接放在 x-goog-api-key 請求頭即可,官方 google-genai SDK 只需把 base_url 改為 https://api.apiyi.com
程式碼執行、URL context、safetySettingsstopSequencesseed 的嚴格執行都只在 Gemini 原生端點可用。OpenAI 相容端覆蓋常規能力(對話 / 流式 / Function Call / JSON Schema / 視覺),但 stopseed 實測不生效。

相關文件