gemini-3.8-flash)是谷歌 2026 年 9 月 2 日推出的多模態文本模型,支援文本 / 影像 / 影片 / 音訊輸入。API易 已開通 Gemini 原生與 OpenAI 相容雙端點,並在上線前完成 150 例雙協議成對實測(以 gemini-3.7-flash 為參照)。
API易 已接入 Gemini 3.8 Flash:模型名
gemini-3.8-flash,default / svip 分組可用。預設開啟深度思考(思考 tokens 計入輸出計費),對延遲和成本敏感的場景請調低思考檔位或關閉思考(詳見下方「思考控制」)。核心優勢
比 3.6 Flash 便宜一半
輸入 $0.75 / 輸出 $3.75 每 1M tokens,是 3.6 Flash($1.50 / $7.50)的一半;與 3.7 Flash 逐項同價,從 3.7 平遷零成本變化。
上線前 150 例實測
與 3.7 Flash 成對同時發起、雙協議覆蓋,核心能力、推理、並行工具呼叫、圖片影片理解逐項對齊,未發現 3.8 獨有回退。
雙端點無縫接入
Gemini 原生格式(官方 SDK 直連,無需 Google API Key)與 OpenAI 相容格式(改 base_url 即用)同時開通。
遷移成本接近於零
從 3.7 Flash 只改模型名:請求結構、引數、返回欄位均不變,實測響應欄位集差異僅 1 組且無欄位型別變化。
模型資訊
實測能力矩陣
以下為 API易 2026 年 9 月 2 日的實測結果,共 150 份用例日誌、198 次呼叫,每個用例與gemini-3.7-flash 同時發起以排除時段干擾:
定價
與
gemini-3.7-flash 逐項一致,從 3.7 平遷不涉及任何成本變化;相比 3.6 Flash($1.50 / $7.50)則直接減半。
價格說明:思考 tokens 按輸出計費——這是控制思考檔位最直接的理由。谷歌尚未公佈 3.8 Flash 的官方定價;作為參考,3.7 Flash 現行的 $0.75 / $3.75 是谷歌自己的限時優惠價,官方註明有效期至 2026 年 12 月 31 日。API易 的模型價格與原廠逐項對齊,折扣通過充值加贈體現,詳見 充值優惠。
思考控制
預設開啟深度思考:一句 1+1 也會先產生上百思考 tokens。實測三檔(同一道題、原生端點):呼叫示例
Gemini 原生格式(推薦,工具支援更全)
OpenAI 相容格式(存量程式碼零改造)
遷移指南
從 gemini-3.7-flash 遷移
從 gemini-3.7-flash 遷移
只改模型名。實測請求結構、引數與返回欄位均無變化,響應欄位集差異僅 1 組且無型別變化,客戶端不需要適配。價格逐項相同,用量預算可直接沿用。
從 gemini-3.6-flash 遷移
從 gemini-3.6-flash 遷移
價格直接減半(輸入 $1.50 → $0.75、輸出 $7.50 → $3.75),但有一處必改:
thinkingLevel: "minimal" 已不支援,原生端點會返回 400,需改成 thinkingConfig: {"thinkingBudget": 0}。OpenAI 相容端的 reasoning_effort: "minimal" 不報錯但會被靜默忽略、思考照常計費,務必一併改掉。上下文上限是多少?
上下文上限是多少?
官方未公佈,我們也不按 3.7 的數字推測。實測 14.5K 字元字首的長上下文定位任務正常通過。長上下文重度依賴的場景建議先小流量灰度,確認邊界後再全量切換;官方規格公佈後本頁會補齊。
原生端點需要 Google API Key 嗎?
原生端點需要 Google API Key 嗎?
不需要。API易 令牌(
sk- 開頭)直接放在 x-goog-api-key 請求頭即可,官方 google-genai SDK 只需把 base_url 改為 https://api.apiyi.com。哪些能力只有原生端點有?
哪些能力只有原生端點有?
程式碼執行、URL context、
safetySettings、stopSequences 與 seed 的嚴格執行都只在 Gemini 原生端點可用。OpenAI 相容端覆蓋常規能力(對話 / 流式 / Function Call / JSON Schema / 視覺),但 stop 與 seed 實測不生效。