跳转到主要内容

核心要点

  • 两款同上:谷歌 2026 年 7 月更新的 gemini-3.6-flash(多模态旗舰 Flash)与 gemini-3.5-flash-lite(高频轻量款)已在 API易开放,default / svip 分组可用
  • 双端点全量实测:Gemini 原生格式 + OpenAI 兼容格式各 30+ 用例逐项验证,非”挂名可用”——搜索 grounding、Maps grounding、URL context、代码执行、Computer Use(3.6)全部实测放通
  • 官方同价:3.6 Flash 输入 $1.50 / 输出 $7.50,3.5 Flash-Lite 输入 $0.30 / 输出 $2.50(每 1M tokens,输出含思考),折扣走充值加赠(最高 20%,≈83 折)
  • 思考默认值相反:3.6 默认开思考(四档可控 0–837 tokens),Lite 默认零思考约 2 秒极速响应——选型关键就看这一条
  • 1M 上下文同规格:两款均为 1,048,576 输入 / 65,536 输出,文本/图像/视频/音频/PDF 全模态输入

背景介绍

Gemini 3.6 Flash 与 Gemini 3.5 Flash-Lite 是谷歌 2026 年 7 月更新的两款 stable 文本模型:前者接棒 Flash 主力位,把 Computer Use(Preview)等原生工具带进 Flash 档;后者延续 Flash-Lite 的”快与省”路线,音频输入与文本同价。 API易在上线前完成双端点全量实测(每模型 26 条主用例 + 5 条补测),覆盖官方 Capabilities 表的全部可测项。本文所有数据均来自 2026 年 7 月 22 日的实测记录。

详细解析

实测能力矩阵

高级工具(搜索/地图/URL/代码执行/Computer Use)为 Gemini 原生格式专属,OpenAI 兼容端覆盖对话、流式、FC、JSON Schema、视觉等常规能力。原生端点直接用 API易令牌(x-goog-api-key: sk-...),无需 Google API Key。

怎么选?

  • 选 3.6 Flash:需要深度推理、复杂规划、原生工具重度使用、Computer Use
  • 选 3.5 Flash-Lite:高频短问答、分类、抽取、翻译、客服等吞吐优先场景——快约一倍、便宜至 1/5

实际应用

价格与可用性

与谷歌官网完全一致;充值加赠最高 20%(充 $100 送 10%),综合约 83 折。Google 搜索 grounding 按 $14 / 1K 次查询计。

总结与建议

两款模型填补了 API易 Gemini 文本线的最新版位:3.6 Flash 是”工具全家桶 + 思考可控”的主力选择,Lite 则是目前谷歌系性价比最高的高频引擎。接入零门槛——官方 google-genai SDK 或 OpenAI SDK 改个 base_url 即用。 📖 详细实测与接入指南:Gemini 3.6 Flash 概览 | Gemini 3.5 Flash-Lite 概览