核心要点
- 两款同上:谷歌 2026 年 7 月更新的
gemini-3.6-flash(多模态旗舰 Flash)与gemini-3.5-flash-lite(高频轻量款)已在 API易开放,default/svip分组可用 - 双端点全量实测:Gemini 原生格式 + OpenAI 兼容格式各 30+ 用例逐项验证,非”挂名可用”——搜索 grounding、Maps grounding、URL context、代码执行、Computer Use(3.6)全部实测放通
- 官方同价:3.6 Flash 输入 $1.50 / 输出 $7.50,3.5 Flash-Lite 输入 $0.30 / 输出 $2.50(每 1M tokens,输出含思考),折扣走充值加赠(最高 20%,≈83 折)
- 思考默认值相反:3.6 默认开思考(四档可控 0–837 tokens),Lite 默认零思考约 2 秒极速响应——选型关键就看这一条
- 1M 上下文同规格:两款均为 1,048,576 输入 / 65,536 输出,文本/图像/视频/音频/PDF 全模态输入
背景介绍
Gemini 3.6 Flash 与 Gemini 3.5 Flash-Lite 是谷歌 2026 年 7 月更新的两款 stable 文本模型:前者接棒 Flash 主力位,把 Computer Use(Preview)等原生工具带进 Flash 档;后者延续 Flash-Lite 的”快与省”路线,音频输入与文本同价。 API易在上线前完成双端点全量实测(每模型 26 条主用例 + 5 条补测),覆盖官方 Capabilities 表的全部可测项。本文所有数据均来自 2026 年 7 月 22 日的实测记录。详细解析
实测能力矩阵
高级工具(搜索/地图/URL/代码执行/Computer Use)为 Gemini 原生格式专属,OpenAI 兼容端覆盖对话、流式、FC、JSON Schema、视觉等常规能力。原生端点直接用 API易令牌(
x-goog-api-key: sk-...),无需 Google API Key。
怎么选?
- 选 3.6 Flash:需要深度推理、复杂规划、原生工具重度使用、Computer Use
- 选 3.5 Flash-Lite:高频短问答、分类、抽取、翻译、客服等吞吐优先场景——快约一倍、便宜至 1/5
实际应用
价格与可用性
与谷歌官网完全一致;充值加赠最高 20%(充 $100 送 10%),综合约 83 折。Google 搜索 grounding 按 $14 / 1K 次查询计。