Skip to main content
低成本高吞吐款,思考档位可调,适合高并发与批量处理。

规格

定价

单位为美元每 100 万 tokens($/1M)。
表中为默认标价。充值活动与分组优惠可叠加,实际扣费以控制台实时显示为准。详见价格说明充值活动

端点支持

可用分组

部分分组有折扣,且可与充值优惠叠加。分组的完整说明见令牌与分组

支持的特性

模型变体

调用示例

以下示例通过 OpenAI Chat Completions(/v1/chat/completions)调用 gemini-3.1-flash-lite。base_url 换成 https://api.apiyi.com/v1 即可,其余用法与官方一致。
Key 从环境变量读取,不要写死在代码里。生产环境建议为不同用途分别建令牌,便于单独停用与用量归因。

相关文档

上线公告

Gemini 3.1 Flash-Lite 的发布背景、实测表现与迁移建议

原生调用

参数、调用方式与最佳实践

Gemini 3.5 Flash-Lite

同系列模型详情

模型价格总表

全量 308 个模型的实时价格、端点与分组
本页规格数据人工维护于 models/data/model-details.json,价格与端点取自系统实时定价接口,数据更新于 2026-07-31 01:30 (UTC+8),规格最后核对于 2026-07-31。