簡短回答
支援。 API易 的 Claude、OpenAI、Gemini、DeepSeek、Qwen、Grok 等主流通道都支援快取計費:快取相關請求引數原樣轉發上游,響應裡的快取命中欄位原樣回吐,後臺賬單按官方折扣倍率單列快取計費項 —— 你的程式碼無需為中轉層做任何適配。 其中 Claude 和 OpenAI 的快取命中穩定好用(站內有專門指南,見下方連結);DeepSeek、Qwen、Grok 也好用;Gemini 的隱式快取雖然支援,但命中率一般,建議不要把成本預算押在 Gemini 快取上。三大通道對比
各通道說明
OpenAI:全自動,最省心
請求字首不少於 1024 tokens 且保持穩定,就自動命中,命中部分按輸入價 1 折計費,沒有寫入費 —— 第 2 次請求即淨省。怎麼寫出會命中的請求、怎麼用prompt_cache_key 提高命中率,見 OpenAI Prompt Caching 快取計費指南。
Claude:手動打標記,省得最狠
在要快取的 content block 上打cache_control 標記,命中按 0.1× 計費(寫入收 1.25× / 2×)。Claude Code、Cline、Cursor 等深度場景必備。注意只在 Anthropic 原生格式(/v1/messages)下生效,用 OpenAI 相容格式調 Claude 拿不到快取。詳見 Claude Prompt Caching 快取計費指南。
Gemini:支援但別指望太高
API易 對 Gemini 原生格式自動啟用隱式上下文快取,命中部分按 Google 官方折扣計費。但實際使用中 Gemini 的快取命中率明顯不如 Claude / OpenAI(上游隱式快取的命中行為不可控),建議:- 把緩存摺扣當作”有則更好”的額外優惠,做成本測算時按無快取價格估算
- 對快取敏感的高頻長字首業務,優先選 OpenAI 或 Claude 通道
DeepSeek / Qwen / Grok 等其它通道
這幾家的快取都是全自動的(無需打標記),通過 API易 呼叫同樣正常命中,實際體驗良好:
提高命中率的思路和 OpenAI 一致:穩定內容放前面、動態內容放後面,時間戳和隨機 ID 別放 prompt 開頭。具體玩法可直接套用 OpenAI 快取計費指南 裡的”穩定字首”方法論。
怎麼確認自己命中了
看響應usage 裡的快取欄位:
欄位大於 0 即命中。後臺呼叫日誌中,命中部分會按折扣倍率單列計費項,可直接核對。
注意事項
- 快取按模型隔離:換模型(哪怕同系列不同檔位)不共享快取
- 上表未列出的其它廠商模型(如 Kimi 等),快取支援情況以呼叫日誌實際回吐的快取欄位為準
- 各家官方機制細節可參考:
platform.openai.com/docs/guides/prompt-caching、docs.claude.com/en/docs/build-with-claude/prompt-caching、ai.google.dev/gemini-api/docs/caching、api-docs.deepseek.com/quick_start/pricing、docs.x.ai/developers/advanced-api-usage/prompt-caching
相關文件
OpenAI 快取計費指南
全自動快取:1024 tokens 起步、命中 1 折、prompt_cache_key 提高命中率
Claude 快取計費指南
cache_control 怎麼打、回本點計算、多輪對話進階玩法
模型倍率說明
瞭解控制台分組倍率與美元價格的換算關係
呼叫日誌查詢
檢視每次請求的 tokens 消耗和快取計費明細
聯絡我們
企業微信客服
郵件諮詢
客服郵箱:[email protected]商務合作:[email protected]
