Skip to main content

簡短回答

支援。 API易 的 Claude、OpenAI、Gemini、DeepSeek、Qwen、Grok 等主流通道都支援快取計費:快取相關請求引數原樣轉發上游,響應裡的快取命中欄位原樣回吐,後臺賬單按官方折扣倍率單列快取計費項 —— 你的程式碼無需為中轉層做任何適配。 其中 Claude 和 OpenAI 的快取命中穩定好用(站內有專門指南,見下方連結);DeepSeek、Qwen、Grok 也好用;Gemini 的隱式快取雖然支援,但命中率一般,建議不要把成本預算押在 Gemini 快取上。

三大通道對比

各通道說明

OpenAI:全自動,最省心

請求字首不少於 1024 tokens 且保持穩定,就自動命中,命中部分按輸入價 1 折計費,沒有寫入費 —— 第 2 次請求即淨省。怎麼寫出會命中的請求、怎麼用 prompt_cache_key 提高命中率,見 OpenAI Prompt Caching 快取計費指南

Claude:手動打標記,省得最狠

在要快取的 content block 上打 cache_control 標記,命中按 0.1× 計費(寫入收 1.25× / 2×)。Claude Code、Cline、Cursor 等深度場景必備。注意只在 Anthropic 原生格式(/v1/messages)下生效,用 OpenAI 相容格式調 Claude 拿不到快取。詳見 Claude Prompt Caching 快取計費指南

Gemini:支援但別指望太高

API易 對 Gemini 原生格式自動啟用隱式上下文快取,命中部分按 Google 官方折扣計費。但實際使用中 Gemini 的快取命中率明顯不如 Claude / OpenAI(上游隱式快取的命中行為不可控),建議:
  • 把緩存摺扣當作”有則更好”的額外優惠,做成本測算時按無快取價格估算
  • 對快取敏感的高頻長字首業務,優先選 OpenAI 或 Claude 通道

DeepSeek / Qwen / Grok 等其它通道

這幾家的快取都是全自動的(無需打標記),通過 API易 呼叫同樣正常命中,實際體驗良好: 提高命中率的思路和 OpenAI 一致:穩定內容放前面、動態內容放後面,時間戳和隨機 ID 別放 prompt 開頭。具體玩法可直接套用 OpenAI 快取計費指南 裡的”穩定字首”方法論。

怎麼確認自己命中了

看響應 usage 裡的快取欄位: 欄位大於 0 即命中。後臺呼叫日誌中,命中部分會按折扣倍率單列計費項,可直接核對。

注意事項

快取跟著呼叫格式走:用 OpenAI 相容格式(/v1/chat/completions)調 Claude 模型時,無法獲得 Claude 的緩存摺扣 —— 深度使用 Claude 請走原生 /v1/messages 格式。
  • 快取按模型隔離:換模型(哪怕同系列不同檔位)不共享快取
  • 上表未列出的其它廠商模型(如 Kimi 等),快取支援情況以呼叫日誌實際回吐的快取欄位為準
  • 各家官方機制細節可參考:platform.openai.com/docs/guides/prompt-cachingdocs.claude.com/en/docs/build-with-claude/prompt-cachingai.google.dev/gemini-api/docs/cachingapi-docs.deepseek.com/quick_start/pricingdocs.x.ai/developers/advanced-api-usage/prompt-caching

相關文件

OpenAI 快取計費指南

全自動快取:1024 tokens 起步、命中 1 折、prompt_cache_key 提高命中率

Claude 快取計費指南

cache_control 怎麼打、回本點計算、多輪對話進階玩法

模型倍率說明

瞭解控制台分組倍率與美元價格的換算關係

呼叫日誌查詢

檢視每次請求的 tokens 消耗和快取計費明細

聯絡我們

企業微信客服

企業微信客服二維碼掃碼新增 或 點選聯絡客服快取功能諮詢、技術支援

郵件諮詢

客服郵箱[email protected]商務合作[email protected]