> ## Documentation Index
> Fetch the complete documentation index at: https://docs.apiyi.com/llms.txt
> Use this file to discover all available pages before exploring further.

# Поддерживает ли APIYI тарификацию кэша?

> Да. Claude, OpenAI, Gemini, DeepSeek, Qwen, Grok и другие основные каналы все поддерживают тарификацию кэша — поля попадания в кэш возвращаются без изменений, а счета выставляются по официальным скидочным ставкам

## Краткий ответ

**Да.** Все каналы APIYI **Claude, OpenAI, Gemini, DeepSeek, Qwen и Grok** поддерживают тарификацию кэша: параметры запросов, связанные с кэшем, передаются вверх по цепочке без изменений, поля cache-hit возвращаются без изменений, а в панели тарификации использование кэша отображается отдельными позициями по официальным дисконтным ставкам — в вашем коде не требуется никакой специфической для middleware адаптации.

**Попадания в кэш у Claude и OpenAI стабильны и надежны** (у обоих есть отдельные руководства на этом сайте — ссылки ниже). DeepSeek, Qwen и Grok тоже работают хорошо. Неявное кэширование Gemini поддерживается, но его **процент попаданий посредственный** — не закладывайте кэширование Gemini в основу расчета бюджета.

## Три канала вкратце

|                    | OpenAI (серия gpt-5)                                                  | Claude                                                                | Gemini                                                                |
| ------------------ | --------------------------------------------------------------------- | --------------------------------------------------------------------- | --------------------------------------------------------------------- |
| Триггер            | **Полностью автоматически**, без кода                                 | Ручные маркеры `cache_control`                                        | Неявное кэширование, включено автоматически                           |
| Минимальный порог  | 1024 tokens                                                           | 1024–4096 tokens в зависимости от модели                              | 4096 (серия 3) / 2048 (серия 2.5)                                     |
| Плата за запись    | Бесплатно                                                             | 1.25× (5 мин) / 2× (1 час)                                            | Бесплатно                                                             |
| Цена попадания     | 0.1× от входа                                                         | 0.1× от входа                                                         | По официальной скидке Google                                          |
| Практический опыт  | ✅ Стабильные попадания                                                | ✅ Стабильные попадания                                                | ⚠️ Средняя частота попаданий                                          |
| Полное руководство | [Тарификация кэша OpenAI](/ru/api-capabilities/openai/prompt-caching) | [Тарификация кэша Claude](/ru/api-capabilities/claude-prompt-caching) | [Тарификация кэша Gemini](/ru/api-capabilities/gemini/prompt-caching) |

## Примечания по каналу

### OpenAI: полностью автоматически, без усилий

Стабильный префикс длиной не менее 1024 token приводит к автоматическому попаданию в кэш — совпавшая часть тарифицируется по **10% от цены входа**, без платы за запись, так что уже 2-й запрос дает чистую экономию. Как писать запросы, чтобы они попадали в кэш, и как использовать `prompt_cache_key`: см. [Руководство по тарификации кэширования промптов OpenAI](/ru/api-capabilities/openai/prompt-caching).

### Claude: ручные маркеры, максимальная экономия

Добавьте `cache_control` к блокам содержимого, которые хотите кэшировать; попадания тарифицируются по **0.1×** (запись стоит 1.25× / 2×). Это особенно важно для Claude Code, Cline, Cursor и других сценариев с высокой нагрузкой. Учтите, что это **работает только в нативном формате Anthropic (`/v1/messages`)** — при вызове Claude через формат, совместимый с OpenAI, скидка за кэш не применяется. См. [Руководство по тарификации кэширования промптов Claude](/ru/api-capabilities/claude-prompt-caching).

### Gemini: поддерживается, но ожидания лучше не завышать

APIYI автоматически включает неявное кэширование контекста для нативного формата Gemini, а попадания тарифицируются по официальной скидке Google. На практике, однако, **процент попаданий в кэш у Gemini заметно ниже, чем у Claude / OpenAI** (поведение неявного кэширования на стороне upstream не поддается управлению). Наша рекомендация:

* Рассматривайте скидку за кэш как приятный бонус — **оценивайте затраты по цене без кэша**
* Для нагрузок, чувствительных к кэшу, с длинными и часто повторяющимися префиксами, отдавайте предпочтение каналам OpenAI или Claude

## Другие каналы: DeepSeek / Qwen / Grok

Кэширование на этих каналах **полностью автоматическое** (маркеры не нужны), нормально работает через APIYI и на практике показывает хорошие результаты:

| Канал          | Триггер                                                                   | Скидка на попадания (официальная)                                  |
| -------------- | ------------------------------------------------------------------------- | ------------------------------------------------------------------ |
| **DeepSeek**   | Автоматически, по совпадению префикса                                     | Попадания экономят **более 90%** — самая большая скидка из всех    |
| **Qwen**       | Неявное кэширование, включено автоматически, префикс не менее 1024 tokens | Попадания тарифицируются по официальной сниженной ставке           |
| **Grok (xAI)** | Автоматически, по совпадению префикса                                     | Попадания экономят примерно **75% или больше** (зависит от модели) |

Повышение доли попаданий работает так же, как и с OpenAI: **сначала стабильный контент, затем изменчивый** — не размещайте временные метки и случайные ID в начале prompt. Подход из руководства [«Тарификация кэша OpenAI»](/ru/api-capabilities/openai/prompt-caching) применим напрямую.

## Как подтвердить попадание

Проверьте поля кэша в ответе `usage`:

| Канал                                      | Поле попадания                                               |
| ------------------------------------------ | ------------------------------------------------------------ |
| OpenAI `/v1/chat/completions`              | `usage.prompt_tokens_details.cached_tokens`                  |
| OpenAI `/v1/responses`                     | `usage.input_tokens_details.cached_tokens`                   |
| Claude `/v1/messages`                      | `usage.cache_read_input_tokens`                              |
| Нативный формат Gemini                     | `usageMetadata.cachedContentTokenCount`                      |
| DeepSeek                                   | `usage.prompt_cache_hit_tokens` / `prompt_cache_miss_tokens` |
| Qwen / Grok (формат, совместимый с OpenAI) | `usage.prompt_tokens_details.cached_tokens`                  |

Значение выше 0 означает попадание. В журналах вызовов на панели управления использование из кэша отображается отдельными позициями со скидкой, которые вы можете проверить напрямую.

## На что обратить внимание

<Warning>
  **Кэширование следует формату вызова**: при вызове моделей Claude через формат, совместимый с OpenAI (`/v1/chat/completions`), вы не получите скидку на кэш Claude — для интенсивного использования Claude применяйте нативный формат `/v1/messages`.
</Warning>

* Кэши **изолированы для каждой модели**: при переключении моделей (даже в пределах одной серии) ничего не используется совместно
* Для вендоров, не перечисленных выше (Kimi и т. д.), ориентируйтесь на поля кэша, которые фактически возвращаются в ваших логах вызовов
* Подробности официального механизма: `platform.openai.com/docs/guides/prompt-caching`, `docs.claude.com/en/docs/build-with-claude/prompt-caching`, `ai.google.dev/gemini-api/docs/caching`, `api-docs.deepseek.com/quick_start/pricing`, `docs.x.ai/developers/advanced-api-usage/prompt-caching`

## Связанные документы

<CardGroup cols={2}>
  <Card title="Руководство по тарификации кэширования OpenAI" icon="database" href="/ru/api-capabilities/openai/prompt-caching">
    Автоматическое кэширование: порог в 1024 token, попадания со скидкой 90%, маршрутизация по prompt\_cache\_key
  </Card>

  <Card title="Руководство по тарификации кэширования Claude" icon="database" href="/ru/api-capabilities/claude-prompt-caching">
    Где размещать cache\_control, математика точки безубыточности, техники многоходового диалога
  </Card>

  <Card title="Множители моделей" icon="calculator" href="/ru/faq/model-multiplier">
    Как коэффициенты группы консоли преобразуются в цены в USD
  </Card>

  <Card title="Журналы вызовов" icon="file-text" href="/ru/faq/call-logs">
    Просматривайте использование token по каждому запросу и сведения о тарификации кэша
  </Card>
</CardGroup>

## Свяжитесь с нами

<CardGroup cols={2}>
  <Card title="Поддержка WeCom" icon="message-circle" href="https://work.weixin.qq.com/kfid/kfc9adfd5810ece25ec">
    <img src="https://mintcdn.com/apiyillc/fpi567ydpk7adDt0/images/wecom-qrcode.png?fit=max&auto=format&n=fpi567ydpk7adDt0&q=85&s=7286b96e94110e3a48798b649df1b45b" alt="QR-код поддержки WeCom" style={{maxWidth: "180px"}} width="400" height="400" data-path="images/wecom-qrcode.png" />

    Отсканируйте, чтобы добавить, или [свяжитесь с поддержкой](https://work.weixin.qq.com/kfid/kfc9adfd5810ece25ec)

    Вопросы по тарификации кэша и техническая поддержка
  </Card>

  <Card title="Электронная почта" icon="mail">
    **Поддержка**: [support@apiyi.com](mailto:support@apiyi.com)

    **Бизнес**: [business@apiyi.com](mailto:business@apiyi.com)
  </Card>
</CardGroup>
