Skip to main content
Модель MoE с общим объёмом 284B / 13B активных, созданная для высокой параллельности и низкой задержки; неявное кэширование не требует настройки и обеспечивает почти полные попадания начиная со второго сообщения.

Характеристики

Цены

Цены в USD за 1M tokens ($/1M).
Таблица показывает базовые цены. Акции на пополнение и групповые скидки суммируются; консоль в реальном времени отражает фактическое списание. См. Цены и Акции на пополнение.

Эндпоинты

Группы тарификации

Некоторые группы предусматривают дополнительные скидки, которые суммируются с бонусами за пополнение. См. Токены и группы.

Поддерживаемые возможности

Пример запроса

Пример ниже вызывает deepseek-v4-flash через OpenAI Chat Completions (/v1/chat/completions). Укажите base_url на https://api.apiyi.com/v1 — всё остальное соответствует официальному API.
Читайте ключ из переменной окружения, никогда не встраивайте его в код. В production выпускайте отдельные token для каждого сценария использования, чтобы вы могли отзывать их и учитывать использование по отдельности.

Связанная документация

Анонс запуска

Контекст, бенчмарки и заметки по миграции для DeepSeek V4 Flash

Обзор

Параметры, использование и лучшие практики

DeepSeek V4 Pro

Сведения о модели из той же линейки

Каталог тарификации моделей

Актуальная тарификация, эндпоинты и группы для всех 296 моделей
Спецификации на этой странице ведутся вручную в models/data/model-details.json; тарификация и эндпоинты берутся из актуального API тарификации, обновлено 2026-08-17 13:47 (UTC+8), спецификации последний раз проверены 2026-08-17.