Skip to main content
Kimi K2.5 — это флагманская нативная мультимодальная модель Moonshot AI, выпущенная 27 января 2026 года. Она ориентирована на Visual Coding и автономную оркестрацию Agent Swarm, а контекстное окно 256K предлагается без доплаты. APIYI интегрирует ее через официальный релей-канал Alibaba Cloud для стабильности уровня production. Базовый коэффициент тарифа группы составляет 0.88× от официальной тарификации, а накопление бонусов за пополнение (от пополнения на $100 → $10 в подарок и выше) снижает фактическую стоимость ниже 80% от официальной тарификации.
Kimi K2.5 доступна в APIYI: официальный релей-канал Alibaba Cloud, совместимый с OpenAI эндпоинт, ID модели kimi-k2.5. В отличие от официального сайта Kimi, режим Thinking необходимо явно включать через enable_thinking: true в теле запроса — по умолчанию модель работает в режиме Instant.

Ключевые преимущества

Контекст 256K

256K tokens без доплаты — поместите всю кодовую базу среднего размера или длинный документ в один вызов.

Режим рассуждения

Поддерживает глубокое рассуждение с помощью enable_thinking: true — создан для сложного планирования, анализа первопричин и агентов.

Нативная мультимодальность + визуальное кодирование

Нативно понимает изображения и код — отлично подходит для преобразования макетов интерфейсов, скриншотов и диаграмм в исполняемый код.

Стабильный перенос через Alibaba Cloud

Маршрутизируется через официальный канал transfer Alibaba Cloud — SLA уровня enterprise при высокой параллельности запросов.

Информация о модели

Встроенный инструмент $web_search в Kimi сейчас несовместим с режимом Thinking. По рекомендации Moonshot отключите enable_thinking, когда вам нужен инструмент web_search. Это ограничение соответствует официальной платформе.

Цены

Примечания к тарификации: APIYI использует коэффициент тарифа 0.88× (88% от официальной базовой цены) в качестве базовой ставки группы. Суммирование бонусов за онбординг / крупное пополнение (например, пополнение на $100 → $10 бесплатно и выше) снижает фактическую стоимость ниже 80% от официальной. См. Акции за пополнение для подробностей.

Как включить режим Thinking

Самое большое отличие от официального сайта Kimi заключается в том, что APIYI по умолчанию использует режим Instant — вам нужно явно включить Thinking через enable_thinking в теле запроса:

Пример cURL (Thinking включен)

Как вызывать

Эндпоинт

Базовое использование (Мгновенный режим)

Расширенное использование (Режим рассуждения)

Потоковая передача

Параметры запроса

Формат ответа

Лучшие практики

  1. Переключайте режимы в зависимости от задачи: Оставляйте Instant mode включенным для повседневного чата и коротких генераций; для сложного рассуждение, code review и agent planning задавайте enable_thinking: true.
  2. Используйте контекст 256K: Поместите в один запрос репозиторий среднего размера, полную документацию продукта или длинные стенограммы встреч — без доплаты.
  3. Мультимодальное визуальное кодирование: Отправляйте скриншоты интерфейса / дизайн-макеты и позвольте K2.5 за один проход «прочитать → спланировать → написать код».
  4. Растягивайте экономию: Сочетайте бонус за пополнение на $100+ с коэффициентом тарифа группы 0.88× — итоговая стоимость снижается ниже 80% от официальной.
  5. Учитывайте оговорку насчет web_search: Отключите enable_thinking, если вам нужен встроенный $web_search инструмент от Moonshot.

Часто задаваемые вопросы

Режим Thinking по умолчанию выключен. Убедитесь, что тело запроса включает "enable_thinking": true. В OpenAI Python SDK передавайте это внутри extra_body; в Node.js SDK вы можете передать это как поле верхнего уровня.
Да — это та же исходная модель, маршрутизируемая через официальный канал Alibaba Cloud official-transfer. Единственное отличие в том, что режим Thinking по умолчанию выключен, и его нужно включить через enable_thinking.
При создании API token в консоли APIYI назначьте его группе, включающей Kimi K2.5 — тарификация автоматически применяет коэффициент 0.88×. С учетом бонусов за пополнение общая стоимость становится еще ниже. См. Акции на пополнение.
Да. Передавайте стандартные определения в стиле OpenAI для tools. Обратите внимание, что официальный встроенный инструмент $web_search несовместим с режимом Thinking — используйте их в отдельных вызовах.
Трассировки Thinking учитываются как output tokens и тарифицируются как обычно. Для сложных задач output tokens может быть значительно больше, поэтому включайте его только когда вам нужно более глубокое рассуждение.

Связанные ресурсы

Руководство по API

Полное руководство по использованию API

Акции на пополнение

Используйте бонусы, чтобы еще сильнее снизить цену

Информация о моделях

Просмотрите все доступные модели и группы

Сценарии использования

Руководства по интеграции для клиентов