> ## Documentation Index
> Fetch the complete documentation index at: https://docs.apiyi.com/llms.txt
> Use this file to discover all available pages before exploring further.

# Kimi K2.5 Генерация текста

> Нативный мультимодальный флагман Moonshot AI с контекстным окном 256K и режимом рассуждения. APIYI подключается через официальный релей Alibaba Cloud — коэффициент группового тарифа 0.88× плюс бонусы за пополнение дают эффективную стоимость ниже 80% от официальной.

Kimi K2.5 — нативный мультимодальный флагман Moonshot AI, выпущенный 27 января 2026 года. Он ориентирован на Visual Coding и автономную координацию Agent Swarm, а контекстное окно 256K предлагается без наценки. APIYI интегрирует его через **официальный релейный канал Alibaba Cloud** для стабильности промышленного уровня. Базовый коэффициент тарифа для группы составляет **0.88× от официальной цены**, а суммирование бонусов за пополнение (при пополнении от \$100 → \$10 бесплатно и выше) снижает **эффективную стоимость ниже 80% от официальной цены**.

<Info>
  **Kimi K2.5 доступен в APIYI**: официальный релейный канал Alibaba Cloud, совместимый с OpenAI эндпоинт, ID модели `kimi-k2.5`. В отличие от официального сайта Kimi, **режим Thinking необходимо явно включить через `enable_thinking: true`** в теле запроса — по умолчанию модель работает в режиме Instant.
</Info>

## Ключевые преимущества

<CardGroup cols={2}>
  <Card title="Контекст 256K" icon="scroll">
    256K tokens без доплаты — поместите всю кодовую базу среднего размера или длинный документ в один запрос.
  </Card>

  <Card title="Режим рассуждения" icon="brain">
    Включите глубокое рассуждение с помощью `enable_thinking: true` — создано для сложного планирования, анализа первопричин и агентов.
  </Card>

  <Card title="Нативная мультимодальность + визуальное кодирование" icon="eye">
    Нативно понимает изображения и code — отлично подходит для превращения UI-макетов, скриншотов и диаграмм в исполняемый code.
  </Card>

  <Card title="Стабильная передача через Alibaba Cloud" icon="server">
    Маршрутизируется через официальный канал official-transfer Alibaba Cloud — SLA корпоративного уровня при высокой параллельности запросов.
  </Card>
</CardGroup>

## Информация о модели

| Параметр                                       | Значение                                                      |
| ---------------------------------------------- | ------------------------------------------------------------- |
| **ID модели**                                  | `kimi-k2.5`                                                   |
| **Контекстное окно**                           | 256,000 tokens                                                |
| **Режимы**                                     | Instant / Thinking / Agent / Agent Swarm                      |
| **Переключатель Thinking**                     | `enable_thinking: true` в теле запроса (по умолчанию `false`) |
| **Вход**                                       | Text + Image (native multimodal)                              |
| **Выход**                                      | Text                                                          |
| **Потоковая передача**                         | ✅ Поддерживается                                              |
| **Вызов функций / использование инструментов** | ✅ Поддерживается                                              |
| **Канал**                                      | Alibaba Cloud Official Transfer                               |

<Warning>
  Встроенный инструмент `$web_search` у Kimi в настоящее время несовместим с режимом Thinking. По рекомендации Moonshot отключите `enable_thinking`, когда вам нужен инструмент web\_search. Это ограничение соответствует официальной платформе.
</Warning>

## Тарификация

| Позиция                | Официально         | Группа APIYI (0.88×) | С бонусом за пополнение (примерно) |
| ---------------------- | ------------------ | -------------------- | ---------------------------------- |
| Вход                   | \$0.60 / 1M tokens | \$0.528 / 1M tokens  | \~\$0.48 / 1M tokens               |
| Выход                  | \$2.50 / 1M tokens | \$2.20 / 1M tokens   | \~\$2.00 / 1M tokens               |
| Попадание в кэш (вход) | \$0.10 / 1M tokens | \$0.088 / 1M tokens  | —                                  |

<Info>
  **Примечания к тарификации**: APIYI использует **коэффициент тарифа 0.88×** (88% от официальной базовой цены) в качестве базовой ставки группы. Сочетание бонусов за онбординг / крупное пополнение (например, пополнение на \$100 → \$10 бесплатно и выше) снижает **фактическую стоимость ниже 80% от официальной**. См. [Промоакции пополнения](/ru/faq/recharge-promotions) для подробностей.
</Info>

## Как включить режим Thinking

Самое большое отличие от официального сайта Kimi заключается в том, что в APIYI по умолчанию используется режим Instant — вы должны явно включить Thinking через `enable_thinking` в теле запроса:

| Сценарий использования                      | `enable_thinking`      | Примечания                                                        |
| ------------------------------------------- | ---------------------- | ----------------------------------------------------------------- |
| Ежедневный чат / быстрые ответы             | `false` (по умолчанию) | Режим Instant, минимальная задержка                               |
| Сложное reasoning / планирование кода / RCA | `true`                 | Режим Thinking, выводит trace рассуждения                         |
| Агент с web\_search                         | `false`                | Официальное ограничение: web\_search и thinking взаимоисключающие |

### Пример cURL (Thinking включен)

```bash theme={null}
curl --location 'https://api.apiyi.com/v1/chat/completions' \
  --header "Authorization: Bearer sk-xxxx" \
  --header 'Content-Type: application/json' \
  --data '{
    "model": "kimi-k2.5",
    "messages": [
      {
        "role": "system",
        "content": "You are a helpful assistant."
      },
      {
        "role": "user",
        "content": "What is 1+1?"
      }
    ],
    "enable_thinking": true
  }'
```

## Как вызвать

### Эндпоинт

```
https://api.apiyi.com/v1/chat/completions
```

### Базовое использование (мгновенный режим)

<CodeGroup>
  ```bash cURL theme={null}
  curl -X POST "https://api.apiyi.com/v1/chat/completions" \
    -H "Authorization: Bearer YOUR_API_KEY" \
    -H "Content-Type: application/json" \
    -d '{
      "model": "kimi-k2.5",
      "messages": [
        {"role": "user", "content": "Introduce yourself in one sentence."}
      ]
    }'
  ```

  ```python Python theme={null}
  from openai import OpenAI

  client = OpenAI(
      api_key="YOUR_API_KEY",
      base_url="https://api.apiyi.com/v1"
  )

  response = client.chat.completions.create(
      model="kimi-k2.5",
      messages=[
          {"role": "user", "content": "Introduce yourself in one sentence."}
      ]
  )

  print(response.choices[0].message.content)
  ```

  ```javascript Node.js theme={null}
  import OpenAI from 'openai';

  const client = new OpenAI({
    apiKey: 'YOUR_API_KEY',
    baseURL: 'https://api.apiyi.com/v1'
  });

  const response = await client.chat.completions.create({
    model: 'kimi-k2.5',
    messages: [
      { role: 'user', content: 'Introduce yourself in one sentence.' }
    ]
  });

  console.log(response.choices[0].message.content);
  ```
</CodeGroup>

### Расширенное использование (режим рассуждения)

<CodeGroup>
  ```python Python theme={null}
  from openai import OpenAI

  client = OpenAI(
      api_key="YOUR_API_KEY",
      base_url="https://api.apiyi.com/v1"
  )

  response = client.chat.completions.create(
      model="kimi-k2.5",
      messages=[
          {"role": "system", "content": "You are a helpful assistant."},
          {"role": "user", "content": "Analyze the time complexity of this code and suggest optimizations."}
      ],
      extra_body={
          "enable_thinking": True
      }
  )

  print(response.choices[0].message.content)
  ```

  ```javascript Node.js theme={null}
  import OpenAI from 'openai';

  const client = new OpenAI({
    apiKey: 'YOUR_API_KEY',
    baseURL: 'https://api.apiyi.com/v1'
  });

  const response = await client.chat.completions.create({
    model: 'kimi-k2.5',
    messages: [
      { role: 'system', content: 'You are a helpful assistant.' },
      { role: 'user', content: 'Analyze the time complexity of this code and suggest optimizations.' }
    ],
    // @ts-ignore - custom field
    enable_thinking: true
  });

  console.log(response.choices[0].message.content);
  ```
</CodeGroup>

### Потоковая передача

```python theme={null}
response = client.chat.completions.create(
    model="kimi-k2.5",
    messages=[{"role": "user", "content": "Write a short poem about spring."}],
    stream=True,
    extra_body={"enable_thinking": True}
)

for chunk in response:
    if chunk.choices[0].delta.content:
        print(chunk.choices[0].delta.content, end="", flush=True)
```

## Параметры запроса

| Имя               | Тип     | Обязательно | Примечания                                    |
| ----------------- | ------- | ----------- | --------------------------------------------- |
| `model`           | string  | Yes         | Должно быть `kimi-k2.5`                       |
| `messages`        | array   | Yes         | Сообщения диалога                             |
| `enable_thinking` | boolean | No          | Включить режим Thinking; по умолчанию `false` |
| `stream`          | boolean | No          | Потоковый вывод                               |
| `temperature`     | number  | No          | Температура выборки, 0–2                      |
| `max_tokens`      | integer | No          | Максимальное число tokens вывода              |
| `tools`           | array   | No          | Список функций / инструментов                 |

## Формат ответа

```json theme={null}
{
  "id": "chatcmpl-xxxxxxxx",
  "object": "chat.completion",
  "created": 1706300000,
  "model": "kimi-k2.5",
  "choices": [
    {
      "index": 0,
      "message": {
        "role": "assistant",
        "content": "1+1 equals 2."
      },
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 24,
    "completion_tokens": 12,
    "total_tokens": 36
  }
}
```

## Лучшие практики

1. **Переключайте режимы в зависимости от задачи**: оставляйте режим Instant включённым для ежедневных чатов и коротких генераций; установите `enable_thinking: true` для сложного reasoning, code review и agent planning.
2. **Используйте контекст 256K**: поместите репозиторий среднего размера, полную документацию по продукту или длинные стенограммы встреч в один запрос — без доплаты.
3. **Мультимодальное визуальное кодирование**: отправляйте скриншоты UI / дизайн-макеты и позвольте K2.5 за один заход «прочитать → спланировать → написать код».
4. **Растяните экономию**: совместите депозитный бонус \$100+ с коэффициентом тарифа группы 0.88× — эффективная стоимость опускается ниже 80% от официальной.
5. **Учтите оговорку по web\_search**: отключите `enable_thinking`, если вам нужен встроенный в Moonshot инструмент `$web_search`.

## Часто задаваемые вопросы

<AccordionGroup>
  <Accordion title="Почему мой запрос не использует режим Thinking?">
    Режим Thinking выключен по умолчанию. Убедитесь, что тело запроса включает `"enable_thinking": true`. В OpenAI Python SDK передавайте его внутри `extra_body`; в Node.js SDK его можно передать как поле верхнего уровня.
  </Accordion>

  <Accordion title="APIYI Kimi K2.5 — это та же модель, что и у Moonshot?">
    Да — это та же базовая модель, маршрутизируемая через официальный канал передачи Alibaba Cloud. Единственное отличие в том, что режим Thinking выключен по умолчанию и его нужно явно включить через `enable_thinking`.
  </Accordion>

  <Accordion title="Как работает групповой тариф 0.88×?">
    При создании API token в консоли APIYI назначьте его в группу, которая включает Kimi K2.5 — тарификация автоматически применит коэффициент 0.88×. В сочетании с бонусами за пополнение общая стоимость снижается еще больше. См. [Акции на пополнение](/ru/faq/recharge-promotions).
  </Accordion>

  <Accordion title="Поддерживает ли оно вызов функций / использование tools?">
    Да. Передавайте стандартные определения `tools` в стиле OpenAI. Обратите внимание, что встроенный tool в официальном `$web_search` является взаимоисключающим с режимом Thinking — используйте их в отдельных вызовах.
  </Accordion>

  <Accordion title="Режим Thinking стоит дороже?">
    Трассировки Thinking учитываются как выходные tokens и тарифицируются как обычно. Сложные задачи могут генерировать значительно больше выходных tokens, поэтому включайте режим только тогда, когда вам нужно более глубокое рассуждение.
  </Accordion>
</AccordionGroup>

## Связанные ресурсы

<CardGroup cols={2}>
  <Card title="Руководство по API" icon="book" href="/ru/api-manual">
    Полное руководство по использованию API
  </Card>

  <Card title="Акции на пополнение" icon="gift" href="/ru/faq/recharge-promotions">
    Складывайте бонусы, чтобы еще сильнее снизить цену
  </Card>

  <Card title="Информация о моделях" icon="list" href="/ru/api-capabilities/model-info">
    Просматривайте все доступные модели и группы
  </Card>

  <Card title="Сценарии использования" icon="layers" href="/ru/scenarios">
    Пошаговые руководства по интеграции для клиентов
  </Card>
</CardGroup>
