> ## Documentation Index
> Fetch the complete documentation index at: https://docs.apiyi.com/llms.txt
> Use this file to discover all available pages before exploring further.

# Почему я не могу отправлять запросы при оставшемся балансе?

> Руководство по устранению неполадок при недостаточном балансе APIYI, понимание механизма предварительного списания для запросов и решений по длине token

## Механизм предварительного списания по запросу

APIYI использует механизм **предварительного списания по запросу**, при котором ориентировочная плата списывается заранее при отправке запросов. Если текущего баланса недостаточно для обработки запроса, он завершится с ошибкой, даже если на счету есть некоторая сумма.

<Warning>
  **Пояснение к предварительному списанию**

  Система оценивает максимально возможную стоимость этого запроса на основе сложности входного содержимого. Если оценочная стоимость превышает текущий баланс, запрос не может быть выполнен.
</Warning>

## Анализ основных причин

### 1. Превышение token входного содержимого

**Изображения**

* Загружены сложные изображения (высокое разрешение, несколько изображений)
* PDF с большим количеством страниц или сложные документы
* Большой объем визуального контента, например диаграммы, скриншоты

**Текстовое содержимое**

* В стороннем ПО включены плагины веб-поиска
* Передана вся codebase (несколько каталогов и файлов)
* Длинные документы или большие объемы кода

### 2. Превышение лимитов контекста модели

Такой избыточный объем содержимого может привести к:

* **Превышению всего контекста текущей модели** (Input + Output в сумме)
* **Превышению вашего текущего баланса APIYI**
* **Слишком большой сумме предварительного списания за запрос**

<Info>
  **Расчет контекста**

  Предел контекста модели = сумма Input Token + Output Token

  Пример: если модель поддерживает контекст 128K и ваш input уже использует 100K token, output может содержать не более 28K token.
</Info>

## Решения

### 1. Проверьте входной контент

**Оптимизируйте ввод**

* Сжимайте изображение или уменьшайте его размер
* Обрабатывайте большие файлы пакетами
* Отключайте ненужные функции веб-поиска
* Передавайте только релевантные файлы с кодом, а не весь проект

**Сегментация контента**

* Разбивайте длинные документы на несколько частей
* Загружайте несколько изображений пакетами
* Обрабатывайте файлы с кодом по одному

### 2. Проверьте баланс аккаунта

**Просмотр баланса**

* Войдите в консоль, чтобы посмотреть текущий баланс
* Убедитесь, что баланса достаточно для оплаты предполагаемых расходов
* Рассмотрите возможность пополнения для поддержания достаточного баланса

### 3. Выберите подходящую модель

**Рекомендуемые тестовые модели**

* `gpt-4o-mini` - Низкая цена, подходит для тестирования
* `gpt-3.5-turbo` - Недорогой вариант
* `claude-3-haiku` - Быстрая и экономичная модель

<Tip>
  **Совет по оптимизации затрат**

  Сначала проверьте входной контент на более дешевых моделях, чтобы убедиться, что он подходит, а затем после подтверждения переходите на более продвинутые модели.
</Tip>

### 4. Проанализируйте использование Token

**Инструменты расчета Token**

* Используйте онлайн-калькуляторы Token, чтобы оценить длину контента
* Проверяйте статистику использования Token по ответам API
* Сравнивайте потребление Token для разного контента

## Техническая поддержка

Если проблема сохраняется после выполнения указанных выше методов, обратитесь в техническую службу поддержки за помощью:

<Card title="Корпоративный WeChat" icon="headphones" href="https://work.weixin.qq.com/kfid/kfc9adfd5810ece25ec">
  <img src="https://mintcdn.com/apiyillc/fpi567ydpk7adDt0/images/wecom-qrcode.png?fit=max&auto=format&n=fpi567ydpk7adDt0&q=85&s=7286b96e94110e3a48798b649df1b45b" alt="QR-код корпоративного WeChat" style={{maxWidth: "180px"}} width="400" height="400" data-path="images/wecom-qrcode.png" />

  Отсканируйте QR-код или [Нажмите, чтобы связаться со службой поддержки](https://work.weixin.qq.com/kfid/kfc9adfd5810ece25ec)

  Для быстрой диагностики предоставьте следующую информацию:

  * Скриншот баланса аккаунта
  * Общее описание входного содержимого
  * Используемое название модели
  * Скриншот сообщения об ошибке
</Card>

## Меры предотвращения

### 1. Предварительная обработка содержимого

* Оценивайте сложность содержимого перед отправкой
* Используйте инструменты сжатия для оптимизации размера файла
* Извлекайте ключевую информацию, а не весь контент

### 2. Управление балансом

* Поддерживайте достаточный баланс аккаунта
* Настройте напоминания о низком балансе
* Регулярно просматривайте записи о потреблении

### 3. Выбор модели

* Выбирайте подходящую модель в зависимости от сложности задачи
* Для простых задач используйте экономичные модели
* Рассматривайте высококлассные модели только для сложных задач

## Распространенные сообщения об ошибках

* `Insufficient balance for this request` - Недостаточно баланса
* `Input too long` - Входной контент слишком длинный
* `Context length exceeded` - Превышен лимит контекста
* `Request timeout` - Тайм-аут запроса (обычно из-за слишком длинного контента)
