Skip to main content

Механизм предварительного списания по запросу

APIYI использует механизм предварительного списания по запросу, при котором ориентировочная плата списывается заранее при отправке запросов. Если текущего баланса недостаточно для обработки запроса, он завершится с ошибкой, даже если на счету есть некоторая сумма.
Пояснение к предварительному списаниюСистема оценивает максимально возможную стоимость этого запроса на основе сложности входного содержимого. Если оценочная стоимость превышает текущий баланс, запрос не может быть выполнен.

Анализ основных причин

1. Превышение token входного содержимого

Изображения
  • Загружены сложные изображения (высокое разрешение, несколько изображений)
  • PDF с большим количеством страниц или сложные документы
  • Большой объем визуального контента, например диаграммы, скриншоты
Текстовое содержимое
  • В стороннем ПО включены плагины веб-поиска
  • Передана вся codebase (несколько каталогов и файлов)
  • Длинные документы или большие объемы кода

2. Превышение лимитов контекста модели

Такой избыточный объем содержимого может привести к:
  • Превышению всего контекста текущей модели (Input + Output в сумме)
  • Превышению вашего текущего баланса APIYI
  • Слишком большой сумме предварительного списания за запрос
Расчет контекстаПредел контекста модели = сумма Input Token + Output TokenПример: если модель поддерживает контекст 128K и ваш input уже использует 100K token, output может содержать не более 28K token.

Решения

1. Проверьте входной контент

Оптимизируйте ввод
  • Сжимайте изображение или уменьшайте его размер
  • Обрабатывайте большие файлы пакетами
  • Отключайте ненужные функции веб-поиска
  • Передавайте только релевантные файлы с кодом, а не весь проект
Сегментация контента
  • Разбивайте длинные документы на несколько частей
  • Загружайте несколько изображений пакетами
  • Обрабатывайте файлы с кодом по одному

2. Проверьте баланс аккаунта

Просмотр баланса
  • Войдите в консоль, чтобы посмотреть текущий баланс
  • Убедитесь, что баланса достаточно для оплаты предполагаемых расходов
  • Рассмотрите возможность пополнения для поддержания достаточного баланса

3. Выберите подходящую модель

Рекомендуемые тестовые модели
  • gpt-4o-mini - Низкая цена, подходит для тестирования
  • gpt-3.5-turbo - Недорогой вариант
  • claude-3-haiku - Быстрая и экономичная модель
Совет по оптимизации затратСначала проверьте входной контент на более дешевых моделях, чтобы убедиться, что он подходит, а затем после подтверждения переходите на более продвинутые модели.

4. Проанализируйте использование Token

Инструменты расчета Token
  • Используйте онлайн-калькуляторы Token, чтобы оценить длину контента
  • Проверяйте статистику использования Token по ответам API
  • Сравнивайте потребление Token для разного контента

Техническая поддержка

Если проблема сохраняется после выполнения указанных выше методов, обратитесь в техническую службу поддержки за помощью:

Корпоративный WeChat

QR-код корпоративного WeChatОтсканируйте QR-код или Нажмите, чтобы связаться со службой поддержкиДля быстрой диагностики предоставьте следующую информацию:
  • Скриншот баланса аккаунта
  • Общее описание входного содержимого
  • Используемое название модели
  • Скриншот сообщения об ошибке

Меры предотвращения

1. Предварительная обработка содержимого

  • Оценивайте сложность содержимого перед отправкой
  • Используйте инструменты сжатия для оптимизации размера файла
  • Извлекайте ключевую информацию, а не весь контент

2. Управление балансом

  • Поддерживайте достаточный баланс аккаунта
  • Настройте напоминания о низком балансе
  • Регулярно просматривайте записи о потреблении

3. Выбор модели

  • Выбирайте подходящую модель в зависимости от сложности задачи
  • Для простых задач используйте экономичные модели
  • Рассматривайте высококлассные модели только для сложных задач

Распространенные сообщения об ошибках

  • Insufficient balance for this request - Недостаточно баланса
  • Input too long - Входной контент слишком длинный
  • Context length exceeded - Превышен лимит контекста
  • Request timeout - Тайм-аут запроса (обычно из-за слишком длинного контента)