Skip to main content

В одном предложении

Группа — это «канал вызова», который вы выбираете на token. Она определяет доступные модели, коэффициент тарифа и маршрутизацию upstream. С точки зрения пользователя это ощущается как «своя группа», но для каждого отдельного вызова фактически действует группа, выбранная на token.

Представление пользователя vs представление платформы

Представление пользователя

Группа — это канал, который я выбираю при создании или редактировании token. Он определяет, к каким моделям этот token может обращаться, какой коэффициент тарифа применяется и через какую upstream-линия он идет.

Представление платформы

Группы — это инструмент для управления ресурсами и предоставления функций — объединение похожих моделей, выделенной мощности и целевых скидок в один канал, чтобы тарификация оставалась точной, а цены можно было дифференцировать.

«Группа пользователя» ≠ «Группа token» — не путайте их

Типичная первая реакция: «Есть ли в моей учетной записи группа, которую мне нужно где-то переключить?»
  • На уровне учетной записи действительно есть понятие «группа пользователя», которое определяет базовую область разрешений (появляются ли модели SVIP, разблокированы ли резервные группы enterprise и т. д.)
  • Но маршрутизация каждого API-вызова, коэффициент тарифа и доступность моделей определяются группой, выбранной для token.
При устранении неполадок сначала проверьте настройки token «Выбор группы» и «Резервная группа» — не ищите «группу моей учетной записи». См. Токены и группы.

Случай 1: Почему существует группа ClaudeCode?

Назначение: Объединить модели, которые поддерживают нативный для Anthropic формат вызова /v1/messages, в один канал, чтобы вы могли использовать отечественные кодовые модели в Claude Code, Cherry Studio и других клиентах с нативной для Anthropic поддержкой точно так же, как при вызове Claude — без изменений кода. Включенные модели:
  • Полная линейка Claude (официальный транзит / AWS Claude)
  • Отечественные модели, совместимые с /v1/messages, например qwen3.x-max, glm-5.x, deepseek-v4
Скидка:
  • По умолчанию скидка 5% (95 折) — ничего делать не нужно
  • Суммируется с бонусом за пополнение (10%–20%), поэтому фактическая стоимость получается примерно на 20% ниже, чем при прямой официальной покупке
Как использовать:
  1. Откройте https://api.apiyi.com/token и создайте или отредактируйте token
  2. Установите для поля «Выбор группы» значение ClaudeCode
  3. Вызывайте из своего клиента в формате Anthropic-native

Случай 2: зачем видеомоделям нужна отдельная группа?

Видеомодели используют правила тарификации (за секунду, за изображение, за длительность), которые полностью отличаются от текстовых моделей, а их upstream-каналы независимы. Группы позволяют точно применять особые правила тарификации:
Неправильная группа обычно означает: модель недоступна (404), неверная тарификация или запрос сразу отклоняется. Убедитесь, что token в «Выбор группы» или «Резервная группа» включает группу, соответствующую нужной вам модели.

Случай 3: «Current group’s upstream is saturated» — это ограничение для меня?

Это частый вопрос в многопользовательских SaaS-сценариях. Он взят из реального обращения в поддержку. Сценарий:
  • Разработчик: Мой инструмент работает в стиле SaaS, и многие пользователи вызывают его параллельно. Когда трафик растет, я получаю:
    error 429 (content-type-not-allowed): Current group’s upstream is saturated, please try again later
  • Я предположил, что платформа ограничивает мои параллельные запросы — нужно ли мне где-то «настроить группу», чтобы обойти это?
На самом деле:
  • Это ошибка не является ограничением на уровне аккаунта по параллельным запросам
  • Она означает: upstream-канал, сопоставленный с этой моделью в этой группе, сейчас занят
  • Типичный триггер: использование модели, которая на стороне вендора все еще находится в preview (версии с названиями вроде *-preview-*), и ее официальная пропускная способность сама по себе колеблется
Что делать правильно:
1

Ослабьте тайм-ауты и повторные попытки на стороне клиента

Увеличьте тайм-ауты (например, до 60–120 с) и замените немедленные повторные попытки на экспоненциальный backoff. Не наращивайте параллельные повторные попытки в момент возникновения ошибки.
2

Добавьте резервную группу для востребованных моделей

Для token добавьте 1–2 резервные группы, соответствующие целевой модели. Когда основная перегружена, трафик переключается на резервный канал, и процент успешных запросов растет.
3

Оцените модели для нагрузок с высокой параллельностью запросов

Если ваш бизнес чувствителен к задержке или стабильности, объективно оцените более стабильные варианты в пределах той же линейки моделей в своем сценарии (у большинства вендоров есть более легкие и более распределенные родственные версии). Ваш бизнес сам выбирает компромисс.
Мы не вводим ограничение по параллельным запросам для клиентских вызовов. Этот 429 приходит от upstream-канала — это не лимит на уровне тарификации. Повторные попытки обычно помогают.

Как выбрать группу — быстрое решение

О коэффициенте группы

«Коэффициент группы», отображаемый в консоли, — это относительное значение, указанное в RMB, а не прямой коэффициент скидки в USD — 0.14x НЕ означает «скидку 86%». Обычно не нужно вникать в это; просто выберите группу, которая соответствует вашей модели. Чтобы понять коэффициенты и преобразование цен, см. Что такое коэффициент модели?.

Связанные документы

Tokens & группы

Роли token, создание/редактирование, просмотр примеров кода, обзор группы.

Режимы тарификации token

Различия между режимами оплаты по использованию и оплаты за вызов.

Множитель модели

Значение множителя, единица тарификации в RMB и конвертация цены в USD.

Доступность модели

Уровни модели и доступ по группе пользователей.