Skip to main content
APIYI поддерживает более 400 основных AI models. На этой странице представлена подробная информация о models, pricing и инструкциях по использованию.
Корпоративный профессиональный и стабильный API-хаб для крупных AI models Все models официально получены и перенаправляются, со скидкой примерно 20% на pricing (за счет сочетания бонусов за пополнение и преимуществ обменного курса), объединяя различные отличные large models. Без ограничений скорости, без срока действия, без риска блокировки аккаунта, тарификация по факту использования, долгосрочно надежный сервис.

🔥 Рекомендуемые модели сейчас

Ниже перечислены популярные модели, которые сейчас стабильно доступны. Для полного списка моделей и актуальных цен посетите Страницу цен консоли APIYI.
Рекомендации по обновлению модели: Мы рекомендуем использовать последние модели для наилучшей производительности, но обратите внимание:
  1. Начальная нестабильность — это нормально: У только что выпущенных моделей могут наблюдаться медленные ответы, тайм-ауты или периодические ошибки из-за ограниченной вычислительной мощности у поставщика — обычно это стабилизируется в течение нескольких дней или недель
  2. Проверьте совместимость параметров: Новые модели могут добавлять или изменять параметры (например, max_completion_tokens заменяет max_tokens). Перед обновлением убедитесь, что параметры вашего API по-прежнему совместимы со старыми моделями
  3. Всегда тестируйте перед запуском в рабочую среду: Перед развертыванием новой модели в production тщательно проверьте ее в тестовой среде, чтобы убедиться, что качество вывода и совместимость API соответствуют ожиданиям

Категории моделей

🤖 Серия OpenAI

🆕 Новейшие модели

Примечания по использованию серии GPT Pro (например, gpt-5.5-pro, gpt-5-pro):
  1. Только /v1/responses эндпоинт: нельзя использовать /v1/chat/completions — переключите ваш SDK / код на Responses API перед вызовом
  2. Очень дорого: один вызов может стоить несколько долларов, и доступ открыт только для группы SVIP, чтобы предотвратить случайное использование в группе Default
  3. Не рекомендуется для непрофессиональных задач: используйте GPT-5.5 / GPT-5.4 для повседневных задач; Pro подходит только для исследований и работ высшего уровня, требующих экстремальной глубины рассуждения

✅ Стабильные / классические

Примечания по использованию серии GPT-5:
  1. Параметр temperature temperature должен быть установлен в 1 (поддерживается только 1)
  2. Используйте max_completion_tokens вместо max_tokens
  3. Не передавайте параметр top_p
Модели генерации изображений и видео перенесены на отдельную страницу. Посетите Модели генерации изображений и видео, чтобы получить полный список и цены.

🎭 Серия Claude (Anthropic)

🆕 Последние модели

✅ Стабильные / классические

Последние: Claude Opus 4.7 улучшает кодовые бенчмарки на 13% по сравнению с 4.6, сокращает ошибки вызова tools до 1/3 и добавляет новый уровень рассуждения xhigh по той же цене, что и 4.6. Sonnet 4.6 не уступает Opus 4.5 и теперь используется по умолчанию на claude.ai. Стабильные: Opus 4.5 и Sonnet 4.5 проверены в бою для production. Haiku 4.5 предлагает скорость в 2 раза выше и отличное соотношение цены и качества.

🌟 Серия Google Gemini

🆕 Последние модели

Примечание: Gemini 3 Pro Preview был прекращен 9 марта 2026 года. Пожалуйста, перейдите на Gemini 3.1 Pro Preview.

✅ Стабильные / классические

Последнее: Gemini 3.5 Flash полностью превосходит Gemini 3.1 Pro по Terminal-Bench 2.1, MCP Atlas и другим показателям, при примерно в 4 раза большей скорости и примерно вдвое меньшей цене — сегодняшний король соотношения цена/производительность. Gemini 3.1 Pro Preview удваивает рассуждение (ARC-AGI-2 77.1%), самое продвинутое у Google. Gemini 3.1 Flash Lite теперь GA, самый дешевый frontier-модель для высокой параллельности. Стабильные: Gemini 2.5 Pro (контекст 2M) и Gemini 2.5 Flash находятся в GA, идеальны для production.

🚀 xAI Grok Серия

🆕 Актуальные модели

✅ Стабильные / Классические

🔍 Серия DeepSeek

🆕 Новейшие модели

✅ Стабильные / классические

🐘 Серия китайских моделей

Zhipu AI (GLM)

🆕 Последняя: GLM-5.1 | ✅ Стабильная / классическая: GLM-5, GLM-4.6
Возможности GLM-5.1:
  • 744B MoE параметров, поддерживает долгосрочные агентные задачи продолжительностью до 8 часов
  • SWE-Bench Pro 58.4, сильнейший уровень кодирования среди моделей с открытым исходным кодом
  • Open-source с лицензией MIT, отличное соотношение цены и качества

Alibaba Qwen

🆕 Последняя: Qwen3.7-Max | ✅ Стабильная / классическая: Qwen Max, Plus, Turbo

Серия Moonshot Kimi

🆕 Последняя: Kimi K2.6 | ✅ Стабильная / классическая: Kimi K2.5, K2

🌐 Серия MiniMax

🆕 Новейшая: MiniMax M2.7 | ✅ Стабильная / Классическая: MiniMax M2.5
Особенности MiniMax M2.7:
  • Достигает SWE-bench Pro 56.22% всего при 10B параметрах, самая маленькая модель Tier-1
  • Саморазвивающаяся; стандартный $0.3 / высокоскоростной (MiniMax-M2.7-highspeed) $0.6 за 1M входных tokens
  • Открытые веса модели

💰 Информация о тарификации

Способы тарификации

  • Pay-as-you-go: списание на основе фактического использования Token
  • Без минимальной платы: платите только за то, чем пользуетесь, баланс не сгорает
  • Списания в реальном времени: сборы списываются с баланса сразу после каждого вызова

Преимущества тарификации

  • Официальный релей с небольшими ценовыми преимуществами
  • Крупные пользователи могут обратиться в службу поддержки за более выгодной тарификацией
  • Новые пользователи получают 3 million tokens тестового кредита при регистрации

Просмотр тарификации в реальном времени

Посетите страницу тарификации в консоли APIYI, чтобы посмотреть актуальные цены для всех моделей.

🛠️ Рекомендации по использованию

Руководство по выбору модели

Разработка программного обеспечения
  • Максимальная производительность: Claude Opus 4.7 (+13% в кодировании по сравнению с 4.6), GPT-5.5 (SWE-bench 88.7%), Claude Sonnet 4.6 (сопоставим с Opus 4.5)
  • Высокое соотношение цены и качества: Gemini 3.5 Flash (превосходит 3.1 Pro примерно вдвое дешевле), GLM-5.1 (SWE-Bench Pro 58.4), Kimi K2.6, DeepSeek V4 Flash
  • Альтернативы: DeepSeek V4 Pro, Qwen3.7-Max, MiniMax M2.7, o4-mini
Создание текста
  • Лучший выбор: GPT-5.5, GPT-5.4, Gemini 3.1 Pro Preview, Claude Opus 4.7, Claude Sonnet 4.6
  • Альтернативы: chat-latest, Claude Sonnet 4.5, GPT-4.1, GPT-4o, Claude Haiku 4.5, GLM-4.6
Быстрый ответ
  • Лучший выбор: Gemini 3.5 Flash (~4x быстрее), Claude Haiku 4.5 (в 2 раза быстрее), GPT-4o Mini
  • Альтернативы: Gemini 3.1 Flash Lite, Gemini 2.5 Flash, Grok 4 Fast, GPT-4.1 Mini
Генерация изображений
  • Последняя рекомендация: GPT Image 1.5 (ускорение в 4 раза, точное редактирование, от $0.01)
  • Профессиональный дизайн: SeeDream 4.5 (1.2B параметров, качество 4K, $0.035/image), Nano Banana Pro (4K HD, лучшее отображение текста)
  • Высокое соотношение цены и качества: Nano Banana ($0.025/image), SeeDream 4.0 ($0.025/image)
  • Реверс-инжиниринг, самый дешевый: sora_image, gpt-4o-image
Обработка длинного текста
  • Лучший выбор: Gemini 2.5 Pro (контекстное окно 2M)
  • Альтернативы: серия Claude 4 (контекстное окно 200K)

Рекомендации по оптимизации затрат

  1. Многоуровневое использование: Используйте более дешевые модели для простых задач, а продвинутые — для сложных
  2. Оптимизация тестирования: Сначала тестируйте на малых моделях, используйте большие после определения потребностей
  3. Пакетная обработка: Выбирайте версии Nano или Mini для больших объемов похожих задач
  4. Повторное использование кэша: Кэшируйте результаты повторяющихся запросов

🔗 Связанные ресурсы

Список моделей постоянно обновляется. Мы оперативно добавим новые выпущенные качественные модели. Если вам нужны определенные модели или массовые требования, пожалуйста, обратитесь в службу поддержки.