Skip to main content
grok-4.20-multi-agent-beta-0309 — это модель совместной работы нескольких агентов от xAI: один запрос запускает несколько агентов, работающих параллельно внутри системы (модель называет себя Oppie, «руководитель команды ИИ для совместной работы»), а ведущий агент синтезирует итоговый ответ. Она подходит для сложных исследований и сравнительного анализа с разных точек зрения. Доступна в APIYI в стандартном формате, совместимом с OpenAI.

Профиль тарификации (Прочитайте сначала)

Весь внутренний трафик агентов попадает в ваш счет. Это главное отличие от обычных моделей:
  • Измеренный обычный prompt примерно на 40 tokens фактически тарифицируется как 39,263 prompt tokens + 9,997 completion tokens (включая все внутренние межагентные round-trip)
  • Даже самый простой однофразовый запрос несет фиксированные накладные расходы примерно в 3,900 prompt tokens
  • Цена за единицу соответствует grok-4.3 ($1.25 / $2.50 за 1M tokens), но один запрос может стоить в десятки раз дороже, чем у обычной модели
Не используйте эту модель для простых задач — для обычных Q&A используйте grok-4.3 или grok-4.20-0309-reasoning.
Хорошая новость: внутренний трафик дает высокие показатели попадания в кэш (26.8K из измеренных 39K prompt tokens попали по сниженной ставке кэша), поэтому реальная стоимость ниже наивного пересчета по количеству tokens — но все равно значительно выше, чем у обычных моделей.

Как вызвать

Аналогично любой другой модели — отличается только поле model:
Многоагентная оркестрация выполняется полностью на стороне сервера — без дополнительных параметров. Streaming и структурированные выходные данные (json_schema) тоже проверены и работают.

Измеренные характеристики (2026-07-13)

Когда использовать

Подходит хорошо

Многоугольный глубокий сравнительный анализ, сложные исследовательские вопросы, открытые задачи, где полезно несколько линий рассуждения, взаимно проверяющих друг друга — параллельное исследование агентами заметно повышает полноту ответа.

Подходит плохо

Повседневные вопросы и ответы, перевод, краткое изложение, завершение кода — задачи с одним сценарием, где качество результата близко к обычным моделям, но стоимость возрастает в десятки раз. Используйте grok-4.3 / grok-4.5 для таких задач.
Перед запуском сравните качество результатов между grok-4.20-0309-reasoning и многоагентной моделью на нескольких реальных задачах, затем решите, оправдывает ли разница в качестве кратное увеличение тарификации — для большинства сценариев варианта с рассуждением достаточно.

Часто задаваемые вопросы

Это встроенная персона модели (роль лидера мультиагентной команды) — совершенно нормально. Проверьте идентичность модели по полю model в вашем запросе и ответе.
Нет. Мультиагентная оркестрация происходит на серверах xAI, и параметры управления не предоставляются.
Устанавливайте его с запасом (например, 8192) — внутреннее рассуждение модели потребляет много token, и небольшой лимит легко обрезает итоговый ответ.

Связанная документация

Обзор Grok

Полная линейка моделей и цены

Chat & Рассуждение

Цепочка рассуждений и тарификация для обычных моделей