Skip to main content
На этой странице показано, как использовать веб-поиск Grok и поиск в X (Twitter) на APIYI; проверено на практике 13 июля 2026 (UTC+8).

Кратко

APIYI полностью поддерживает официальные серверные инструменты поиска Grok: используйте Responses API (/v1/responses) с инструментами web_search / x_search. grok-4.5 достоверно выполняет реальные поиски и возвращает цитируемые актуальные результаты. Ключ группы по умолчанию работает сразу из коробки.
Устаревшая точка входа удалена: поле search_parameters в Chat Completions (старый Live Search) было удалено xAI — при проверке возвращается 410. Перенесите существующий код на формат tools в Responses API.

Проверенные результаты (2026-07-13)

Поиск по X — ключевое отличие Grok: он ищет посты в реальном времени, активность аккаунтов и обсуждения тем в X (Twitter) — источник, который не охватывает ни один другой инструмент поиска вендоров. Отлично подходит для мониторинга соцсетей, отслеживания трендов и анализа KOL. Учтите, что x_search выполняет много раундов поиска и заметно медленнее (измерено ~45 с); установите тайм-ауты клиента на 120 с или больше.

Быстрый старт

cURL

Python (OpenAI SDK)

Пример поиска в X

Структура ответа

Массив output содержит в порядке выполнения: usage.server_side_tool_usage_details сообщает количество вызовов по каждому инструменту (web_search_calls / x_search_calls / code_interpreter_calls / mcp_calls и т. д.) — это стоит логировать у себя для сверки затрат.

Тарификация

У Q&A с live-search есть две составляющие стоимости:
x_search выполняет много раундов (24 поиска в одном измеренном Q&A), что приводит к более высокой инъекции tokens и задержке по сравнению с web_search — оценивайте стоимость с учетом ожидаемого объема запросов. И количество поисков, и cached_tokens можно самостоятельно проверить в использовании ответа.

Примечания

  1. Только Responses API: search_parameters в Chat Completions больше нет (410) — не используйте его.
  2. Ожидаемая задержка: ~12 s для web_search, ~45 s для x_search (измерено; зависит от сложности задачи). Установите тайм-ауты клиента ≥ 120 s.
  3. Контроль затрат: ограничьте поведение поиска в prompt (например, «ищите не более 2 раз») и следите за server_side_tool_usage_details.
  4. Проверьте, что реальный поиск был выполнен: проверьте массив output на наличие элементов web_search_call (или эквивалентных) — ответ с текстом, но без элементов поиска, был получен из обучающих данных, а не из web.

Связанные документы

Обзор Grok

Линейка моделей, тарификация и матрица возможностей

Выполнение кода и MCP

Два других серверных инструмента в Responses API

Тарификация кэша

Крупные вставки input-token из поиска хорошо сочетаются с автоматическим кэшированием

Веб-поиск OpenAI

Использование веб-поиска для серии GPT, для сравнения