Кратко
APIYI полностью поддерживает официальные серверные инструменты поиска Grok: используйте Responses API (/v1/responses) с инструментами web_search / x_search. grok-4.5 достоверно выполняет реальные поиски и возвращает цитируемые актуальные результаты. Ключ группы по умолчанию работает сразу из коробки.
Проверенные результаты (2026-07-13)
Быстрый старт
cURL
Python (OpenAI SDK)
Пример поиска в X
Структура ответа
Массивoutput содержит в порядке выполнения:
usage.server_side_tool_usage_details сообщает количество вызовов по каждому инструменту (web_search_calls / x_search_calls / code_interpreter_calls / mcp_calls и т. д.) — это стоит логировать у себя для сверки затрат.
Тарификация
У Q&A с live-search есть две составляющие стоимости:x_search выполняет много раундов (24 поиска в одном измеренном Q&A), что приводит к более высокой инъекции tokens и задержке по сравнению с web_search — оценивайте стоимость с учетом ожидаемого объема запросов. И количество поисков, и
cached_tokens можно самостоятельно проверить в использовании ответа.Примечания
- Только Responses API:
search_parametersв Chat Completions больше нет (410) — не используйте его. - Ожидаемая задержка: ~12 s для web_search, ~45 s для x_search (измерено; зависит от сложности задачи). Установите тайм-ауты клиента ≥ 120 s.
- Контроль затрат: ограничьте поведение поиска в prompt (например, «ищите не более 2 раз») и следите за
server_side_tool_usage_details. - Проверьте, что реальный поиск был выполнен: проверьте массив
outputна наличие элементовweb_search_call(или эквивалентных) — ответ с текстом, но без элементов поиска, был получен из обучающих данных, а не из web.
Связанные документы
Обзор Grok
Линейка моделей, тарификация и матрица возможностей
Выполнение кода и MCP
Два других серверных инструмента в Responses API
Тарификация кэша
Крупные вставки input-token из поиска хорошо сочетаются с автоматическим кэшированием
Веб-поиск OpenAI
Использование веб-поиска для серии GPT, для сравнения