TL;DR
APIYI는 Grok의 공식 서버 측 검색 도구를 완벽히 지원합니다: Responses API (/v1/responses)와 web_search / x_search 도구를 사용합니다. grok-4.5는 실제 검색을 검증 가능하게 수행하고, 출처가 표시된 최신 결과를 반환합니다. 기본 그룹 키는 바로 사용할 수 있습니다.
검증된 결과 (2026-07-13)
빠른 시작
cURL
Python (OpenAI SDK)
X 검색 예제
응답 구조
output 배열에는 실행 순서대로 다음이 포함됩니다:
usage.server_side_tool_usage_details는 도구별 호출 횟수(web_search_calls / x_search_calls / code_interpreter_calls / mcp_calls 등)를 보고합니다 — 비용 정산을 위해 귀하 쪽에서 기록해 둘 만합니다.
과금
실시간 검색 Q&A에는 두 가지 비용 구성 요소가 있습니다:x_search는 여러 라운드를 실행합니다(측정된 Q&A 1회에서 24회 검색), 따라서 web_search보다 token 주입과 지연 시간이 더 큽니다 — 예상 쿼리 볼륨을 기준으로 비용을 추정하십시오. 검색 횟수와
cached_tokens는 응답 사용량에서 자체 검증 가능합니다.Notes
- Responses API만: Chat Completions의
search_parameters는 더 이상 없습니다(410) — 사용하지 마십시오. - 지연 시간 예상: web_search는 약 12초, x_search는 약 45초입니다(측정값이며 작업 복잡도에 따라 달라집니다). 클라이언트 타임아웃은 120초 이상으로 설정하십시오.
- 비용 제어: 프롬프트에서 검색 동작을 제한하고(예: “최대 2회만 검색”),
server_side_tool_usage_details를 모니터링하십시오. - 실제 검색 수행 여부 확인:
output배열에서web_search_call(또는 이에 상응하는) 항목을 확인하십시오 — 본문 텍스트는 있지만 검색 항목이 없는 답변은 웹이 아니라 학습 데이터에서 온 것입니다.
관련 문서
Grok 개요
모델 라인업, 가격, 및 기능 매트릭스
코드 실행 & MCP
Responses API의 나머지 두 서버 측 도구
캐시 과금
검색에서 오는 대규모 입력 token 주입은 자동 캐싱과 잘 맞습니다
OpenAI 웹 검색
비교용으로 GPT 시리즈의 웹 검색 사용