Skip to main content
Grok 是 xAI 推出的旗艦大模型家族。當前一代(Grok 4.x)覆蓋旗艦通用、長上下文標準檔、推理/非推理雙變體、程式碼專用與多智慧體協作五條產品線,全部已上架 API易。xAI 官方 API 本身就是 OpenAI 相容格式(Chat Completions + Responses API),沒有獨立的私有協議——因此在 API易 上用 OpenAI SDK 即可呼叫全部能力,包括官方的 server-side 工具(聯網搜尋、X 搜尋、程式碼執行、Remote MCP)。 本組文件基於 2026年7月13日 (UTC+8) 在 API易 閘道上的全量實測(56 組請求/響應日誌)編寫,能力邊界均有實測依據。
🚀 核心亮點:grok-4.5 是 xAI 於 2026年7月8日 釋出的最新旗艦(知識截止 2026年2月),主打程式碼與 Agent 任務;grok-4.3 與 grok-4.20 系列提供 100 萬 tokens 上下文;Responses API 的 web_search / x_search / code_interpreter / MCP 四大工具在 API易 實測真實可用,其中 X 搜尋是 Grok 獨有的差異化能力;原生 responses 協議還意味著 Grok 可以直接接入 OpenAI Codex

模型陣容

grok-4.5

旗艦 · 程式碼與通用xAI 最智慧模型,500K 上下文,為編碼、Agent 任務和知識工作構建。

grok-4.3

標準主力1M 上下文,價格是旗艦的六折出頭,日常對話與中等推理的均衡之選。

grok-4.20 雙變體

推理 / 非推理可選-reasoning-non-reasoning 同價同上下文(1M),按需選擇是否輸出思維鏈。

grok-build-0.1

程式碼專用256K 上下文,全系最低單價,適合高頻程式碼補全與輕量程式設計任務。

grok-4.20-multi-agent-beta-0309

多智慧體協作多個 agent 並行協作解題,適合複雜研究任務。計費特性特殊,詳見 Multi-Agent 模型

更多能力頁

對話/推理/視覺見 對話與推理;聯網見 聯網搜尋與 X 搜尋

模型定價

掛牌價與 xAI 官網一致(已於 2026-07-13 經 API易 定價介面逐一核對),API易 的折扣體現在 充值加贈活動 中。
  • 別名 grok-code-fast / grok-code-fast-1 亦可呼叫(實測連通),定價以 模型價格頁 為準。
  • 快取命中的輸入 tokens 享受折扣價,Grok 字首快取自動生效、無需配置,詳見 快取計費說明
  • 掛牌價持平官網,疊加 充值加贈 後實際成本更低。

實測能力矩陣

以下矩陣來自 2026-07-13 (UTC+8) 在 API易 閘道的實測(✅ 實測通過;— 未覆蓋,同架構預期一致):

端點一覽

在 Codex 中直接使用

因為原生支援 /v1/responses,Grok 是少數能在 OpenAI Codex(桌面客戶端 / IDE 外掛 / CLI)裡以 responses 原生協議直接使用的非 OpenAI 模型——config.tomlmodel = "grok-4.5"wire_api = "responses" 即可,5 分鐘接上,Codex 的工具呼叫、推理條目等 Agent 能力全走原生協議。對比之下,Claude / Gemini 在 API易 上只能走 OpenAI 相容 chat 模式(wire_api = "chat" 兜底),在 Codex / Agent 場景存在協議不相容。完整接入步驟見 Codex 接入教程
以下能力在 API易 上不支援(實測確認,避免踩坑):
  • Legacy Completions(/v1/completions:上游拒絕——Grok 4.x 全係為推理架構,官方層面即不支援文本補全模式
  • 聯網舊入口 search_parameters:已被 xAI 下線(實測返回 410),聯網一律走 Responses API 工具,見 聯網搜尋
  • Batch API / Files 檔案能力:閘道不路由,號池模式不適用
  • Deferred Completions(deferred: true:引數會被靜默忽略,請求按同步執行並正常計費,請勿依賴
  • Collections Search(RAG / file_search):需在 xAI 控制台預建知識庫,號池模式不適用
  • Context Compaction(/v1/responses/compactPriority Processing(service_tier: "priority",實測回落 default)WebSocket 模式mTLS 認證:均不支援

快速開始

模型怎麼選:預設用 grok-4.3(1M 上下文、價格均衡);程式碼 Agent / 複雜任務升級 grok-4.5;追求快答低成本用 grok-4.20-0309-non-reasoning(無思維鏈、輸出 tokens 最省);高頻程式碼補全用 grok-build-0.1;複雜研究類任務才考慮 multi-agent 模型(注意其計費放大特性)。

計費注意:思維鏈 tokens

grok-4.5 / grok-4.3 / grok-build-0.1 預設帶內部推理:響應中返回 reasoning_content,且推理 tokens 計入輸出計費。實測短問答中可見文本僅 30 tokens、實際計費輸出 586 tokens(含 556 推理 tokens)。對成本敏感的短問答場景,建議改用 grok-4.20-0309-non-reasoning。詳細說明見 對話與推理

常見問題

沒有獨立私有協議。xAI 官方 REST API 就是 OpenAI 相容格式:/v1/chat/completions(對話)+ /v1/responses(Responses API 與 server-side 工具)。在 API易 上用 OpenAI SDK 把 base_url 指向 https://api.apiyi.com/v1 即為全功能呼叫,不存在”相容模式閹割”。
走 Responses API:tools: [{"type": "web_search"}](或 x_search)。舊版 Chat Completions 的 search_parameters 引數已被 xAI 下線(實測 410),不要再使用。詳見 聯網搜尋與 X 搜尋
正常現象。Grok 4.x 全系的自我認知均為「Grok 4」(multi-agent 模型自稱 Oppie),不會精確報出 4.5 / 4.3 等版本號。驗證模型身份請以請求的 model 欄位和響應 model 欄位為準,而非模型的自我介紹。
不需要。Grok 字首快取自動生效,響應 usage.prompt_tokens_details.cached_tokens 可自查命中量(實測同字首第二次請求命中 2688/2735 tokens)。閘道為號池模式,命中率請做合理預期,詳見 快取計費說明
返回 400 錯誤。注意各檔上限不同:grok-4.5 為 500K,grok-4.3 與 4.20 系列為 1M,grok-build-0.1 為 256K。超長內容建議先做摘要 / 分段 / RAG 檢索。
4xx 類客戶端錯誤(引數錯誤 / 鑑權失敗)不計費;已成功返回 tokens 的請求按實際消耗計費。注意 deferred: true 會被靜默忽略——請求實際同步執行並正常計費。

相關文件

對話與推理

流式、思維鏈、結構化輸出、函式呼叫、視覺輸入、快取

聯網搜尋與 X 搜尋

Responses API 的 web_search / x_search 工具實戰

程式碼執行與 MCP

服務端 Python 沙箱與 Remote MCP 工具接入

Multi-Agent 模型

多智慧體協作模型的能力與計費特性

在 Codex 中使用 Grok

原生 responses 協議直連 Codex,5 分鐘接上

Grok 4.5 釋出解讀

xAI 最新旗艦的深度解讀

模型資訊總覽

檢視所有可用模型及分組