🚀 核心亮點:grok-4.5 是 xAI 於 2026年7月8日 釋出的最新旗艦(知識截止 2026年2月),主打程式碼與 Agent 任務;grok-4.3 與 grok-4.20 系列提供 100 萬 tokens 上下文;Responses API 的 web_search / x_search / code_interpreter / MCP 四大工具在 API易 實測真實可用,其中 X 搜尋是 Grok 獨有的差異化能力;原生 responses 協議還意味著 Grok 可以直接接入 OpenAI Codex。
模型陣容
grok-4.5
旗艦 · 程式碼與通用xAI 最智慧模型,500K 上下文,為編碼、Agent 任務和知識工作構建。
grok-4.3
標準主力1M 上下文,價格是旗艦的六折出頭,日常對話與中等推理的均衡之選。
grok-4.20 雙變體
推理 / 非推理可選
-reasoning 與 -non-reasoning 同價同上下文(1M),按需選擇是否輸出思維鏈。grok-build-0.1
程式碼專用256K 上下文,全系最低單價,適合高頻程式碼補全與輕量程式設計任務。
grok-4.20-multi-agent-beta-0309
多智慧體協作多個 agent 並行協作解題,適合複雜研究任務。計費特性特殊,詳見 Multi-Agent 模型。
更多能力頁
對話/推理/視覺見 對話與推理;聯網見 聯網搜尋與 X 搜尋。
模型定價
掛牌價與 xAI 官網一致(已於 2026-07-13 經 API易 定價介面逐一核對),API易 的折扣體現在 充值加贈活動 中。實測能力矩陣
以下矩陣來自 2026-07-13 (UTC+8) 在 API易 閘道的實測(✅ 實測通過;— 未覆蓋,同架構預期一致):端點一覽
在 Codex 中直接使用
因為原生支援/v1/responses,Grok 是少數能在 OpenAI Codex(桌面客戶端 / IDE 外掛 / CLI)裡以 responses 原生協議直接使用的非 OpenAI 模型——config.toml 裡 model = "grok-4.5"、wire_api = "responses" 即可,5 分鐘接上,Codex 的工具呼叫、推理條目等 Agent 能力全走原生協議。對比之下,Claude / Gemini 在 API易 上只能走 OpenAI 相容 chat 模式(wire_api = "chat" 兜底),在 Codex / Agent 場景存在協議不相容。完整接入步驟見 Codex 接入教程。
快速開始
計費注意:思維鏈 tokens
grok-4.5 / grok-4.3 / grok-build-0.1 預設帶內部推理:響應中返回 reasoning_content,且推理 tokens 計入輸出計費。實測短問答中可見文本僅 30 tokens、實際計費輸出 586 tokens(含 556 推理 tokens)。對成本敏感的短問答場景,建議改用 grok-4.20-0309-non-reasoning。詳細說明見 對話與推理。
常見問題
Grok 有自己的原生 API 格式嗎?
Grok 有自己的原生 API 格式嗎?
沒有獨立私有協議。xAI 官方 REST API 就是 OpenAI 相容格式:
/v1/chat/completions(對話)+ /v1/responses(Responses API 與 server-side 工具)。在 API易 上用 OpenAI SDK 把 base_url 指向 https://api.apiyi.com/v1 即為全功能呼叫,不存在”相容模式閹割”。聯網搜尋怎麼開?
聯網搜尋怎麼開?
走 Responses API:
tools: [{"type": "web_search"}](或 x_search)。舊版 Chat Completions 的 search_parameters 引數已被 xAI 下線(實測 410),不要再使用。詳見 聯網搜尋與 X 搜尋。模型自我介紹說自己是 Grok 4,是不是模型不對?
模型自我介紹說自己是 Grok 4,是不是模型不對?
正常現象。Grok 4.x 全系的自我認知均為「Grok 4」(multi-agent 模型自稱 Oppie),不會精確報出 4.5 / 4.3 等版本號。驗證模型身份請以請求的
model 欄位和響應 model 欄位為準,而非模型的自我介紹。快取需要配置嗎?
快取需要配置嗎?
不需要。Grok 字首快取自動生效,響應
usage.prompt_tokens_details.cached_tokens 可自查命中量(實測同字首第二次請求命中 2688/2735 tokens)。閘道為號池模式,命中率請做合理預期,詳見 快取計費說明。上下文超限會怎樣?
上下文超限會怎樣?
返回 400 錯誤。注意各檔上限不同:grok-4.5 為 500K,grok-4.3 與 4.20 系列為 1M,grok-build-0.1 為 256K。超長內容建議先做摘要 / 分段 / RAG 檢索。
失敗的請求會扣費嗎?
失敗的請求會扣費嗎?
4xx 類客戶端錯誤(引數錯誤 / 鑑權失敗)不計費;已成功返回 tokens 的請求按實際消耗計費。注意
deferred: true 會被靜默忽略——請求實際同步執行並正常計費。相關文件
對話與推理
流式、思維鏈、結構化輸出、函式呼叫、視覺輸入、快取
聯網搜尋與 X 搜尋
Responses API 的 web_search / x_search 工具實戰
程式碼執行與 MCP
服務端 Python 沙箱與 Remote MCP 工具接入
Multi-Agent 模型
多智慧體協作模型的能力與計費特性
在 Codex 中使用 Grok
原生 responses 協議直連 Codex,5 分鐘接上
Grok 4.5 釋出解讀
xAI 最新旗艦的深度解讀
模型資訊總覽
檢視所有可用模型及分組