🚀 核心亮點:
grok-4.6 是 xAI 於 2026年8月7日 釋出的最新旗艦,沿用 grok-4.5 的 1.5T 引數 V9 基座、提升全部來自後訓練,掛牌價與 grok-4.5 完全相同;grok-4.3 與 grok-4.20 系列提供 100 萬 tokens 上下文;Responses API 的 web_search / x_search / code_interpreter / MCP 四大工具在 API易 實測真實可用,其中 X 搜尋是 Grok 獨有的差異化能力;原生 responses 協議還意味著 Grok 可以直接接入 OpenAI Codex。全系可走 GrokOfficial 分組享 0.8x 倍率(8 折),詳見下方「分組與折扣」。模型陣容
grok-4.6
最新旗艦 · 程式碼與 Agent2026/8/7 釋出,500K 上下文。與 grok-4.5 同基座同價,長週期任務的自檢與驗證更強。
grok-4.5
上一代旗艦 · 同價500K 上下文,與 grok-4.6 掛牌同價,存量業務可繼續使用。
grok-4.3
標準主力1M 上下文,價格是旗艦的六折出頭,日常對話與中等推理的均衡之選。
grok-4.20 雙變體
推理 / 非推理可選
-reasoning 與 -non-reasoning 同價同上下文(1M),按需選擇是否輸出思維鏈。grok-build-0.1
程式碼專用256K 上下文,全系最低單價,適合高頻程式碼補全與輕量程式設計任務。
grok-4.20-multi-agent-beta-0309
多智慧體協作多個 agent 並行協作解題,適合複雜研究任務。計費特性特殊,詳見 Multi-Agent 模型。
更多能力頁
對話/推理/視覺見 對話與推理;聯網見 聯網搜尋與 X 搜尋。
模型定價
掛牌價與 xAI 官網一致(已於 2026-07-13 經 API易 定價介面逐一核對,grok-4.6 於 2026-08-13 補核),API易 的折扣體現在 GrokOfficial 分組 0.8x 與 充值加贈活動 中,兩者可疊加。
下表為 0 – 200K 上下文件位的掛牌價(Grok 全系按上下文長度階梯計費,超過 200K 的檔位見下方說明):
階梯計費與快取價
Grok 全系按單次請求的上下文長度分兩檔計費,分檔點為 200K tokens(即 200Ki = 204,800)。超過該點的請求,輸入與輸出單價翻倍:
單位均為每 1M tokens。
grok-4.6 與 grok-4.5 唯一的價格差異在快取讀取($0.50 vs $0.30),輸入輸出完全相同。
其中 grok-4.6 兩檔的輸入 / 輸出 / 快取讀取價均已在 API易 控制台逐項核對;其餘模型第二檔的快取讀取價按官方「第二檔單價翻倍」口徑推算,以 模型價格頁 的即時掛牌為準。
- 別名
grok-code-fast/grok-code-fast-1亦可呼叫(實測連通),定價以 模型價格頁 為準。 - 快取命中的輸入 tokens 享受上表的快取讀取價,Grok 字首快取自動生效、無需配置,雙端點與流式 / 非流式均已實測覆蓋,詳見 Grok 快取計費指南。
- 長上下文任務請留意分檔點:一次 210K tokens 的請求,全部 tokens 都按第二檔計價,而不是隻有超出的 10K 按第二檔。拆分請求可以避開這一跳變。
分組與折扣
GrokOfficial 的模型能力與呼叫方式和預設分組完全一致,單獨拆出這個分組只是為了做優惠、鼓勵在 Grok 系列上多跑量。建立令牌時勾選該分組(或在已有 Grok 令牌上增加該分組)即可,程式碼一行不用改;grok-4.6 等模型在該分組下同樣支援 Codex 場景使用。
折扣可與 充值加贈(10%–20%)疊加。以 grok-4.6 第一檔為例:
實測能力矩陣
以下矩陣來自 2026-07-13 (UTC+8) 在 API易 閘道的實測(✅ 實測通過;◐ 未實測、同架構預期一致;— 未覆蓋,同架構預期一致):grok-4.6 那一列為什麼還有 ◐:這套 56 組請求的實測跑於 2026-07-13,當時 4.6 尚未釋出。2026-08-19 我們對 4.6 補測了基礎對話、流式輸出(含 usage)與 Prompt Caching 三項(覆蓋 /v1/chat/completions 與 /v1/responses 雙端點、流式與非流式,並逐條核對了賬單),已改為實測結論。其餘仍為 ◐ 的專案沿用同架構預期一致的判斷:4.6 與 4.5 同為 1.5T 引數 V9 基座、同一套 API 協議與端點,上游也未公告任何引數層面的破壞性變更。生產接入前建議先在自己的用例上做一次小樣驗證。端點一覽
在 Codex 中直接使用
因為原生支援/v1/responses,Grok 是少數能在 OpenAI Codex(桌面客戶端 / IDE 外掛 / CLI)裡以 responses 原生協議直接使用的非 OpenAI 模型——config.toml 裡 model = "grok-4.6"、wire_api = "responses" 即可,5 分鐘接上,Codex 的工具呼叫、推理條目等 Agent 能力全走原生協議。對比之下,Claude / Gemini 在 API易 上只能走 OpenAI 相容 chat 模式(wire_api = "chat" 兜底),在 Codex / Agent 場景存在協議不相容。完整接入步驟見 Codex 接入教程。
快速開始
計費注意:思維鏈 tokens
grok-4.6 / grok-4.5 / grok-4.3 / grok-build-0.1 預設帶內部推理:響應中返回 reasoning_content,且推理 tokens 計入輸出計費。實測短問答中可見文本僅 30 tokens、實際計費輸出 586 tokens(含 556 推理 tokens)。對成本敏感的短問答場景,建議改用 grok-4.20-0309-non-reasoning。詳細說明見 對話與推理。
常見問題
Grok 有自己的原生 API 格式嗎?
Grok 有自己的原生 API 格式嗎?
沒有獨立私有協議。xAI 官方 REST API 就是 OpenAI 相容格式:
/v1/chat/completions(對話)+ /v1/responses(Responses API 與 server-side 工具)。在 API易 上用 OpenAI SDK 把 base_url 指向 https://api.apiyi.com/v1 即為全功能呼叫,不存在”相容模式閹割”。聯網搜尋怎麼開?
聯網搜尋怎麼開?
走 Responses API:
tools: [{"type": "web_search"}](或 x_search)。舊版 Chat Completions 的 search_parameters 引數已被 xAI 下線(實測 410),不要再使用。詳見 聯網搜尋與 X 搜尋。模型自我介紹說自己是 Grok 4,是不是模型不對?
模型自我介紹說自己是 Grok 4,是不是模型不對?
正常現象。Grok 4.x 全系的自我認知均為「Grok 4」(multi-agent 模型自稱 Oppie),不會精確報出 4.6 / 4.5 / 4.3 等版本號。驗證模型身份請以請求的
model 欄位和響應 model 欄位為準,而非模型的自我介紹。快取需要配置嗎?
快取需要配置嗎?
不需要。Grok 字首快取自動生效,響應
usage.prompt_tokens_details.cached_tokens 可自查命中量(/v1/responses 端點看 usage.input_tokens_details.cached_tokens)。命中量按 128 token 取整,兩輪實測都吻合:8802 token 的字首命中 8704、2735 token 的字首命中 2688。xAI 官方明確快取條目可能被驅逐、不保證 100% 命中,做成本測算請按無快取價格打底。完整口徑見 Grok 快取計費指南。上下文超限會怎樣?
上下文超限會怎樣?
返回 400 錯誤。注意各檔上限不同:grok-4.6 與 grok-4.5 為 500K,grok-4.3 與 4.20 系列為 1M,grok-build-0.1 為 256K。超長內容建議先做摘要 / 分段 / RAG 檢索。
失敗的請求會扣費嗎?
失敗的請求會扣費嗎?
4xx 類客戶端錯誤(引數錯誤 / 鑑權失敗)不計費;已成功返回 tokens 的請求按實際消耗計費。注意
deferred: true 會被靜默忽略——請求實際同步執行並正常計費。相關文件
對話與推理
流式、思維鏈、結構化輸出、函式呼叫、視覺輸入、快取
快取計費
命中省 75%、128 token 塊粒度、長對話該走哪個端點
聯網搜尋與 X 搜尋
Responses API 的 web_search / x_search 工具實戰
程式碼執行與 MCP
服務端 Python 沙箱與 Remote MCP 工具接入
Multi-Agent 模型
多智慧體協作模型的能力與計費特性
在 Codex 中使用 Grok
原生 responses 協議直連 Codex,5 分鐘接上
Grok 4.6 釋出解讀
xAI 最新旗艦的基準、定價與遷移建議
Grok 4.5 釋出解讀
上一代旗艦的深度解讀
模型資訊總覽
檢視所有可用模型及分組