/v1/chat/completions 端點上的全部對話類能力,所有結論基於 2026年7月13日 (UTC+8) 在 API易 閘道的實測。
基礎對話與流式輸出
全系 6 個模型均支援標準 OpenAI 格式與流式輸出,stream_options: {"include_usage": true} 實測可用(末尾 chunk 返回完整 usage):
思維鏈(Reasoning)
這是 Grok 系列最容易被誤解的計費點,務必讀完本節。哪些模型輸出思維鏈
讀取思維鏈與推理用量
reasoning_effort 引數
reasoning_effort(如 "low" / "high")僅 grok-4.5 接受;grok-4.20-0309-reasoning 會明確報錯 Model ... does not support parameter reasoningEffort(400)。跨模型程式碼請勿硬編碼該引數。
結構化輸出(Structured Outputs)
支援 OpenAI 標準的response_format: json_schema(strict 模式),實測 grok-4.5 / grok-4.3 / grok-build-0.1 / grok-4.20-0309-reasoning / multi-agent 模型全部通過,返回嚴格符合 schema 的 JSON:
函式呼叫(Function Calling)
支援 OpenAI 標準的tools / tool_choice 欄位與完整的兩輪工具呼叫流程(實測 grok-4.5 / grok-4.3 / grok-build-0.1 通過):
tool_choice 強制呼叫({"type": "function", "function": {"name": "get_weather"}})實測同樣可用。
視覺輸入(圖片理解)
Grok 4.x 對話模型支援圖片輸入(jpg / png,單圖不大於 20MiB),使用 OpenAI Vision 相容格式。實測grok-4.5 / grok-4.3 / grok-4.20-0309-non-reasoning 均正確識別圖形與顏色:
Prompt Caching(自動快取)
Grok 字首快取自動生效,無需任何配置。同字首請求實測第二次起命中 2688/2735 tokens,命中部分按緩存摺扣價計費:常見問題
怎麼關閉 grok-4.5 的思維鏈?
怎麼關閉 grok-4.5 的思維鏈?
關不掉。
grok-4.5 / grok-4.3 / grok-build-0.1 的內部推理是模型固有行為。若不需要思維鏈、追求快答低成本,直接改用 grok-4.20-0309-non-reasoning。reasoning_content 會計入下一輪上下文嗎?
reasoning_content 會計入下一輪上下文嗎?
多輪對話回傳歷史時,只需回傳
content(和工具呼叫相關欄位),不要把 reasoning_content 塞回 messages——它不是標準欄位,回傳徒增輸入 tokens。max_tokens 怎麼設定?
max_tokens 怎麼設定?
推理模型的思維鏈也消耗輸出配額,
max_tokens 給小了會導致思維鏈吃滿配額、正文被截斷。帶推理的模型建議 max_tokens 至少 2048 起步。temperature / top_p 能用嗎?
temperature / top_p 能用嗎?
可以正常傳入。注意推理類模型對取樣引數的敏感度低於傳統模型,調優價值有限。
相關文件
Grok 概覽
模型陣容、定價與能力矩陣
聯網搜尋與 X 搜尋
server-side 聯網工具實戰