Skip to main content
POST
图片编辑:根据指令编辑参考图或融合多图
🔒 本系列預設不對外開放:Grok Imagine 2 不在 Default 預設分組,獨立放在 Grok_imagine 專屬分組,需申請開通後才能呼叫(含本頁 Playground)。未開通時呼叫固定返回 503。該系列的內容安全策略與平臺其它模型差異較大,部分類別不作過濾,為避免合規風險我們採取定向開放:累計消費滿 $1,000 的存量客戶聯絡客服說明用途即可開通,其他客戶請通過企業微信客服提交申請,說明使用場景與內容管控措施。申請流程見 Grok Imagine 2 概覽 · 分組介紹。
右側的互動式 Playground 支援直接上傳本地圖片。請在 Authorization 中填入你的 API Key(格式:Bearer sk-xxx),選擇 image 檔案並填入 prompt、model 後一鍵傳送即可。
🔴 本介面必須使用 multipart/form-data 檔案上傳傳送 JSON 到 /v1/images/edits 會固定返回 400:
如果你是照著 xAI / 上游廠商的文件接入的,請特別注意:上游文件寫的是 JSON + 公網圖片 URL 的形式({"image": {"type": "image_url", "url": "..."}}),這套寫法在 API易 閘道上走不通,請以本頁為準。好訊息是檔案上傳不需要圖床——直接傳本地檔案即可,比準備公網 URL 更省事。檔案欄位名只能是 image 或 image[];寫成 images / image_file 會返回 415。prompt 必填,缺失返回 400。
場景說明:本頁用於「基於一張或多張參考圖改圖 / 多圖融合」。如需純文本生成圖片,請使用 文生圖介面。
⚠️ 輸出畫幅跟隨「第一張」參考圖,改不了resolution 與 aspect_ratio 在本端點傳入不報錯也不生效——編輯結果的尺寸恆等於第一張參考圖的尺寸(輸入 1280×720 就輸出 1280×720,輸入 1024×1024 就輸出 1024×1024)。多圖融合時同理:實測把 4 張的順序完全顛倒,輸出畫幅就從 1280×720 變成 1024×1024,跟著新的第一張走。需要改變輸出畫幅,請先自行裁剪或縮放第一張參考圖再上傳。
多圖融合順序有意義:image[] 可重複傳入 1–4 張參考圖(實測上限 4 張,傳 5 張返回 400),上傳順序就是提示詞中「圖1 / 圖2 / 圖3」的引用依據。建議在提示詞裡顯式指代,例如「把圖1的主體放進圖2的場景,沿用圖2的畫風」。實測 2 / 3 / 4 張遞進驗證:每多傳一張,輸出就多一個對應主體,各自的鮮明特徵都會保留,融合是真實生效的。

程式碼示例

Python(OpenAI SDK · 單圖編輯)

Python(原生 requests · 單圖編輯)

Python(多圖融合 · 1–4 張)

cURL

Node.js(原生 fetch + FormData)

瀏覽器 JavaScript

引數說明速查

本系列不支援 mask 局部重繪。要局部修改請在提示詞裡描述清楚修改範圍,例如「只把圍巾改成紅色,其餘部分完全保持不變」——模型對這類約束遵循度很好。

編輯效果與提示詞寫法

編輯介面會保留輸入圖的畫風、構圖、配色與主體身份,只改提示詞指定的部分。為了拿到穩定結果,建議:
**顯式宣告「其餘保持不變」**是這個模型上最有效的技巧。多圖融合時則要顯式指代「圖1 / 圖2」,對應 image[] 的上傳順序。另外把最重要的主體放第一張:第一張不僅決定輸出畫幅,實測順序顛倒後次要主體的身份還可能與其它主體發生融合。

響應格式

響應欄位陷阱
  • data[] 每項只有 url 或 b64_json 二選一,取決於 response_format,不會同時出現。
  • 不返回 revised_prompt,解析時不要假設它存在。
  • b64_json 是純 base64,不帶 data:image/...;base64, 字首,可直接 base64.b64decode。
  • created 恆為 0,不能當時間戳用。
  • 輸出尺寸由輸入圖決定,不要按請求引數去預判返回圖的寬高。
usage 不能用來核賬:prompt_tokens 恆為 1000 × n,是佔位值。編輯與文生圖同價,按次固定計費,真實扣費請以 API易 控制台賬單為準。

授權

Authorization
string
header
必填

在 API易控制台获取的 API Key

主體

multipart/form-data
model
enum<string>
預設值:grok-imagine-image
必填

模型 ID

可用選項:
grok-imagine-image,
grok-imagine-image-quality
prompt
string
必填

编辑指令。建议明确「改什么」并声明「其余保持不变」,例如 Change the scarf color to bright RED. Keep everything else exactly the same.

範例:

"Change the scarf color to bright RED. Keep everything else exactly the same."

image
file
必填

参考图文件。多图融合时用 image[] 重复传入(1–4 张), 顺序即 prompt 中「图1/图2/图3」的引用依据,第一张还决定输出画幅。 实测每多传一张就多一个主体,融合真实生效。格式 png / jpg / webp。

n
integer
預設值:1

生成图片数量,取值 1–10。与参考图数量无关

必填範圍: 1 <= x <= 10
範例:

1

response_format
enum<string>
預設值:url

返回格式。url 返回图片直链;b64_json 返回纯 base64(不带 data: 前缀)

可用選項:
url,
b64_json
範例:

"url"

回應

成功生成图片

created
integer

创建时间戳。本模型恒返回 0,不可用于计时

範例:

0

data
object[]

图片结果数组,长度等于请求的 n

usage
object

占位值,不能用于核账。 prompt_tokens 恒为 1000 × n