Skip to main content
POST
图片编辑:根据指令编辑或融合参考图,可锁定输出尺寸
右側的互動式 Playground 支援直接上傳本地圖片。請在 Authorization 中填入你的 API Key(格式:Bearer sk-xxx),選擇圖片與填入 promptmodelsize 後一鍵傳送即可。
場景說明:本頁用於「基於一張或多張參考圖改圖 / 融合生成」。請求為 multipart/form-data 格式。如需純文本生成圖片,請使用 文生圖介面gpt-image-2-all 的區別:呼叫結構完全一致,只多一個 size 欄位;不需要鎖尺寸、追求出圖速度時改用 gpt-image-2-all
🖥️ 瀏覽器 Playground 限制本端點預設返回 base64 字串(b64_json,體積可達數 MB,瀏覽器 Playground 可能彈出 請求時發生錯誤: unable to complete request ——實際請求已經成功,只是瀏覽器無法顯示這麼長的 base64。推薦做法:想要 base64 或要傳超大參考圖時,複製下方”程式碼示例”到本地執行,程式碼會自動處理上傳與解碼。
📎 多圖融合順序有意義image 欄位可重複傳入多張參考圖,順序將作為 prompt 中「圖1/圖2/圖3」的引用依據。建議在 prompt 中顯式指代,例如:
把圖1的人物放進圖2的場景,參考圖3的畫風
推薦單張 ≤ 10MB,格式 png / jpg / webp,過大的圖可能觸發閘道限制。
🎯 保形改圖小技巧:傳 size=auto(或不傳 size)時,輸出會跟隨 prompt 裡點名要修改的那張圖的尺寸比例——多圖場景下不一定是第一張例如 prompt 寫”修改圖2,把圖2 的衣服和帽子改成圖1 裡的樣子”,那圖2 是 1:1,則輸出也是 1:1(即便圖1 是橫版 16:9)。對換裝、加帽子、修圖等保形場景特別好用。如果 prompt 沒明確指代要改哪張,模型會自行判斷;需要切換到 30 檔鎖定尺寸時再顯式傳 size
⚠️ 關鍵引數說明
  • size改圖建議傳 auto(或不傳)——模型會根據 prompt 裡點名要修改的那張圖的尺寸比例輸出,多圖場景下不一定是第一張。例如 prompt 寫”修改圖2,把圖2 的衣服換成圖1 的樣子”,輸出比例就跟圖2 一致;prompt 沒明確指代時由模型自行判斷。需要強制改變尺寸時,從 30 檔常見尺寸裡選;寫法用半形小寫 x,如 2048x13603840x2160。完整表見 概覽頁
  • quality:❌ 不接受,不要傳
  • n:❌ 不接受,單次僅返回 1 張圖。
  • response_format:不傳預設返回 base64(純 base64 無字首,2026-07 實測);傳 "url" 可返回圖片 URL。強依賴 URL 輸出的業務建議把令牌分組切到 image2_OSS,穩定輸出 URL、不降級為 base64。

程式碼示例

Python

單圖編輯
多圖融合

cURL

單圖編輯
多圖融合

Node.js(原生 fetch + FormData)

瀏覽器 JavaScript(File 物件)

引數說明速查

多輪迭代:把上一次的輸出圖片作為下一次的 image 輸入,配合新的編輯指令,可逐步精調畫面效果。每一輪都可以獨立指定 size

響應格式

與文生圖介面一致:預設返回 base64data[0].b64_json,純 base64 無字首,2026-07 實測)。如需 圖片 URL:顯式傳 response_format: "url" 即可;強依賴 URL 輸出的業務建議把令牌分組切到 image2_OSS,穩定輸出 URL、不降級為 base64。data[0] 中只會出現 urlb64_json 之一,不會兩者都返回。 b64_json 模式(預設):
url 模式(顯式傳 response_format: "url";強依賴 URL 建議用 image2_OSS 分組):
2026-07 實測 b64_json 欄位為純 base64(不含 data: 字首),需解碼或自行拼接字首後使用;歷史版本曾直接帶字首。請先做 startsWith('data:') 檢測再處理,相容兩種形態。

相關資源

模型概覽(含完整 size 表)

30 檔 size 完整對照表、定價、技術規格

文生圖 API

/v1/images/generations 相容端點

姐妹模型 gpt-image-2-all

不需要鎖尺寸時呼叫方式一致,出圖更快

授權

Authorization
string
header
必填

在 API易控制台获取的 API Key

主體

multipart/form-data
model
enum<string>
預設值:gpt-image-2-vip
必填

模型名称,固定为 gpt-image-2-vip

可用選項:
gpt-image-2-vip
prompt
string
必填

编辑/融合指令。多图场景可用「图1/图2/图3」指代 image 字段的上传顺序

範例:

"把图1的人物放进图2的场景,参考图3的画风"

image
file[]
必填

参考图。单图直接传一次,多图重复传同名 image 字段(例如 -F [email protected] -F [email protected]),按上传顺序对应 prompt 中的「图1/图2/...」。推荐单张 ≤ 10MB,格式 png/jpg/webp。

size
enum<string>

输出尺寸。改图场景推荐传 auto(或不传)——模型会根据 prompt 里点名要修改的那张图的尺寸比例输出(多图场景下不一定是第一张)。例如 prompt 写"修改图2,把图2 的衣服换成图1 的样子",则输出比例跟图2 一致。如果 prompt 没明确指代,模型会自行判断。如需强制改变尺寸,从 30 档常见尺寸里选;写法:宽x高(半角小写 x),如 2048x13603840x2160。所有档位统一价 $0.03/张。

可用選項:
auto,
1280x1280,
848x1280,
1280x848,
960x1280,
1280x960,
1024x1280,
1280x1024,
720x1280,
1280x720,
1280x544,
2048x2048,
1360x2048,
2048x1360,
1536x2048,
2048x1536,
1632x2048,
2048x1632,
1152x2048,
2048x1152,
2048x864,
2880x2880,
2336x3520,
3520x2336,
2480x3312,
3312x2480,
2560x3216,
3216x2560,
2160x3840,
3840x2160,
3840x1632
範例:

"2048x1360"

回應

成功生成图片。响应默认返回 base64(data[0].b64_json),不会同时返回 url

图片编辑响应。默认返回 base64data[0].b64_json);如需 url,请改用 image2_OSS 分组并传 response_format=urldata[0]只会出现 urlb64_json 之一,不会两者都返回。

data
object[]

生成结果数组(本模型单次返回 1 张)

created
integer

创建时间戳(Unix 秒)

usage
object

Token 用量统计