Skip to main content
POST
文生图:根据文本描述 + size 生成指定尺寸图片
右側的互動式 Playground 支援直接線上除錯。請在 Authorization 中填入你的 API Key(格式:Bearer sk-xxx),輸入 promptsize 後一鍵傳送即可。
場景說明:本頁用於「文本生成圖片」。只需輸入提示詞與 size 即可,無需上傳任何圖片。如需根據現有圖片做編輯或融合,請使用 圖片編輯介面gpt-image-2-all 的區別:呼叫結構完全一致,只多一個 size 欄位;不需要鎖尺寸、追求出圖速度時改用 gpt-image-2-all 即可。
🖥️ 瀏覽器 Playground 限制本端點預設返回 base64 字串(b64_json,體積可達數 MB,瀏覽器 Playground 可能彈出 請求時發生錯誤: unable to complete request ——實際請求已經成功,只是瀏覽器無法顯示這麼長的 base64。推薦做法複製下方”程式碼示例”到本地執行,程式碼會自動解碼並把圖片儲存為本地檔案。
圖片 API 全部為同步呼叫:沒有非同步任務 ID,客戶端斷開連線結果即丟失、但請求仍會計費。請為本模型設定足夠大的 timeout,詳見 圖片 API 呼叫須知與最佳實踐
⚠️ 關鍵引數說明
  • size:可傳 auto 讓模型自動決定尺寸(vip 在同一提示詞下尺寸相對收斂/固定),或從 30 檔常見尺寸裡選(10 比例 × 1K Fast / 2K Recommended / 4K Detail,詳見 概覽頁 size 完整表)嚴格鎖尺寸。寫法用半形小寫 x,例如 2048x13603840x2160,不要用 × 或大寫 X
  • quality:❌ 不接受,不要傳
  • n:❌ 不接受,單次僅返回 1 張圖。傳 n=3 會按 0.09 $ 扣費但只返回 1 張,請把 n 欄位從請求裡去掉。
  • aspect_ratio:❌ 不接受。比例直接由 size 決定。
  • response_format:不傳預設返回 base64(純 base64 無字首,2026-07 實測);傳 "url" 可返回圖片 URL。強依賴 URL 輸出的業務建議把令牌分組切到 image2_OSS,穩定輸出 URL、不降級為 base64。

程式碼示例

Python

4K Detail 檔示例(桌布 / 印刷)

cURL

Node.js

OpenAI SDK(Python,推薦)

引數說明速查

size 速查:常用挑這幾個就夠:
  • 電商主圖:2048x1360 (3:2 2K) / 2048x2048 (1:1 2K)
  • 海報豎圖:1536x2048 (3:4 2K) / 2480x3312 (3:4 4K)
  • 影片封面:2048x1152 (16:9 2K) / 3840x2160 (16:9 4K)
  • 故事/手機桌布:1152x2048 (9:16 2K) / 2160x3840 (9:16 4K)
完整 30 檔表見 概覽頁

響應格式

預設返回 base64data[0].b64_json,純 base64 無字首,2026-07 實測)。如需 圖片 URL:顯式傳 response_format: "url" 即可;強依賴 URL 輸出的業務建議把令牌分組切到 image2_OSS,穩定輸出 URL、不降級為 base64。data[0] 中只會出現 urlb64_json 之一,不會兩者都返回。 b64_json 模式(預設):
url 模式(顯式傳 response_format: "url";強依賴 URL 建議用 image2_OSS 分組,R2 CDN 全球加速):
相容性提示:2026-07 實測 b64_json 欄位為純 base64(不含 data: 字首),需解碼寫檔案或自行拼接字首後渲染;歷史版本曾直接帶字首。請在程式碼裡做 startsWith('data:') 檢測後再處理,相容兩種形態。

相關資源

模型概覽(含完整 size 表)

30 檔 size 完整對照表、定價、技術規格

圖片編輯 API

/v1/images/edits 多圖融合與改圖

姐妹模型 gpt-image-2-all

不需要鎖尺寸時呼叫方式一致,出圖更快(約 30–60s)

授權

Authorization
string
header
必填

在 API易控制台获取的 API Key

主體

application/json
model
enum<string>
預設值:gpt-image-2-vip
必填

模型名称,固定为 gpt-image-2-vip

可用選項:
gpt-image-2-vip
prompt
string
必填

提示词,描述画面内容、风格、光线等

範例:

"黄昏时的海边老灯塔,电影画幅,写实风格"

size
enum<string>

输出尺寸。可传 auto 让模型自动决定(vip 在同一提示词下倾向收敛到一个相对固定的尺寸),或从 30 档常见尺寸里选(10 比例 × 1K Fast / 2K Recommended / 4K Detail)严格锁尺寸。 写法:宽x高(半角小写 x),如 2048x13603840x2160。所有档位统一价 $0.03/张。

可用選項:
auto,
1280x1280,
848x1280,
1280x848,
960x1280,
1280x960,
1024x1280,
1280x1024,
720x1280,
1280x720,
1280x544,
2048x2048,
1360x2048,
2048x1360,
1536x2048,
2048x1536,
1632x2048,
2048x1632,
1152x2048,
2048x1152,
2048x864,
2880x2880,
2336x3520,
3520x2336,
2480x3312,
3312x2480,
2560x3216,
3216x2560,
2160x3840,
3840x2160,
3840x1632
範例:

"2048x1152"

回應

成功生成图片。响应默认返回 base64(data[0].b64_json),不会同时返回 url

图片生成响应。默认返回 base64data[0].b64_json);如需 url,请改用 image2_OSS 分组并传 response_format=urldata[0]只会出现 urlb64_json 之一,不会两者都返回。

data
object[]

生成结果数组(本模型单次返回 1 张)

created
integer

创建时间戳(Unix 秒)

usage
object

Token 用量统计