Skip to main content
size 引數已恢復可用(2026-07-22 更新):顯式傳入 size 即可正常鎖定輸出尺寸,本頁 30 檔對照表恢復生效。注意:size 僅在 /v1/images/generations/v1/images/edits 端點生效,/v1/chat/completions 聊天補全端點不支援 size 引數,對話方式出圖無法鎖尺寸。最新狀態以 即時動態 欄目為準。
圖片 API 全部為同步呼叫:沒有非同步任務 ID,客戶端斷開連線結果即丟失、但請求仍會計費。請為本模型設定足夠大的 timeout,詳見 圖片 API 呼叫須知與最佳實踐

概述

gpt-image-2-vip 是 API易 平臺上線的 GPT 影像生成 Codex 官逆模型。與 gpt-image-2-all 同價 $0.03/張呼叫方式完全一致,最大區別是 支援 size 引數——覆蓋 10 比例 × 3 解析度檔(1K Fast / 2K Recommended / 4K Detail)共 30 檔常見尺寸,含 4K。
🎨 核心定位:當你需要鎖定輸出尺寸(電商主圖、海報模板、影片封面、4K 桌布等)時使用 gpt-image-2-vip。請求體裡只需把 model 改成 gpt-image-2-vip、加一個 size 欄位,其它程式碼與 gpt-image-2-all 完全相同

文生圖 API

/v1/images/generations,輸入文本提示詞 + size 生成指定尺寸圖片。

圖片編輯 API

/v1/images/edits,multipart 上傳參考圖 + 編輯/融合指令。

gpt-image-2-all 的關鍵差異

gpt-image-2-vipgpt-image-2-all 同屬逆向通道、同價、同套呼叫程式碼。互相對映——把同一段請求裡的 model 欄位從一個換成另一個,行為整體一致,差異如下:
一句話決策不需要嚴格控尺寸、追求出圖速度gpt-image-2-all要鎖死輸出尺寸或要 4Kgpt-image-2-vip需要畫質引數 quality 或 OpenAI 官方完全對齊的欄位 → 改用官方版 gpt-image-2

核心特性

穩定鎖定輸出尺寸

size 欄位直接接受 30 檔常見尺寸,電商主圖、海報模板、4K 桌布都能嚴格輸出

4K 高解析度

4K Detail 檔支援 2880×2880 / 3840×2160 / 3840×1632 等,適合大尺寸交付物

所有 size 統一價

1K / 2K / 4K 所有檔位統一 $0.03/張,4K 不額外加價

呼叫方式同 -all

請求結構、欄位、響應欄位與 gpt-image-2-all 完全一致,可秒級切換模型名

文字還原度高

圖內中英文、招牌、海報文字還原穩定,適合資訊圖與營銷物料

中文提示詞友好

原生理解中文描述,無需翻譯即可獲得高品質輸出

自然語言改圖

支援通過對話描述直接改圖,無需蒙版,可多輪迭代

標準端點相容

相容 OpenAI Images API 標準端點 /images/generations/images/edits

模型定價

計費說明
  • 所有 30 檔 size 統一定價 $0.03/張——4K Detail 不加價
  • 失敗請求不計費(如鑑權失敗、引數校驗失敗)
  • 如需生成 N 張,客戶端並行呼叫 N 次

分組介紹

gpt-image-2-vip 放在 Default 預設分組 即可,不需要額外切分組。逆向通道目前供給穩定,不存在像官轉那樣需要”企業分組”過渡的場景。

需要確定性 URL 輸出 → 切到 image2_OSS 分組

gpt-image-2-vip(及 gpt-image-2-all)在預設分組下實測(2026-07)不傳 response_format 時返回 b64_json;顯式傳 response_format: "url" 可拿到圖片 URL。但預設分組的輸出格式不做承諾——歷史上曾預設返回 url、資源緊張時降級為 b64_json,行為隨負載與渠道版本變化過。 如果你的業務強依賴 URL 輸出(直接把 URL 落庫、前端按 URL 渲染、不接受 base64),請把令牌分組切到 image2_OSS——這是專為 URL 輸出確定性設計的分組,1x 倍率(不加價),對 gpt-image-2-vipgpt-image-2-all 兩個官逆模型都生效,保證響應穩定輸出圖片 URL,不會降級為 base64。
令牌建立介面:計費模式「按量優先」,選擇分組 image2_OSS(1x 倍率),支援輸出為圖片 URL 的分組,適合 gpt-image-2-all 與 gpt-image-2-vip

令牌建立:計費模式選「按量優先」,分組選 image2_OSS(1x)——需要確定性 URL 輸出時使用

進階玩法(同時使用 gpt-image-2-all 與官轉 gpt-image-2:如果你的令牌同時覆蓋逆向兩模與官轉 gpt-image-2,可以在令牌的「分組優先順序」裡這樣配——
  • 第一優先順序image2Enterprise(1.2x 企業分組,官轉專用穩定通道)
  • 預設(兜底)Default(逆向兩模都在這裡,按模型路由)
這樣官轉 gpt-image-2 走企業分組保穩,逆向兩模仍走預設分組——一把令牌覆蓋三種模型,互不干擾。
📖 關於 image2Enterprise 企業分組:/live/2026-04/image2-enterprise

技術規格

⏰ 圖片 URL 有效期:預設 1 天url 模式響應的 url 欄位是 R2 CDN 加速連結,有效期約 24 小時,過期後訪問會 404。需要長期儲存的圖片請在生成後儘快轉存到自己的物件儲存 / CDN / 資料庫,或改用 b64_json 響應格式。

端點一覽

gpt-image-2-vipgpt-image-2-all 相容完全相同的兩個端點。把 model 欄位換掉、按需加上 size 即可:
統一使用 OpenAI Images API/v1/images/generations + /v1/images/edits),理由有二:
  1. 更穩定:上游對 Images API 通道的資源供給更充足,呼叫成功率更高
  2. 相容官轉,便於切換:與官轉 gpt-image-2 呼叫方式、size 等引數完全相容——遇到官逆通道風控異常時,只需更換 model 名即可切換,業務程式碼零改動
另有對話式端點(/v1/chat/completions,不主推),見下方「常見問題」。
域名選擇api.apiyi.com 為主域名,也可使用 b.apiyi.com / vip.apiyi.com 等平臺提供的其他閘道域名,響應行為一致。

支援的 size(30 檔完整對照表)

gpt-image-2-vip 支援 10 個比例 × 3 個解析度檔 = 30 檔 常見尺寸。請求體直接傳 size: "寬x高"(半形小寫 x)。

1K Fast — 草稿與低成本試稿

4K Detail — 大尺寸交付物

30 檔統一價:所有檔位都是 $0.03/張,4K Detail 不額外加價。
怎麼選檔位
  • 1K Fast:用於草稿、縮圖、A/B 測試,省時(也不省錢,價格統一),出圖最快。
  • 2K Recommended預設檔,覆蓋大部分終稿場景(電商主圖、海報、資訊圖)。
  • 4K Detail:印刷、大屏桌布、影片封面、桌面 / 戶外大圖。
最小呼叫示例(只傳 size不要傳 quality):

最佳實踐

1

輸入圖先壓到 1.5MB 以內(圖生圖 / 多圖融合)

上傳給介面的每張圖先壓到 1.5MB 以內(JPEG 品質 80-90 / 解析度適當下調),多圖融合時也按這個標準逐張控制。偶發的 shell_api_error / Unknown error 大多就是圖片體積過大觸發的,壓一下請求成功率和出圖速度都會明顯改善。輸出解析度由 size 欄位決定,與輸入圖體積無關——壓小輸入只會提速、不會損畫質。提示詞裡光寫 4K / 8K 這類詞也不會真給你 4K,畫質看 size,不看 prompt 修飾詞。
2

按交付物檔位選 size

草稿用 1K Fast、終稿用 2K Recommended、印刷/大屏用 4K Detail。所有檔位統一價,按需要選。
3

size 用半形小寫 x

請求體寫 "size": "1536x1024",不是 1536×1024、不是大寫 X
4

不要傳 quality 與 n

quality 不接受;n 單次僅返回 1 張圖,多張請客戶端並行呼叫。
5

超時設到 300 秒

出圖典型 90–150s,疊加圖片上傳/下載與高峰長尾,保守按 300s 配,避免大量誤超時。
6

響應格式按需選擇

Web 應用直接渲染用 b64_json,服務端中轉儲存用 url
7

程式碼可與 -all 共用

同一套呼叫程式碼,把 modelgpt-image-2-allgpt-image-2-vip 之間切換即可。需要鎖尺寸時切到 -vip,需要更快出圖時切回 -all。

錯誤碼與重試

建議客戶端
  • 請求超時 300 秒 起步(保守值;典型 90–150s,但 4K Detail + 高峰長尾會更長)
  • 對 5xx 與超時做 指數退避重試(建議 2–3 次)
  • 記錄響應頭 request-id 方便排查

常見問題

可以,幾乎完全一樣。 兩個端點(/v1/images/generations/v1/images/edits)的請求欄位、響應欄位、b64_json 字首行為都一致。差異只有兩處:
  1. model 欄位:gpt-image-2-vipgpt-image-2-all
  2. size 欄位:vip 接受 30 檔常見尺寸;-all 不接受 size,尺寸要寫進 prompt
實際工程實踐:保留同一套程式碼,做一個 if model == 'vip': payload['size'] = ... 的開關即可。
gpt-image-2-vip 走的是 Codex 逆向通道,典型 90–150 秒,與官轉 gpt-image-2(100–120 秒)持平,比 ChatGPT 網頁線路的 gpt-image-2-all(約 30–60 秒)慢。如果對響應延遲敏感,建議優先用 gpt-image-2-all;只在必須鎖尺寸或 4K 時切換到 vip。
是的,建議嚴格用表裡 30 檔之一。非表內 size 可能觸發上游 invalid_request_error,請按交付需求選最接近的檔位。
現象:在 4K Detail 檔(如 3840x2160 / 2880x2880)較容易觸發 status_code: 500 錯誤,上游返回 invalid_request_error
根因OpenAI 算力波動,與請求引數本身無關——同一段請求換 2K 檔大機率就過了。Codex 官逆通道對 4K 這種大輸出的負載更敏感,高峰期更明顯。應對建議(按價效比排序):
  1. 優先改用 2K Recommended 檔(如 2048x1360 / 2048x2048)—— 2K 成功率顯著更高,價格同樣 $0.03/張
  2. 圖生圖 / 多圖融合少傳輸入圖 —— Codex 官逆鏈路對多入圖請求處理壓力大,會進一步增加 4K 失敗率;單張輸入圖先壓到 1.5MB 以內也有幫助
  3. 如必須穩定出 4K —— 切換到官轉模型 gpt-image-2 + image2Enterprise 企業分組。官轉 4K 價格更高(約 $0.3+/張),但穩定性顯著更好,適合對 4K 交付有硬要求的場景。
📖 經驗來源:/live/2026-05/gpt-image-2-vip-4k-tips
強烈建議壓。單張輸入圖壓到 1.5MB 以內(JPEG 品質 80-90 / 解析度適當下調):偶發的 shell_api_error / Unknown error 大多就是圖片體積過大觸發的,壓一下請求成功率和出圖速度都會明顯改善。注意 1.5MB 是推薦上限(追求穩定性與速度),上面 FAQ 寫的 10MB 是閘道硬上限。別擔心壓輸入會損畫質——本模型輸出解析度由 size 引數決定,跟你上傳圖的體積沒關係。壓小輸入只會提速、不會損畫質。提示詞裡光寫 4K / 8K 這類詞也不會真給你 4K。如果 prompt 寫 8K 超清size1024x1024,最終拿到的就是 1K 水平。要 4K 請在 size 欄位裡指定——30 檔裡 1K / 2K / 4K 同價 $0.03/張,按需要直接選。📖 排錯來源:/live/2026-05/gpt-image-2-vip-unknown-error
不加價,4K Detail 檔(3840x2160 / 2880x2880 等)與 1K / 2K 同價 $0.03/張。
不支援。 本模型單次只返回 1 張圖,請通過重複呼叫 / 併發呼叫的方式生成多張。⚠️ 重要:如果在請求裡傳入 n=3計費會按 0.03 × 3 = $0.09 扣費,但實際上仍然只返回 1 張圖。請務必把 n 欄位從請求裡去掉,避免被多扣費。
官逆是同步對話式返回,結果分兩種情況,計費規則不同1) 返回 5xx 狀態碼 → 不計費上游內容策略明確攔截時會返回類似:
這種”明確報錯”呼叫不計費,引導使用者調整提示詞重試即可。2) 返回 200 狀態碼(模型用文字軟拒絕)→ 計費模型在對話裡軟拒絕、用文字回覆(例如「我不能做到這個需求」「抱歉,這個請求涉及……」),從協議層看就是一次正常的對話返回,這種情況會被計費。官逆目前沒有辦法在協議層提前識別”這一段是拒絕文字而不是圖片”。為什麼不能直接對軟拒絕免單?強行對所有”軟拒絕”都不計費意味著平臺要為每次失敗承擔上游成本;更關鍵的是,頻繁觸發上游內容安全會讓供應方賬號更容易被封號——這部分供給側的硬成本也無法完全規避。給接入方的建議
  • 前置內容過濾 / 風險提示:在前端或接入層先做一道關鍵詞與場景過濾(如真實姓名、版權角色、敏感題材),並在 UI 上提示”涉及名人/版權題材時上游限制較嚴,可能失敗也會計費”,能顯著降低誤扣率。
  • C 端產品月度補發:理解 C 端產品無法完全控制使用者輸入。如果你的月用量較大(月消費 $1000+ 起),可以按月彙總日誌(短耗時呼叫通常對應軟拒絕)聯絡客服一次性人工補發,無須逐條申訴。
📖 相關:官逆 500 多為內容違規
先檢測再處理。2026-07 實測返回的 b64_json 為純 base64(不帶字首),需要解碼寫檔案或自行拼接字首後再渲染;但歷史版本曾直接帶字首。請在程式碼裡做 startsWith('data:') 檢測:有字首直接用作 img src,無字首先解碼,避免雙重拼接或帶字首解碼產出損壞的圖片。
推薦 單張 ≤ 10MB,格式 png / jpg / webp。過大的圖可能觸發閘道限制。多圖融合時每張都需滿足此限制。
url 模式響應的 url 欄位是 R2 CDN 加速連結,有效期約 1 天(24 小時),過期後會 404。強烈建議:生成後儘快把圖片 轉存到自己的物件儲存(S3 / OSS / R2)、CDN 或資料庫,不要長期直接引用本服務返回的 URL。
本模型為一次性出圖,不支援 stream 輸出。如果對響應延遲敏感,建議客戶端顯示”生成中”進度提示,併合理配置 300s 超時(保守值)。
可以。把 base_url 指向 https://api.apiyi.com/v1api_key 設為 API易 令牌即可。client.images.generate(model="gpt-image-2-vip", size="2048x1360", prompt=...) 直接可用。
可以,端點仍然可用,但不再主推——推薦統一使用 /v1/images/generations/v1/images/edits(更穩定、與官轉 gpt-image-2 同套程式碼)。對話方式僅適合兩類場景:多輪迭代改圖、需要直接傳線上圖片 URL。注意出圖意圖不夠明確時可能返回純文字而不是圖片(可在提示詞開頭加「生成圖片:」字首強化)。詳細引數見 對話式呼叫說明
需要 quality(low/medium/high)檔位、需要 mask 局部重繪、需要 OpenAI 官方完全一致的欄位行為時,改用 gpt-image-2(官轉)。詳見 官轉 vs 官逆 對比

相關文件

gpt-image-2-vip 屬於官逆通道(Codex 線路),行為對齊但定價/能力與官方版本不完全一致。需要官方完全一致字段時,請使用 gpt-image-2