概述
除了獨立的 文生圖 / 圖片編輯 端點外,API易 還支援 OpenAI Responses API 的原生image_generation 工具:由主線模型 gpt-5.5 在對話中自主決定何時畫圖,內部自動選用 GPT Image 模型,圖片以 base64 形式回傳在響應的 output 數組裡。
實測可用(2026-06-17):
gpt-5.5 + POST /v1/responses + tools: [{"type": "image_generation"}],返回合法 base64 PNG。兩條出圖鏈路均走 OpenAI 官網直轉。怎麼選? 絕大部分「我就是要張圖」的場景,請優先用獨立端點
/v1/images/generations——只按實際用量計費,更划算也更可控。僅當你的鏈路必須走 Responses(例如讓 gpt-5.5 在 Agent 對話中自主決定是否畫圖)時,才用本頁的原生工具方式——它每次出圖額外固定收一筆約 $0.20 的工具呼叫費。兩種出圖方式對比
根本差異:原生工具方式每次出圖額外固定約 $0.20 工具費;images API 只按實際用量計費,所以多數場景更划算。
最簡呼叫
cURL
Python(requests)
響應結構(關鍵欄位)
成功時 HTTP 200,響應體裡:- ✅ 成功:
output裡有type="image_generation_call",且result解碼出\x89PNG開頭的合法圖。 - ⚠️ 被靜默剝離:HTTP 200 但
output裡沒有image_generation_call,只有一段文字(常見於渠道不支援)。 - ❌ 報錯:非 200,或返回
unknown tool/no available channels等。後兩種可改走/v1/images/generations兜底。
💰 計費說明
以一次真實呼叫為例(輸入 2347 token、輸出 74 token、生成 1 張 1122×1402 PNG),最終扣費 = $0.213954,計費正確。拆解如下:換算關係:500,000 配額 = \$1(由106977 配額 = \$0.213954反推)。
成本提示
- 出圖費用是按張固定(約 $0.20/張),不隨 prompt 長短變化;文本 token 費相比之下很小。
- 單張耗時約 60~90s,程式碼裡超時建議設 ≥300s。
- 如果只是要圖、不需要模型自主決策,用獨立端點
/v1/images/generations可能更省也更可控。
排錯速查
相關文件
- GPT-Image-2 概覽 - 模型總覽與定價
- 文生圖 API 參考 -
/v1/images/generations,多數場景的首選 - 圖片編輯 API 參考 -
/v1/images/edits,參考圖編輯 / 多圖融合 / mask