Skip to main content

概述

除了獨立的 文生圖 / 圖片編輯 端點外,API易 還支援 OpenAI Responses API 的原生 image_generation 工具:由主線模型 gpt-5.5 在對話中自主決定何時畫圖,內部自動選用 GPT Image 模型,圖片以 base64 形式回傳在響應的 output 數組裡。
實測可用(2026-06-17)gpt-5.5 + POST /v1/responses + tools: [{"type": "image_generation"}],返回合法 base64 PNG。兩條出圖鏈路均走 OpenAI 官網直轉。
怎麼選? 絕大部分「我就是要張圖」的場景,請優先用獨立端點 /v1/images/generations——只按實際用量計費,更划算也更可控。僅當你的鏈路必須走 Responses(例如讓 gpt-5.5 在 Agent 對話中自主決定是否畫圖)時,才用本頁的原生工具方式——它每次出圖額外固定收一筆約 $0.20 的工具呼叫費。

兩種出圖方式對比

根本差異:原生工具方式每次出圖額外固定約 $0.20 工具費;images API 只按實際用量計費,所以多數場景更划算。

最簡呼叫

cURL

Python(requests)

可選引數放進 tools 項裡:{"type": "image_generation", "output_format": "png|jpeg|webp", "size": "1024x1024", ...}。不寫則用預設(png)。

響應結構(關鍵欄位)

成功時 HTTP 200,響應體裡:
判斷是否真出圖:
  • 成功output 裡有 type="image_generation_call",且 result 解碼出 \x89PNG 開頭的合法圖。
  • ⚠️ 被靜默剝離:HTTP 200 但 output沒有 image_generation_call,只有一段文字(常見於渠道不支援)。
  • 報錯:非 200,或返回 unknown tool / no available channels 等。後兩種可改走 /v1/images/generations 兜底。

💰 計費說明

以一次真實呼叫為例(輸入 2347 token、輸出 74 token、生成 1 張 1122×1402 PNG),最終扣費 = $0.213954,計費正確。拆解如下:
換算關係:500,000 配額 = \$1(由 106977 配額 = \$0.213954 反推)。
控制台明細頁的展示問題(需主動向客戶說明)在 APIYI 的「條件計費詳情」頁面裡:
  • 上半部分只展示了文本部分的計算(基礎成本 = (2347 + 74×6) × 2.5 = 6977.50);
  • 畫圖工具呼叫的那一筆費用(≈100,000 配額 / ≈$0.20)在明細列表裡是一行空白,沒有渲染出來
  • 但它已經被正確計入底部的「最終配額 106977 / $0.213954」。
結論:計費是正常、準確的——只是明細 UI 漏顯示了「圖片工具」這一行,導致明細各行相加 ≠ 最終總額。向客戶解釋時強調:總額無誤,差額就是這張圖的工具費(約 $0.20/張),只是沒單獨列出來。

成本提示

  • 出圖費用是按張固定(約 $0.20/張),不隨 prompt 長短變化;文本 token 費相比之下很小。
  • 單張耗時約 60~90s,程式碼裡超時建議設 ≥300s。
  • 如果只是要圖、不需要模型自主決策,用獨立端點 /v1/images/generations 可能更省也更可控。

排錯速查

相關文件