概述
MAI-Image 2.6 是微軟 AI(Microsoft AI)自研的影像生成模型,2026-09-04 釋出、在 Microsoft Foundry 公開預覽。釋出時在 Arena 榜單上文生圖與圖片編輯均排第 2,在 Artificial Analysis 榜單上圖片編輯排第 1(資料截至 2026-09-04,來源:微軟官方公告)。 API易 通過微軟官方渠道(官轉)提供兩個型號,共用同一套介面與引數:MAI-Image-2.6:旗艦版,追求畫質與精度MAI-Image-2.6-Flash:快速版,官方稱出圖速度是 GPT-Image-2-Medium 的 2.8 倍,適合高吞吐的生產場景
核心亮點:中文文字渲染出色(招牌、對聯、手寫體都能逐字正確),編輯保真度高(只改指定部分、其餘畫素級保留),
width + height 自定義任意畫幅(最高 1536×1536 面積),按次固定計費、不區分尺寸。1024×1024 出圖 Flash 約 17 秒、2.6 約 30 秒。圖片 API 全部為同步呼叫:沒有非同步任務 ID,客戶端斷開連線結果即丟失、但請求仍會計費。請為本模型設定足夠大的 timeout,詳見 圖片 API 呼叫須知與最佳實踐。
文生圖 API
輸入文本提示詞生成圖片,帶互動式 Playground 線上除錯。
圖片編輯 API
上傳參考圖 + 編輯指令生成新圖,支援雙圖融合,帶 Playground。
讓 AI Agent 幫你接入
在用 Codex / Claude Code / Cursor 開發的話,把下面這段提示詞複製給它。它會先抓本頁的純文本版(任意文件頁地址後加
.md),再按你專案的技術棧寫程式碼——超時、三個會 400 的引數、width/height 取代 size、編輯介面只認檔案上傳這幾個高頻坑已經寫死在要求裡。讓程式設計 Agent 接入或排查 MAI-Image 2.6 的文生圖與圖片編輯。複製後直接貼上給 Codex、Claude Code、Cursor 等。
這段提示詞替你擋掉了什麼
這段提示詞替你擋掉了什麼
為什麼選 API易 的 MAI-Image 2.6
微軟官方渠道
官轉接入,模型與微軟 Foundry 上的同名模型一致。走標準
/v1/images/generations 與 /v1/images/edits,響應結構與 OpenAI Images API 一致。按次計費 · 成本可預測
原廠按 token 計費、圖越大越貴;API易 按張固定價、不區分尺寸,從 768×768 到 1536×1536 同價,預算可精確到張。
全球零門檻接入
無需 Azure 賬號與海外伺服器,國內機房、家寬網路、海外節點均可直連
api.apiyi.com,一個 Key 調所有模型。模型生態齊全
影像側還有 GPT-Image-2、Nano Banana 2、Seedream、FLUX 可按場景組合。
核心特性
中文文字渲染
中文招牌、豎排對聯、黑板手寫都能逐字正確,適合海報、電商主圖、文創物料
高保真編輯
「把茶壺改成鈷藍釉」只改茶壺,尺寸標註、其它物件畫素級保留
自定義畫幅
width + height 任意組合,最長邊可到 3072(如 3072×768 橫幅),面積上限 1536×1536雙檔速度
1024×1024 出圖 Flash 約 17 秒、2.6 約 30 秒;10 併發下延遲穩定
實測效果
中文文字渲染(MAI-Image-2.6-Flash,提示詞要求招牌寫「API易 歡迎」):招牌、燈籠、豎排對聯、黑板手寫全部是可讀的中文。

MAI-Image-2.6-Flash,指令「把茶壺改成深鈷藍釉,其餘完全不變」):左為原圖,右為結果。只有茶壺變色,尺寸標註與其它物件保持不變。

模型定價
模型價格可能調整;上表僅供參考,具體以頂部導航「模型價格」欄目為準:模型價格。
計費說明
- 按張計費、不區分尺寸:768×768 與 1536×1536 同價;提示詞長短不影響價格。
- 編輯與文生圖同價:單圖編輯、雙圖融合都是一次一張的價格;編輯介面傳
n=2按 2 張計費。 - 被攔截或引數錯誤的請求(400)不出圖。
- 響應體裡的
usage不能用來核賬:prompt_tokens恆為1000 × 張數,是佔位值,真實扣費以控制台賬單為準。 - 可疊加 充值加贈活動。
分組與令牌
本系列在Default 預設分組,新建令牌即可直接呼叫,無需申請。
令牌「計費模式」:選
按量優先 或 按次計費 都能正常呼叫本系列。推薦 按量優先,同一把令牌還能相容站內其它按 token 計費的模型。速率:單個 Key 建議控制在 50 RPM 以內;有大批量出圖需求請提前聯絡客服報備。技術規格
端點一覽
關鍵引數詳解
width 與 height(輸出尺寸)
常用畫幅參考(都在面積上限內):
n(張數)
- 文生圖:
n無效,傳 2、4、10 都只返回 1 張(也只收 1 張的錢)。需要多張請併發多次請求。 - 編輯:
n有效,n=2返回 2 張、按 2 張計費。
最佳實踐
1
按場景選型號
批量出圖、對延遲敏感 →
MAI-Image-2.6-Flash;海報主視覺、複雜構圖、對畫質要求高 → MAI-Image-2.6。兩者引數完全一致,切換隻改模型名。2
中文文字寫進引號
要在圖裡出現的中文,用引號括起來並說明位置,例如:招牌上寫「API易 歡迎」。模型對引號內文字的還原度很高。
3
編輯時明確寫「其餘保持不變」
編輯指令寫成「把茶壺改成鈷藍釉,其餘部分完全保持不變」,能最大限度保留原圖。
4
改畫幅會重新構圖
編輯時傳與原圖不同比例的
width / height,模型會重新排布畫面而不是裁切或留白。只想改局部時不要傳尺寸,輸出會按原圖比例貼合到 16 的倍數(如 1344×756 輸入 → 1360×768 輸出)。5
多張圖就併發請求
文生圖一次只出一張,要 4 張就併發 4 個請求。實測 10 併發延遲與單發基本一致。
錯誤碼與重試
客戶端建議:上表中的 4xx / 500 都是確定性錯誤,重試沒有意義,應直接告警。只有網路層超時和
429 值得重試,建議指數退避、最多 3 次——但注意超時斷開的請求仍會計費,先加大 timeout。常見問題
為什麼傳了 response_format 就報 400?
為什麼傳了 response_format 就報 400?
本系列只返回
b64_json 一種格式,不接受 response_format 引數,傳 "b64_json" 也一樣報 400 Invalid parameters: response_format。從 gpt-image / DALL·E 遷移過來的程式碼往往顯式寫了這個引數,刪掉即可,返回值依然在 data[0].b64_json。seed 和 negative_prompt 同理。傳了 size: 1536x1024 為什麼出來還是方圖?
傳了 size: 1536x1024 為什麼出來還是方圖?
文生圖介面不認
size,會靜默忽略並按預設 1024×1024 出圖。請改成 "width": 1536, "height": 1024。編輯介面的 size 反而能生效,但為了兩邊寫法統一,建議都用 width + height。能用圖片 URL 做編輯嗎?
能用圖片 URL 做編輯嗎?
不能。 編輯介面只接受
multipart/form-data 檔案上傳,image 填 URL、data URI 或 base64 字串都會返回 400。如果你手上只有圖片 URL,先在服務端下載成檔案再上傳:怎麼傳兩張參考圖?OpenAI SDK 為什麼不行?
怎麼傳兩張參考圖?OpenAI SDK 為什麼不行?
第二張圖的欄位名要寫成 OpenAI SDK 的
image2:client.images.edit(image=[f1, f2]) 會把兩張圖都發成 image[] 欄位,本系列不接受同名多檔案,會返回 400。單圖編輯用 SDK 沒問題。支援 mask 局部重繪嗎?
支援 mask 局部重繪嗎?
不支援,帶
mask 欄位會返回 400。局部修改請直接在提示詞裡描述修改範圍,例如「只把茶壺改成藍色,其餘部分完全保持不變」——實測本模型對這類約束的遵循度很高。能在 Cherry Studio / LobeChat 裡用嗎?
能在 Cherry Studio / LobeChat 裡用嗎?
不建議。 這類對話客戶端走的是
/v1/chat/completions,本系列在該端點返回 404。請使用支援 OpenAI Images API 的工具,或按本文件的程式碼示例直接呼叫。一次能出幾張?
一次能出幾張?
文生圖介面固定 1 張,
n 傳多少都只返回 1 張、只收 1 張的錢。需要多張請併發多次請求。編輯介面的 n 有效,n=2 返回 2 張、按 2 張計費。usage 裡的 token 數能用來核對賬單嗎?
usage 裡的 token 數能用來核對賬單嗎?
不能。 響應體的
usage.prompt_tokens 恆為 1000 × 張數、output_tokens 恆為 0,是佔位值。本系列按張固定計費,真實扣費請以 API易 控制台的賬單記錄為準。內容稽核嚴嗎?被攔了是什麼樣?
內容稽核嚴嗎?被攔了是什麼樣?
本系列走微軟官方的內容安全策略,稽核較嚴格:真人名人、暴力血腥、知名 IP 角色(如迪士尼)、裸露內容都會被攔截。被攔時返回
400 content_safety_violation,錯誤資訊裡帶具體原因。提示詞類攔截通常 5–8 秒內返回;少數情況是出圖後才攔截,耗時接近正常出圖。重試同樣的提示詞無效,請調整表述。支援流式輸出嗎?
支援流式輸出嗎?
不支援。 請按普通同步請求呼叫,等待完整響應返回。
呼叫返回 503 no available channels?
呼叫返回 503 no available channels?
最常見的原因是模型名大小寫寫錯。模型名必須嚴格寫成
MAI-Image-2.6 或 MAI-Image-2.6-Flash,寫成 mai-image-2.6-flash 會返回 503。相關文件
- MAI-Image 2.6 文生圖 API - 帶 Playground 的介面參考
- MAI-Image 2.6 圖片編輯 API - 參考圖編輯與雙圖融合
- 圖片 API 呼叫須知與最佳實踐 - 超時、斷連、壓縮通用建議
- 充值加贈活動