Skip to main content

概述

MAI-Image 2.6 是微軟 AI(Microsoft AI)自研的影像生成模型,2026-09-04 釋出、在 Microsoft Foundry 公開預覽。釋出時在 Arena 榜單上文生圖與圖片編輯均排第 2,在 Artificial Analysis 榜單上圖片編輯排第 1(資料截至 2026-09-04,來源:微軟官方公告)。 API易 通過微軟官方渠道(官轉)提供兩個型號,共用同一套介面與引數:
  • MAI-Image-2.6:旗艦版,追求畫質與精度
  • MAI-Image-2.6-Flash:快速版,官方稱出圖速度是 GPT-Image-2-Medium 的 2.8 倍,適合高吞吐的生產場景
核心亮點:中文文字渲染出色(招牌、對聯、手寫體都能逐字正確),編輯保真度高(只改指定部分、其餘畫素級保留),width + height 自定義任意畫幅(最高 1536×1536 面積),按次固定計費、不區分尺寸。1024×1024 出圖 Flash 約 17 秒、2.6 約 30 秒。
📌 上手前必看的三條
  1. 只支援兩個端點:/v1/images/generations(文生圖,JSON)和 /v1/images/edits(編輯,multipart/form-data)。不支援 /v1/chat/completions 和 /v1/responses,發過去會返回 404。
  2. 不要傳 response_format、seed、negative_prompt——這三個引數會直接返回 400。返回值固定是 data[0].b64_json(PNG)。
  3. 尺寸用 width + height,不用 size。文生圖介面傳 size 會被靜默忽略,結果恆為 1024×1024。
圖片 API 全部為同步呼叫:沒有非同步任務 ID,客戶端斷開連線結果即丟失、但請求仍會計費。請為本模型設定足夠大的 timeout,詳見 圖片 API 呼叫須知與最佳實踐。

文生圖 API

輸入文本提示詞生成圖片,帶互動式 Playground 線上除錯。

圖片編輯 API

上傳參考圖 + 編輯指令生成新圖,支援雙圖融合,帶 Playground。

讓 AI Agent 幫你接入

在用 Codex / Claude Code / Cursor 開發的話,把下面這段提示詞複製給它。它會先抓本頁的純文本版(任意文件頁地址後加 .md),再按你專案的技術棧寫程式碼——超時、三個會 400 的引數、width/height 取代 size、編輯介面只認檔案上傳這幾個高頻坑已經寫死在要求裡。

讓程式設計 Agent 接入或排查 MAI-Image 2.6 的文生圖與圖片編輯。複製後直接貼上給 Codex、Claude Code、Cursor 等。

為什麼選 API易 的 MAI-Image 2.6

微軟官方渠道

官轉接入,模型與微軟 Foundry 上的同名模型一致。走標準 /v1/images/generations 與 /v1/images/edits,響應結構與 OpenAI Images API 一致。

按次計費 · 成本可預測

原廠按 token 計費、圖越大越貴;API易 按張固定價、不區分尺寸,從 768×768 到 1536×1536 同價,預算可精確到張。

全球零門檻接入

無需 Azure 賬號與海外伺服器,國內機房、家寬網路、海外節點均可直連 api.apiyi.com,一個 Key 調所有模型。

模型生態齊全

影像側還有 GPT-Image-2、Nano Banana 2、Seedream、FLUX 可按場景組合。

核心特性

中文文字渲染

中文招牌、豎排對聯、黑板手寫都能逐字正確,適合海報、電商主圖、文創物料

高保真編輯

「把茶壺改成鈷藍釉」只改茶壺,尺寸標註、其它物件畫素級保留

自定義畫幅

width + height 任意組合,最長邊可到 3072(如 3072×768 橫幅),面積上限 1536×1536

雙檔速度

1024×1024 出圖 Flash 約 17 秒、2.6 約 30 秒;10 併發下延遲穩定

實測效果

中文文字渲染(MAI-Image-2.6-Flash,提示詞要求招牌寫「API易 歡迎」):招牌、燈籠、豎排對聯、黑板手寫全部是可讀的中文。
MAI-Image-2.6-Flash 中文文字渲染示例:古風茶館招牌寫著 API易 歡迎
參考圖編輯(MAI-Image-2.6-Flash,指令「把茶壺改成深鈷藍釉,其餘完全不變」):左為原圖,右為結果。只有茶壺變色,尺寸標註與其它物件保持不變。
MAI-Image-2.6-Flash 編輯示例:茶壺從米白改為鈷藍,其餘不變

模型定價

模型價格可能調整;上表僅供參考,具體以頂部導航「模型價格」欄目為準:模型價格。
計費說明
  • 按張計費、不區分尺寸:768×768 與 1536×1536 同價;提示詞長短不影響價格。
  • 編輯與文生圖同價:單圖編輯、雙圖融合都是一次一張的價格;編輯介面傳 n=2 按 2 張計費。
  • 被攔截或引數錯誤的請求(400)不出圖。
  • 響應體裡的 usage 不能用來核賬:prompt_tokens 恆為 1000 × 張數,是佔位值,真實扣費以控制台賬單為準。
  • 可疊加 充值加贈活動。

分組與令牌

本系列在 Default 預設分組,新建令牌即可直接呼叫,無需申請。
令牌「計費模式」:選 按量優先 或 按次計費 都能正常呼叫本系列。推薦 按量優先,同一把令牌還能相容站內其它按 token 計費的模型。速率:單個 Key 建議控制在 50 RPM 以內;有大批量出圖需求請提前聯絡客服報備。

技術規格

端點一覽

❌ 不支援對話端點/v1/chat/completions 與 /v1/responses 對本系列返回 404 Requested path is not found。Cherry Studio、LobeChat 這類對話式客戶端會對模型列表裡的所有模型發 chat 請求,請不要在這類客戶端裡選用 MAI-Image,改用支援 Images API 的工具或自己寫程式碼呼叫。
✅ 編輯介面只認 multipart 檔案上傳傳送 JSON(image 填 URL、data URI 或裸 base64)到 /v1/images/edits 會返回 400:
請用 -F "[email protected]" 直接上傳本地檔案,不需要圖床。完整示例見 圖片編輯 API。
主域名 https://api.apiyi.com,備用域名 https://b.apiyi.com。

關鍵引數詳解

width 與 height(輸出尺寸)

常用畫幅參考(都在面積上限內):
size 的行為在兩個端點上不一樣:文生圖介面傳 size 會被靜默忽略(恆出 1024×1024),編輯介面傳 size 卻會生效。為了避免混淆,兩個端點都統一用 width + height。

n(張數)

  • 文生圖:n 無效,傳 2、4、10 都只返回 1 張(也只收 1 張的錢)。需要多張請併發多次請求。
  • 編輯:n 有效,n=2 返回 2 張、按 2 張計費。

最佳實踐

1

按場景選型號

批量出圖、對延遲敏感 → MAI-Image-2.6-Flash;海報主視覺、複雜構圖、對畫質要求高 → MAI-Image-2.6。兩者引數完全一致,切換隻改模型名。
2

中文文字寫進引號

要在圖裡出現的中文,用引號括起來並說明位置,例如:招牌上寫「API易 歡迎」。模型對引號內文字的還原度很高。
3

編輯時明確寫「其餘保持不變」

編輯指令寫成「把茶壺改成鈷藍釉,其餘部分完全保持不變」,能最大限度保留原圖。
4

改畫幅會重新構圖

編輯時傳與原圖不同比例的 width / height,模型會重新排布畫面而不是裁切或留白。只想改局部時不要傳尺寸,輸出會按原圖比例貼合到 16 的倍數(如 1344×756 輸入 → 1360×768 輸出)。
5

多張圖就併發請求

文生圖一次只出一張,要 4 張就併發 4 個請求。實測 10 併發延遲與單發基本一致。

錯誤碼與重試

客戶端建議:上表中的 4xx / 500 都是確定性錯誤,重試沒有意義,應直接告警。只有網路層超時和 429 值得重試,建議指數退避、最多 3 次——但注意超時斷開的請求仍會計費,先加大 timeout。

常見問題

本系列只返回 b64_json 一種格式,不接受 response_format 引數,傳 "b64_json" 也一樣報 400 Invalid parameters: response_format。從 gpt-image / DALL·E 遷移過來的程式碼往往顯式寫了這個引數,刪掉即可,返回值依然在 data[0].b64_json。seed 和 negative_prompt 同理。
文生圖介面不認 size,會靜默忽略並按預設 1024×1024 出圖。請改成 "width": 1536, "height": 1024。編輯介面的 size 反而能生效,但為了兩邊寫法統一,建議都用 width + height。
不能。 編輯介面只接受 multipart/form-data 檔案上傳,image 填 URL、data URI 或 base64 字串都會返回 400。如果你手上只有圖片 URL,先在服務端下載成檔案再上傳:
第二張圖的欄位名要寫成 image2:
OpenAI SDK 的 client.images.edit(image=[f1, f2]) 會把兩張圖都發成 image[] 欄位,本系列不接受同名多檔案,會返回 400。單圖編輯用 SDK 沒問題。
不支援,帶 mask 欄位會返回 400。局部修改請直接在提示詞裡描述修改範圍,例如「只把茶壺改成藍色,其餘部分完全保持不變」——實測本模型對這類約束的遵循度很高。
不建議。 這類對話客戶端走的是 /v1/chat/completions,本系列在該端點返回 404。請使用支援 OpenAI Images API 的工具,或按本文件的程式碼示例直接呼叫。
文生圖介面固定 1 張,n 傳多少都只返回 1 張、只收 1 張的錢。需要多張請併發多次請求。編輯介面的 n 有效,n=2 返回 2 張、按 2 張計費。
不能。 響應體的 usage.prompt_tokens 恆為 1000 × 張數、output_tokens 恆為 0,是佔位值。本系列按張固定計費,真實扣費請以 API易 控制台的賬單記錄為準。
本系列走微軟官方的內容安全策略,稽核較嚴格:真人名人、暴力血腥、知名 IP 角色(如迪士尼)、裸露內容都會被攔截。被攔時返回 400 content_safety_violation,錯誤資訊裡帶具體原因。提示詞類攔截通常 5–8 秒內返回;少數情況是出圖後才攔截,耗時接近正常出圖。重試同樣的提示詞無效,請調整表述。
不支援。 請按普通同步請求呼叫,等待完整響應返回。
最常見的原因是模型名大小寫寫錯。模型名必須嚴格寫成 MAI-Image-2.6 或 MAI-Image-2.6-Flash,寫成 mai-image-2.6-flash 會返回 503。

相關文件