Skip to main content
API易 支援 400+ 主流 AI 模型,本頁面提供詳細的模型資訊、定價和使用說明。
企業級專業穩定的AI大模型API中轉站
本站均為官方源頭轉發,價格八折(疊加充值加贈和匯率優勢),聚合各種優秀大模型。不限速,不懼封號,按量計費,長期可靠服務。

🔥 當前推薦模型

以下為當前穩定供給的熱門模型,完整模型列表和即時價格請訪問 API易控制台定價頁面,也可檢視站內 模型價格總覽
模型升級建議:我們推薦優先使用最新模型以獲得最佳效能,但請注意:
  1. 上線初期可能不穩定:新模型剛釋出時,原廠商算力可能不足,導致響應慢、超時或偶發錯誤,通常數天至數週後趨於穩定
  2. 注意引數相容性:新模型可能新增或變更引數(如 max_completion_tokens 替代 max_tokens),升級前請檢查 API 引數是否相容老模型
  3. 務必先測試再上線:在將新模型用於生產環境前,務必在測試環境充分驗證,確保輸出品質和介面相容性符合預期
表格中上下文一欄標註為「—」的,表示廠商暫未公佈明確數值,實際以控制台與官方文件為準。價格均為每 100 萬 tokens 掛牌價,可疊加充值加贈優惠。

模型分類

🤖 OpenAI 系列

🆕 最新模型

GPT-5.6 雙分組供給:預設官轉分組(default / svip)與官網同價,充值最多贈 20%(約 83 折);CodexReverse 分組預設 0.7 折扣,適合成本敏感的批次任務。存量 GPT-5.5 程式碼只需替換 model 欄位即可遷移。詳見 GPT-5.6 系列上線說明
GPT Pro 系列(如 gpt-5.5-progpt-5.4-pro)使用須知
  1. 僅支援 /v1/responses 端點:不能走 /v1/chat/completions,呼叫前請確認 SDK / 程式碼已切換到 Responses API
  2. 價格高昂:單次呼叫可能消耗數美金,且僅對 SVIP 分組開放,避免 Default 分組誤用
  3. 非專業需求不建議使用:日常任務用 GPT-5.6 Sol / Terra 即可,Pro 僅適合對推理深度有極致要求的科研、頂級任務

✅ 穩定/經典系列

GPT-5 及以上系列使用注意事項
  1. 溫度引數 temperature 必須設定為 1(只支援 1)
  2. 使用 max_completion_tokens 替代 max_tokens
  3. 不要傳遞 top_p 引數
影像和影片生成模型已移至專屬頁面,請訪問 影像與影片生成模型 檢視完整列表和定價。

🎭 Claude 系列 (Anthropic)

🆕 最新模型

Fable 5 / Mythos 5 的 30 天資料保留合規:因模型能力先進,Bedrock 與 Anthropic 對高風險濫用執行額外檢查,這兩款模型的輸入與輸出將保留 30 天用於嚴重濫用檢測,預設僅自動化安全系統訪問,人工審查僅在系統標記潛在危害時發生。保留髮生在 AWS / Anthropic 官方側,API易 為純透明代理、自身不保留資料;其他 Claude 模型不受影響。詳見 Fable 5 上線說明

✅ 穩定/經典系列

最新推薦:Claude Opus 5 智慧逼近 Fable 5,但價格只有一半($5/$25,與 Opus 4.8 持平),屬於”無痛升級”。Sonnet 5 官方稱”迄今最具 Agentic 能力的 Sonnet”,效能逼近 Opus 4.8 而更快更省。穩定首選:Opus 4.7 / Sonnet 4.6 經過充分驗證,適合已上線的生產工作流;Haiku 4.5 速度快 2 倍、價效比高。

🌟 Google Gemini 系列

🆕 最新模型

注意:Gemini 3 Pro Preview 已於 2026 年 3 月 9 日停止服務,請遷移至 Gemini 3.1 Pro Preview 或 Gemini 3.6 Flash。

✅ 穩定/經典系列

最新推薦:Gemini 3.6 Flash 與 3.5 Flash-Lite 已完成 Gemini 原生格式 + OpenAI 相容格式各 30+ 用例的雙端點實測,原生工具全部放通,接入前建議先看 3.6 Flash 概覽3.5 Flash-Lite 概覽穩定首選:Gemini 2.5 Pro(2M 超長上下文)和 Gemini 2.5 Flash 適合已定型的生產環境。

🚀 xAI Grok 系列

🆕 最新模型

✅ 穩定/經典系列

Grok 4.5 的 token 效率優勢:SWE Bench Pro 上平均輸出僅 15,954 tokens,約為 Opus 4.8 (max) 的 1/4.2,任務步數減半,同任務實際花費顯著更低。注意超過 200K tokens 的高上下文請求按官方更高費率計費。

🔍 DeepSeek 系列

🐘 國產模型系列

智譜 AI (GLM)

🆕 最新:GLM-5.2 | ✅ 穩定/經典:GLM-5.1、GLM-5、GLM-4.6
GLM-5.2 特性
  • 上下文由 GLM-5.1 的 200K 躍升至 1M tokens,可一次載入專案級程式碼與多份長文件
  • 744B MoE,Terminal-Bench 2.1 81.0 / SWE-bench Pro 62.1,長程程式設計基準開源領先
  • 經阿里雲官方授權直連,價格對齊官網(按 1:7 固定匯率折算),疊加充值活動約官網 85 折
  • 長任務建議把 timeout 調到 600 秒以上,詳見 GLM-5.2 上線說明

阿里通義千問 (Qwen)

🆕 最新:Qwen3.7-Max | ✅ 穩定/經典:Qwen3.6 系列、Qwen Max / Plus / Turbo

Moonshot Kimi 系列

🆕 最新:Kimi K3 | ✅ 穩定/經典:Kimi K2.6、K2.5、K2
Kimi K3 使用要點
  • 精確 1,048,576 tokens 上下文,全區間統一計價,長程式碼庫 / 長文件可整體塞入,不擔心跨檔漲價
  • 最大輸出預設 131,072、最高可調至 1,048,576 tokens;思考模式常開滿檔,請預留輸出預算
  • 自動上下文快取,命中部分輸入按 $0.30/1M 計費(未命中價的 1/10),多輪對話收益顯著

字節跳動 Seed 系列

🆕 最新:Seed 2.1 Turbo | ✅ 穩定/經典:Seed 2.0 Pro / Lite / Mini
Seed 2.1 Turbo 預設開啟深度思考:不傳任何引數時,一句話的簡單問題也會先輸出數百 tokens 的思考內容(實測一句話自我介紹消耗 444 輸出 tokens,其中思考 409),且思考內容按輸出 tokens 正常計費。高頻短問答請把 thinking: {"type": "disabled"} 作為基線配置。詳見 接入文件

🌐 MiniMax 系列

🆕 最新:MiniMax-M3 | ✅ 穩定/經典:MiniMax-M2.7、M2.5
MiniMax-M3 計費說明
  • 採用階梯計費,0-512K 區間 $0.30 輸入 / $1.20 輸出(每 1M tokens),超出部分按更高檔單價計費
  • 注意模型名大小寫:MiniMax-M3(同系列 MiniMax-M2.7-highspeed 等亦區分大小寫)
  • 做百萬級長上下文任務前請預估好成本

💰 定價說明

計費方式

  • 按量計費:根據實際使用的 Token 數量計費
  • 無最低消費:充多少用多少
  • 餘額有效期:自充值之日起 365 天內有效,再次充值自動重置(詳見充值活動說明
  • 即時扣費:每次呼叫後立即從餘額扣除費用

價格優勢

  • 官方源頭轉發,價格略有優勢
  • 批次使用可聯絡客服獲取更優惠價格
  • 新使用者註冊後賬號自帶 $0.05 試用額度,可直接跑通接入驗證

檢視即時價格

訪問 API易控制台定價頁面 檢視所有模型的最新價格,或檢視站內 模型價格總覽

🛠️ 使用建議

模型選擇指南

程式設計開發
  • 頂級效能:Claude Opus 5(智慧逼近 Fable 5、價格一半)、GPT-5.6 Sol(Terminal-Bench 2.1 88.8%)、Claude Sonnet 5(SWE-bench 85.2%)、Kimi K3
  • 高性價比:GPT-5.6 Terra(GPT-5.5 級效能價格減半)、Gemini 3.6 Flash、GLM-5.2、MiniMax-M3、DeepSeek V4 Flash
  • 備選:Grok 4.5、Qwen3.7-Max、Kimi K2.6、Gemini 3.5 Flash
文本創作
  • 首選:GPT-5.6 Sol / Terra、Claude Opus 5、Claude Sonnet 5、Gemini 3.6 Flash
  • 備選:chat-latest、Claude Sonnet 4.6、GLM-5.2、GPT-4.1
快速響應
  • 首選:Gemini 3.5 Flash-Lite(預設零思考、約 2 秒)、Claude Haiku 4.5(速度快 2 倍)、GPT-5.6 Luna
  • 備選:Gemini 3.1 Flash Lite、Gemini 2.5 Flash、Seed 2.1 Turbo(需顯式關閉思考)
長文本處理
  • 超長上下文:Gemini 2.5 Pro(2M)、Kimi K3(1M 全區間統一計價)、MiniMax-M3(1M)、GLM-5.2(1M)、Claude Opus 5(1M)
  • 注意:部分模型超過一定長度會按更高檔階梯計費(如 Grok 4.5 超 200K、MiniMax-M3 超 512K),長任務前請預估成本
影像生成
  • 最新推薦:gpt-image-2.5-flare / gpt-image-2.5-sunburst(2026-09 上線,原生 4K、size/quality 精確控制,與 gpt-image-2 同價,速度 / 編輯精度分別更強)、Nano Banana Pro(4K 高畫質,最佳文本渲染)
  • 高性價比:Nano Banana 2($0.055/張,按量低至 $0.025)、Nano Banana Lite(約 4 秒出圖,$0.025/張)
  • 專業設計:Seedream 5.0 Pro($0.12/次,互動式編輯 + 最多 10 張參考圖)、Seedream 5.0 Lite($0.035/張)
  • 最便宜:gpt-image-2-all(官逆,$0.03/張)
影片生成
  • 官轉首選:VEO 3.1 Official(按次 $0.3 / $1.2,4/6/8 秒,原生同步音軌)
  • 國產主力:Seedance 2.5 與 2.0 系列(2.5 / 標準 / fast / mini 四檔)、Wan2.7、HappyHorse 1.1
  • 注意:Sora 2 相關通道已下線,請改用上述通道,詳見 影像與影片生成模型
聯網搜尋
  • 原生聯網:Grok 4 All、Grok 3 All(無需工具呼叫)
  • 搜尋 grounding:Gemini 3.6 Flash / 3.5 Flash-Lite(原生工具已放通)

成本最佳化建議

  1. 分級使用:簡單任務用便宜模型,複雜任務用高階模型
  2. 測試最佳化:先用小模型測試,確定需求後再用大模型
  3. 批次處理:大量相似任務可以選擇 Luna / Lite / Mini 檔位
  4. 快取複用:善用各家的上下文快取(Kimi K3、Seed 2.1 Turbo、Claude 系列命中後輸入價可低至 1/10)
  5. 關閉不必要的思考:部分模型預設開啟深度思考(如 Seed 2.1 Turbo、Gemini 3.6 Flash),高頻短問答顯式關閉可同時省錢提速

🔗 相關資源

模型列表持續更新中,我們會及時新增最新發布的優秀模型。最新上新動態請關注 網站公告。如需使用特定模型或有批次需求,請聯絡客服。