> ## Documentation Index
> Fetch the complete documentation index at: https://docs.apiyi.com/llms.txt
> Use this file to discover all available pages before exploring further.

# 當下熱門模型（保持更新）

> 檢視支援的400+AI模型詳細資訊，推薦給你當下熱門、好用的 AI 大模型。

API易 支援 300+ 主流 AI 模型，本頁面提供詳細的模型資訊、定價和使用說明。

<Note>
  **企業級專業穩定的AI大模型API中轉站**\
  本站均為官方源頭轉發，價格八折（疊加充值加贈和匯率優勢），聚合各種優秀大模型。不限速，不過期，不懼封號，按量計費，長期可靠服務。
</Note>

## 🔥 當前推薦模型

以下為當前穩定供給的熱門模型，完整模型列表和即時價格請訪問 [API易控制台定價頁面](https://www.apiyi.com/account/pricing)。

<Warning>
  **模型升級建議**：我們推薦優先使用最新模型以獲得最佳效能，但請注意：

  1. **上線初期可能不穩定**：新模型剛釋出時，原廠商算力可能不足，導致響應慢、超時或偶發錯誤，通常數天至數週後趨於穩定
  2. **注意引數相容性**：新模型可能新增或變更引數（如 `max_completion_tokens` 替代 `max_tokens`），升級前請檢查 API 引數是否相容老模型
  3. **務必先測試再上線**：在將新模型用於生產環境前，務必在測試環境充分驗證，確保輸出品質和介面相容性符合預期
</Warning>

## 模型分類

### 🤖 OpenAI 系列

#### 🆕 最新模型

| 模型名稱                 | 模型ID            | 上下文長度 | 特點                                                                      | 推薦場景          |
| -------------------- | --------------- | ----- | ----------------------------------------------------------------------- | ------------- |
| **GPT-5.5 Pro**      | `gpt-5.5-pro`   | 1M    | 當前最強推理，Terminal-Bench 2.0 82.7%；**僅 `/v1/responses` 端點 + SVIP 分組**，價格高昂 | 頂級推理、科研（專業需求） |
| **GPT-5.5** 🔥       | `gpt-5.5`       | 1M    | SWE-bench Verified 88.7%，幻覺率較 5.4 降 60%，新增 `xhigh` 推理檔                  | 複雜智慧體、專業工作流   |
| **GPT-5.4**          | `gpt-5.4`       | 1M    | 原生計算機操控，GDPval 83%                                                      | 複雜智慧體、專業工作流   |
| **chat-latest**      | `chat-latest`   | 400K  | 去版本號別名，始終指向最新 ChatGPT Instant（當前 GPT-5.5 Instant）                       | 快速寫作、對話       |
| **GPT-5.2**          | `gpt-5.2`       | 400K  | GDPval 70.9% 超越專業人士                                                     | 程式設計規劃、結構化任務  |
| **GPT-5.3 Codex** 🔥 | `gpt-5.3-codex` | 128K  | SWE-Bench Pro SOTA，複雜程式設計與智慧體任務                                         | 複雜程式設計、智慧體任務  |
| **GPT-5.1**          | `gpt-5.1`       | 128K  | 智慧與速度平衡，SWE-bench 76.3%，24h 快取                                          | 綜合應用、程式設計     |

<Warning>
  **GPT Pro 系列（如 `gpt-5.5-pro`、`gpt-5-pro`）使用須知**：

  1. **僅支援 `/v1/responses` 端點**：不能走 `/v1/chat/completions`，呼叫前請確認 SDK / 程式碼已切換到 Responses API
  2. **價格高昂**：單次呼叫可能消耗數美金，且僅對 SVIP 分組開放，避免 Default 分組誤用
  3. **非專業需求不建議使用**：日常任務用 GPT-5.5 / GPT-5.4 即可，Pro 僅適合對推理深度有極致要求的科研、頂級任務
</Warning>

#### ✅ 穩定/經典系列

| 模型名稱             | 模型ID           | 上下文長度 | 特點               | 推薦場景         |
| ---------------- | -------------- | ----- | ---------------- | ------------ |
| **GPT-5** ⭐      | `gpt-5`        | 128K  | 旗艦穩定版，超強推理能力     | 頂級推理、複雜任務    |
| **GPT-5 Mini**   | `gpt-5-mini`   | 128K  | GPT-5 輕量版，效能優異   | 平衡效能與成本      |
| **GPT-5 Nano**   | `gpt-5-nano`   | 128K  | GPT-5 超輕量版       | 大批次處理        |
| **o3** ⭐         | `o3`           | 200K  | 推理模型，已大幅降價，價效比極高 | 複雜推理、數學、程式設計 |
| **o4-mini**      | `o4-mini`      | 200K  | 輕量級推理模型          | 程式設計任務首選     |
| **GPT-4.1** ⭐    | `gpt-4.1`      | 128K  | 速度快，主力模型之一       | 綜合應用         |
| **GPT-4.1 Mini** | `gpt-4.1-mini` | 128K  | 更便宜的輕量版本         | 成本敏感場景       |
| **GPT-4o**       | `gpt-4o`       | 128K  | 綜合能力平衡，多模態支援     | 通用場景         |
| **GPT-4o Mini**  | `gpt-4o-mini`  | 128K  | 輕量快速版本           | 快速響應         |

<Warning>
  **GPT-5 系列使用注意事項**：

  1. 溫度引數 `temperature` 必須設定為 1（只支援 1）
  2. 使用 `max_completion_tokens` 替代 `max_tokens`
  3. 不要傳遞 `top_p` 引數
</Warning>

<Info>
  **影像和影片生成模型**已移至專屬頁面，請訪問 [影像與影片生成模型](/zh-Hant/api-capabilities/image-video-models) 檢視完整列表和定價。
</Info>

### 🎭 Claude 系列 (Anthropic)

#### 🆕 最新模型

| 模型名稱                            | 模型ID                       | 上下文長度     | 特點                                                | 推薦場景         |
| ------------------------------- | -------------------------- | --------- | ------------------------------------------------- | ------------ |
| **Claude Opus 4.7** 🔥          | `claude-opus-4-7`          | 1M (Beta) | 程式設計基準較 4.6 +13%，生產任務 3 倍，工具錯誤降至 1/3，新增 xhigh 推理檔 | 頂級程式設計、複雜智慧體 |
| **Claude Opus 4.7 Thinking** 🔥 | `claude-opus-4-7-thinking` | 1M (Beta) | 自適應思維鏈，深度推理增強                                     | 頂級推理任務       |
| **Claude Opus 4.6**             | `claude-opus-4-6`          | 1M (Beta) | Terminal-Bench 2.0 登頂，128K 輸出                     | 頂級程式設計、複雜智慧體 |
| **Claude Sonnet 4.6** 🔥        | `claude-sonnet-4-6`        | 1M (Beta) | 全面升級，效能媲美 Opus 4.5，價效比極高                          | 程式設計首選、智慧體開發 |

#### ✅ 穩定/經典系列

| 模型名稱                           | 模型ID                                  | 上下文長度 | 特點                              | 推薦場景        |
| ------------------------------ | ------------------------------------- | ----- | ------------------------------- | ----------- |
| **Claude Opus 4.5** ⭐          | `claude-opus-4-5-20251101`            | 200K  | SWE-bench 80.9%，價格降至前代 1/3      | 複雜程式設計、頂級推理 |
| **Claude Sonnet 4.5** ⭐        | `claude-sonnet-4-5-20250929`          | 200K  | 世界級編碼模型，SWE-bench 77.2%         | 程式碼生成、智慧體開發 |
| **Claude Sonnet 4.5 Thinking** | `claude-sonnet-4-5-20250929-thinking` | 200K  | 思維鏈模式，深度推理                      | 複雜程式設計推理任務  |
| **Claude Haiku 4.5** ⭐         | `claude-haiku-4-5-20251001`           | 200K  | 高性價比編碼模型，SWE-bench 73.3%，速度 2 倍 | 即時聊天、結對程式設計 |
| **Claude 4 Sonnet**            | `claude-sonnet-4-20250514`            | 200K  | 穩定版本，程式設計首選                     | 程式碼生成、分析    |
| **Claude Opus 4.1**            | `claude-opus-4-1-20250805`            | 200K  | 迭代升級版，程式設計最佳化                   | 高要求程式設計任務   |

<Note>
  **最新推薦**：Claude Opus 4.7 程式設計基準較 4.6 提升 13%，工具呼叫錯誤降至 1/3，新增 xhigh 推理檔，價格持平 4.6。Sonnet 4.6 效能媲美 Opus 4.5，已成為 claude.ai 預設模型，價效比極高。**穩定首選**：Opus 4.5 和 Sonnet 4.5 經過充分驗證，適合生產環境。Haiku 4.5 速度快 2 倍，價效比高。
</Note>

### 🌟 Google Gemini 系列

#### 🆕 最新模型

| 模型名稱                          | 模型ID                     | 上下文長度 | 特點                                                  | 推薦場景         |
| ----------------------------- | ------------------------ | ----- | --------------------------------------------------- | ------------ |
| **Gemini 3.5 Flash** 🔥       | `gemini-3.5-flash`       | 1M    | Terminal-Bench 2.1 76.2% 全面反超 3.1 Pro，速度約 4 倍、價格約一半 | 程式設計首選、價效比之王 |
| **Gemini 3.1 Pro Preview** 🔥 | `gemini-3.1-pro-preview` | 1M    | ARC-AGI-2 77.1%（3 Pro 的 2 倍+），最強推理模型                | 複雜推理、多模態分析   |
| **Gemini 3 Flash Preview**    | `gemini-3-flash-preview` | 1M    | SWE-bench 78%，速度快 3 倍，含 thinking / nothinking 變體    | 程式設計、價效比     |
| **Gemini 3.1 Flash Lite** 🔥  | `gemini-3.1-flash-lite`  | 1M    | GA 版，比 2.5 Flash 快 64%，超低價                          | 高併發、大批次、低成本  |

<Warning>
  **注意**：Gemini 3 Pro Preview 已於 2026 年 3 月 9 日停止服務，請遷移至 Gemini 3.1 Pro Preview。
</Warning>

#### ✅ 穩定/經典系列

| 模型名稱                      | 模型ID                    | 上下文長度 | 特點                | 推薦場景         |
| ------------------------- | ----------------------- | ----- | ----------------- | ------------ |
| **Gemini 2.5 Pro** ⭐      | `gemini-2.5-pro`        | 2M    | 正式版，程式設計優勢，多模態能力強 | 長文本、程式設計、多模態 |
| **Gemini 2.5 Flash** ⭐    | `gemini-2.5-flash`      | 1M    | 速度快，成本低，正式版       | 快速響應場景       |
| **Gemini 2.5 Flash Lite** | `gemini-2.5-flash-lite` | 1M    | 超輕量版本，更快更便宜       | 大批次簡單任務      |

<Note>
  **最新推薦**：Gemini 3.5 Flash 在 Terminal-Bench 2.1、MCP Atlas 等基準全面反超 Gemini 3.1 Pro，速度約 4 倍、價格約一半，是當前程式設計價效比之王。Gemini 3.1 Pro Preview 推理能力翻倍（ARC-AGI-2 77.1%），是谷歌最先進推理模型。Gemini 3.1 Flash Lite 已轉 GA，是最便宜的前沿模型，適合高併發場景。**穩定首選**：Gemini 2.5 Pro（2M 超長上下文）和 Gemini 2.5 Flash 已正式釋出，適合生產環境。
</Note>

### 🚀 xAI Grok 系列

#### 🆕 最新模型

| 模型名稱                         | 模型ID                    | 上下文長度 | 特點                                                          | 推薦場景          |
| ---------------------------- | ----------------------- | ----- | ----------------------------------------------------------- | ------------- |
| **Grok 4.3** 🔥              | `grok-4.3`              | 1M    | Intelligence Index 53、τ²-Bench 98%、IFBench 81%，1M 上下文 + 多模態 | 複雜推理、綜合任務     |
| **Grok 4**                   | `grok-4`                | 標準    | 官方版本，可選 `grok-4-all` 原生聯網                                   | 綜合任務、即時資訊     |
| **Grok 4 Fast Reasoning** 🔥 | `grok-4-fast-reasoning` | 200K  | 推理模式，顯示思考過程，降價 93%+                                         | 複雜推理任務        |
| **Grok Code Fast 1** ⭐       | `grok-code-fast-1`      | 256K  | SWE-bench 70.8%，高速生成                                        | 程式碼生成、智慧體程式設計 |

#### ✅ 穩定/經典系列

| 模型名稱            | 模型ID          | 上下文長度 | 特點        | 推薦場景      |
| --------------- | ------------- | ----- | --------- | --------- |
| **Grok 3** ⭐    | `grok-3`      | 標準    | 官方穩定版本    | 日常使用      |
| **Grok 3 All**  | `grok-3-all`  | 標準    | 原生聯網增強版   | 新聞資訊、市場分析 |
| **Grok 3 Mini** | `grok-3-mini` | 標準    | 帶推理能力的小模型 | 輕量任務      |

<Info>
  **Grok Fast 系列價格優勢**：

  * 相比 Grok-4 系列降價 **93%+**
  * 輸入：\$0.20/1M tokens，輸出：\$0.50/1M tokens
  * 業界領先的價效比，適合超長上下文場景
</Info>

### 🔍 DeepSeek 系列

#### 🆕 最新模型

| 模型名稱                     | 模型ID                | 上下文長度 | 特點                                                              | 推薦場景          |
| ------------------------ | ------------------- | ----- | --------------------------------------------------------------- | ------------- |
| **DeepSeek V4 Pro** 🔥   | `deepseek-v4-pro`   | 1M    | 1.6T/49B 啟用，SWE-Verified 80.6 接近 Claude/Gemini，Hybrid Attention | 複雜推理、程式設計、智慧體 |
| **DeepSeek V4 Flash** 🔥 | `deepseek-v4-flash` | 1M    | 284B/13B 啟用，僅 \$0.14/M 輸入，開源 SOTA 價效比                           | 高併發、大批次       |
| **DeepSeek V3.2**        | `deepseek-v3.2`     | 128K  | 效能比肩 GPT-5，工具呼叫融入推理                                             | 複雜推理、程式設計     |

#### ✅ 穩定/經典系列

| 模型名稱                | 模型ID                   | 上下文長度 | 特點                         | 推薦場景      |
| ------------------- | ---------------------- | ----- | -------------------------- | --------- |
| **DeepSeek V3.1** ⭐ | `deepseek-v3-1-250821` | 128K  | 混合推理模式，Think/Non-Think 雙模式 | 智慧推理、程式設計 |
| **DeepSeek R1**     | `deepseek-r1`          | 64K   | 推理模型                       | 數學、推理     |
| **DeepSeek V3**     | `deepseek-v3`          | 128K  | 綜合能力強                      | 通用場景      |

### 🐘 國產模型系列

#### 智譜 AI (GLM)

**🆕 最新**：GLM-5.1 | **✅ 穩定/經典**：GLM-5、GLM-4.6

| 模型名稱           | 模型ID      | 上下文長度 | 特點                                                                        | 推薦場景        |
| -------------- | --------- | ----- | ------------------------------------------------------------------------- | ----------- |
| **GLM-5.1** 🔥 | `glm-5.1` | 200K  | SWE-Bench Pro 58.4 擊敗 GPT-5.4 / Opus 4.6 / Gemini 3.1 Pro，744B MoE，MIT 開源 | 複雜程式設計、智慧體  |
| **GLM-5** ⭐    | `glm-5`   | 200K  | 744B 引數（40B 啟用），程式設計對齊 Claude Opus 4.5，開源                                 | 複雜程式設計、系統工程 |
| **GLM-4.6**    | `glm-4.6` | 200K  | 程式碼與推理增強版，穩定可靠                                                            | 程式設計、推理、智慧體 |
| **GLM-4.5**    | `glm-4.5` | 128K  | 標準版本，綜合能力強                                                                | 通用場景        |

<Info>
  **GLM-5.1 特性**：

  * 744B MoE 引數，支援 8 小時長程智慧體任務
  * SWE-Bench Pro 58.4，開源模型中程式設計能力最強
  * MIT 協議開源，價效比極高
</Info>

#### 阿里通義千問 (Qwen)

**🆕 最新**：Qwen3.7-Max | **✅ 穩定/經典**：Qwen Max、Plus、Turbo

| 模型名稱               | 模型ID          | 上下文長度 | 特點                                                      | 推薦場景        |
| ------------------ | ------------- | ----- | ------------------------------------------------------- | ----------- |
| **Qwen3.7-Max** 🔥 | `qwen3.7-max` | 1M    | AA Intelligence Index 56.6 全球前五、國產第一，agent 長程 35 小時自主任務 | 智慧體、多語言、長文本 |
| **Qwen Max** ⭐     | `qwen-max`    | 32K   | 最強穩定版本                                                  | 綜合任務        |
| **Qwen Plus**      | `qwen-plus`   | 32K   | 增強版本                                                    | 價效比場景       |
| **Qwen Turbo**     | `qwen-turbo`  | 32K   | 快速版本                                                    | 低延遲場景       |

#### Moonshot Kimi 系列

**🆕 最新**：Kimi K2.6 | **✅ 穩定/經典**：Kimi K2.5、K2

| 模型名稱              | 模型ID             | 上下文長度 | 特點                                                       | 推薦場景     |
| ----------------- | ---------------- | ----- | -------------------------------------------------------- | -------- |
| **Kimi K2.6** 🔥  | `kimi-k2.6`      | 256K  | 1T MoE / 32B 啟用，SWE-Bench Pro 58.6 反超 GPT-5.4 與 Opus 4.6 | 程式設計、智慧體 |
| **Kimi K2.5**     | `kimi-k2.5`      | 200K  | 原生多模態，Agent Swarm 100 智慧體協作                              | 多模態、智慧體  |
| **Kimi K2 正式版** ⭐ | `kimi-k2-250711` | 200K  | 火山引擎官方合作，穩定性強                                            | 生產環境     |

### 🌐 MiniMax 系列

**🆕 最新**：MiniMax M2.7 | **✅ 穩定/經典**：MiniMax M2.5

| 模型名稱                | 模型ID           | 上下文長度 | 特點                                             | 推薦場景           |
| ------------------- | -------------- | ----- | ---------------------------------------------- | -------------- |
| **MiniMax M2.7** 🔥 | `MiniMax-M2.7` | 標準    | 10B 引數 SWE-bench Pro 56.22%，自進化能力，最小 Tier-1 模型 | 程式設計、智慧體       |
| **MiniMax M2.5**    | `minimax-m2.5` | 標準    | 230B（10B 啟用），SWE-bench 80.2%，極致價效比             | 程式設計、智慧體、辦公自動化 |

<Info>
  **MiniMax M2.7 特性**：

  * 僅 10B 引數即達 SWE-bench Pro 56.22%，最小的 Tier-1 模型
  * 具備自進化能力，標準版 \$0.3 / highspeed 版（`MiniMax-M2.7-highspeed`）\$0.6 每百萬輸入 tokens
  * 模型權重已開源
</Info>

## 💰 定價說明

### 計費方式

* **按量計費**：根據實際使用的 Token 數量計費
* **無最低消費**：充多少用多少，餘額永不過期
* **即時扣費**：每次呼叫後立即從餘額扣除費用

### 價格優勢

* 官方源頭轉發，價格略有優勢
* 批次使用可聯絡客服獲取更優惠價格
* 新使用者註冊送 300萬 Token 測試額度

### 檢視即時價格

訪問 [API易控制台定價頁面](https://www.apiyi.com/account/pricing) 檢視所有模型的最新價格。

## 🛠️ 使用建議

### 模型選擇指南

**程式設計開發**

* 頂級效能：Claude Opus 4.7（程式設計基準較 4.6 +13%）、GPT-5.5（SWE-bench 88.7%）、Claude Sonnet 4.6（媲美 Opus 4.5）
* 高性價比：Gemini 3.5 Flash（全面反超 3.1 Pro，價格約一半）、GLM-5.1（SWE-Bench Pro 58.4）、Kimi K2.6、DeepSeek V4 Flash
* 備選：DeepSeek V4 Pro、Qwen3.7-Max、MiniMax M2.7、o4-mini

**文本創作**

* 首選：GPT-5.5、GPT-5.4、Gemini 3.1 Pro Preview、Claude Opus 4.7、Claude Sonnet 4.6
* 備選：chat-latest、Claude Sonnet 4.5、GPT-4.1、GPT-4o、Claude Haiku 4.5、GLM-4.6

**快速響應**

* 首選：Gemini 3.5 Flash（約 4 倍速度）、Claude Haiku 4.5（速度快 2 倍）、GPT-4o Mini
* 備選：Gemini 3.1 Flash Lite、Gemini 2.5 Flash、Grok 4 Fast、GPT-4.1 Mini

**影像生成**

* 最新推薦：GPT Image 1.5（速度提升 4 倍，精準編輯，低 \$0.01 起）
* 專業設計：SeeDream 4.5（12 億引數，4K 畫質，\$0.035/張）、Nano Banana Pro（4K 高畫質，最佳文本渲染）
* 高性價比：Nano Banana 正式版（10 種寬高比，\$0.025/張）、SeeDream 4.0（\$0.025/張）
* 逆向、價格最便宜：sora\_image、gpt-4o-image

**影片生成**

* 首選：Sora 2 系列（音影片同步，無水印，\$0.15/次起）
* 豎屏：sora\_video2，橫屏：sora\_video2-landscape，高畫質：sora-2-pro

**長文本處理**

* 超長上下文：Gemini 2.5 Pro（2M）、Grok 4 Fast 系列（200K）、Grok Code Fast 1（256K）
* 程式設計場景：GLM-4.6（200K）、Claude 4 系列（200K）、Kimi K2（200K）

**聯網搜尋**

* 原生聯網：Grok 4 All、Grok 3 All（無需工具呼叫）
* 適合場景：即時資訊、新聞資訊、市場動態分析

### 成本最佳化建議

1. **分級使用**：簡單任務用便宜模型，複雜任務用高階模型
2. **測試最佳化**：先用小模型測試，確定需求後再用大模型
3. **批次處理**：大量相似任務可以選擇 Nano 或 Mini 版本
4. **快取複用**：對重複查詢結果進行快取

## 🔗 相關資源

* [模型對比測試](https://imagen.apiyi.com/) - 影像生成效果對比
* [即時價格查詢](https://www.apiyi.com/account/pricing) - 最新定價資訊
* [API 文件](/zh-Hant/api-manual) - 詳細介面說明
* [快速開始](/zh-Hant/getting-started) - 整合指南

<Note>
  模型列表持續更新中，我們會及時新增最新發布的優秀模型。如需使用特定模型或有批次需求，請聯絡客服。
</Note>
