エンタープライズグレードのプロフェッショナルで安定したAI大規模モデルAPIハブ
すべてのモデルは公式ソースからの公式リレーで提供され、約20%オフの料金(チャージ特典と為替レートの優位性を組み合わせたもの)で、さまざまな優れた大規模モデルを集約しています。速度制限なし、アカウント停止リスクなし、従量課金、長期的に信頼できるサービスです。
🔥 現在おすすめのモデル
以下は、現在安定供給されている人気モデルです。完全なモデル一覧とリアルタイム価格は、APIYI コンソールの料金ページ またはサイト内の モデル料金概要 をご覧ください。コンテキスト列の「—」は、提供元が確定値を公開していないことを意味します。コンソールと公式ドキュメントをご参照ください。価格はすべて 100万 tokens あたりの定価で、チャージ特典と併用できます。
モデルカテゴリ
🤖 OpenAI シリーズ
🆕 最新モデル
GPT-5.6 のデュアルグループ供給: デフォルトの公式リレーグループ(default / svip)は公式価格と一致し、最大 20% のチャージボーナス(定価の約 83%)があります。
CodexReverse グループはデフォルトで 0.7 の割引があり、コスト重視のバッチ処理により適しています。既存の GPT-5.5 コードは model フィールドを入れ替えるだけで対応できます。GPT-5.6 のローンチノート をご覧ください。✅ 安定版 / クラシック
画像生成および動画生成モデル は専用ページに移動しました。全一覧と価格については 画像生成 & 動画生成モデル をご覧ください。
🎭 Claude シリーズ (Anthropic)
🆕 最新モデル
✅ 安定版 / クラシック
最新: Claude Opus 5 は、Opus 4.8 と同じ $5/$25 で、Fable 5 の知能に半額で迫る、負担の少ないアップグレードです。Sonnet 5 は、これまでで最もエージェント的な Sonnet とされ、Opus 4.8 に近い一方で、より高速かつ低価格です。安定版: Opus 4.7 と Sonnet 4.6 は、すでに本番ワークフローで実績のある、実戦投入済みのモデルです。Haiku 4.5 は、2倍の速度を優れたコストパフォーマンスで提供します。
🌟 Google Gemini シリーズ
🆕 最新モデル
✅ 安定版 / クラシック
最新: Gemini 3.6 Flash と 3.5 Flash-Lite は、ネイティブ Gemini 形式と OpenAI 互換形式の両方で、それぞれ30件超のテストケースを用いてエンドツーエンドで検証され、すべてのネイティブツールが有効になっています。統合前に 3.6 Flash の概要 と 3.5 Flash-Lite の概要 をお読みください。安定版: Gemini 2.5 Pro(2M コンテキスト)と Gemini 2.5 Flash は、運用が安定した本番環境に適しています。
🚀 xAI Grok シリーズ
🆕 最新モデル
✅ 安定版 / クラシック
Grok 4.5 token efficiency: SWE Bench Pro では平均出力 token が 15,954 にすぎず、Opus 4.8(最大)の約 1/4.2 です。タスク手順を半減し、同じ作業での実支出を削減します。200K tokens を超えるリクエストは、ベンダーのより高い長文コンテキスト料金で課金されることに注意してください。
🔍 DeepSeek Series
🐘 中国モデルシリーズ
Zhipu AI (GLM)
🆕 最新: GLM-5.2 | ✅ 安定版 / クラシック: GLM-5.1, GLM-5, GLM-4.6GLM-5.2 の特長:
- コンテキストが GLM-5.1 の 200K から 1M tokens に拡大し、プロジェクト規模のコードや複数の長文ドキュメントを一度に読み込めます
- 744B MoE、Terminal-Bench 2.1 81.0 / SWE-bench Pro 62.1、長期コーディングでオープンソースをリード
- Vendor と連動した価格設定の Alibaba Cloud 公式リレーに直接接続(固定 1:7 レートで換算);チャージ特典込みで定価の約85%
- 長時間タスクでは、タイムアウトを 600 秒以上に設定してください。GLM-5.2 の公開ノートをご覧ください
Alibaba Qwen
🆕 最新: Qwen3.7-Max | ✅ 安定版 / クラシック: Qwen3.6 series, Qwen Max / Plus / TurboMoonshot Kimi Series
🆕 最新: Kimi K3 | ✅ 安定版 / クラシック: Kimi K2.6, K2.5, K2Kimi K3 の利用メモ:
- コンテキストはちょうど 1,048,576 tokens で、範囲全体で一律課金です。リポジトリ全体や長文ドキュメントを、段階差を気にせずそのまま投入できます
- 最大出力は初期値で 131,072 で、1,048,576 tokens まで引き上げられます。推論は全力で動くため、出力 tokens の予算にご注意ください
- 自動コンテキストキャッシュにより、キャッシュ済み入力は $0.30/1M(未キャッシュ料金の1/10)で課金され、複数ターン会話で大きな効果があります
ByteDance Seed Series
🆕 最新: Seed 2.1 Turbo | ✅ 安定版 / クラシック: Seed 2.0 Pro / Lite / Mini🌐 MiniMax シリーズ
🆕 最新: MiniMax-M3 | ✅ 安定版 / クラシック: MiniMax-M2.7, M2.5MiniMax-M3 の課金に関する注意:
- 段階制課金: 0-512K の範囲では 1M tokens あたり入力 $0.30 / 出力 $1.20。これを超える部分はより高い料金帯で課金されます
- モデル名は大文字・小文字を区別します:
MiniMax-M3(MiniMax-M2.7-highspeedのような兄弟モデルも同様です) - 100万 token 規模のコンテキストジョブを実行する前にコストを見積もってください
💰 料金情報
課金方法
- 従量課金: 実際の token 使用量に基づいて課金されます
- 最低課金なし: 支払う分だけご利用いただけます
- 残高の有効期限: チャージ日から365日間有効で、次回のチャージ時に自動的にリセットされます(チャージ特典を参照)
- リアルタイム差し引き: 各呼び出しの直後に料金が残高から即時に差し引かれます
料金面のメリット
- 公式リレーを利用したわずかな価格優位があります
- 大口利用者は、より良い料金についてカスタマーサービスへお問い合わせいただけます
- 新規アカウントには $0.05 の試用クレジットが付与され、連携が正常に動作するか確認するのに十分です
リアルタイム料金を確認
最新の全モデル料金については、APIYI コンソールの料金ページをご覧いただくか、サイト内のモデル料金概要をご確認ください。🛠️ 使用のおすすめ
モデル選定ガイド
プログラミング開発- 最高性能: Claude Opus 5(Fable 5に近い知能を半額で), GPT-5.6 Sol(Terminal-Bench 2.1 88.8%), Claude Sonnet 5(SWE-bench 85.2%), Kimi K3
- 高いコストパフォーマンス: GPT-5.6 Terra(GPT-5.5相当の性能を半額で), Gemini 3.6 Flash, GLM-5.2, MiniMax-M3, DeepSeek V4 Flash
- 代替候補: Grok 4.5, Qwen3.7-Max, Kimi K2.6, Gemini 3.5 Flash
- 第一候補: GPT-5.6 Sol / Terra, Claude Opus 5, Claude Sonnet 5, Gemini 3.6 Flash
- 代替候補: chat-latest, Claude Sonnet 4.6, GLM-5.2, GPT-4.1
- 第一候補: Gemini 3.5 Flash-Lite(デフォルトで推論なし、約2秒), Claude Haiku 4.5(2倍高速), GPT-5.6 Luna
- 代替候補: Gemini 3.1 Flash Lite, Gemini 2.5 Flash, Seed 2.1 Turbo(推論を明示的に無効化)
- 超長文コンテキスト: Gemini 2.5 Pro(2M), Kimi K3(1M、定額課金), MiniMax-M3(1M), GLM-5.2(1M), Claude Opus 5(1M)
- 注: 一部のモデルは、しきい値を超えるとより高い課金ティアに切り替わります(Grok 4.5 は200K超、MiniMax-M3 は512K超)— 長時間のジョブでは事前にコストを見積もってください
- 最新のおすすめ: gpt-image-2(ネイティブ4K、正確なサイズ/品質制御), Nano Banana Pro(4K HD、最高のテキスト描画)
- 高いコストパフォーマンス: Nano Banana 2($0.055/image, from $0.025 pay-as-you-go), Nano Banana Lite(画像あたり約4秒、$0.025/image)
- プロ向けデザイン: Seedream 5.0 Pro($0.12/call, インタラクティブ編集 + 最大10枚の参照画像), Seedream 5.0 Lite($0.035/image)
- 最安: gpt-image-2-all(リバースチャネル、$0.03/image)
- 公式リレーの第一候補: VEO 3.1 Official($0.3 / $1.2 per call, 4/6/8s, ネイティブ同期音声)
- 中国系ベンダーの主力: Seedance 2.0 series(standard / fast / mini), Wan2.7, HappyHorse 1.1
- 注: Sora 2 のチャネルは廃止されました — 上記の विकल्पを使用してください。Image & Video Generation Models をご覧ください
- ネイティブなウェブアクセス: Grok 4 All, Grok 3 All(ツール呼び出し不要)
- 検索のグラウンディング: Gemini 3.6 Flash / 3.5 Flash-Lite(ネイティブツール有効)
コスト最適化のおすすめ
- 段階的な利用: 簡単なタスクには安価なモデルを使い、複雑なタスクには高性能モデルを使ってください
- テスト最適化: まず小さなモデルでテストし、必要性を確認してから大きなモデルを使ってください
- バッチ処理: 類似タスクを大量に処理する場合は、Luna / Lite / Mini ティアを選んでください
- キャッシュ再利用: 各ベンダーのコンテキストキャッシュを積極的に活用してください(Kimi K3、Seed 2.1 Turbo、Claude 系列はキャッシュ済み入力を1/10程度まで課金)
- 不要な推論をオフにする: 一部のモデルはデフォルトで推論します(Seed 2.1 Turbo, Gemini 3.6 Flash)— 短い高頻度Q&Aでは無効化すると、コストと時間の両方を節約できます
🔗 関連リソース
- モデル料金の概要 - ライブ料金付きのモデル一覧
- モデル比較テスト - 画像生成の効果比較
- リアルタイム料金照会 - 最新の料金情報
- APIドキュメント - 詳細なインターフェース仕様
- クイックスタート - 統合ガイド
モデル一覧は継続的に更新されます。新しくリリースされた優れたモデルは順次追加します。最新のリリースは更新履歴をご確認ください。特定のモデルのご要望や大量利用のご要件がある場合は、カスタマーサービスまでお問い合わせください。