エンタープライズグレードのプロフェッショナルで安定したAI大規模モデルAPIハブ
すべてのモデルは公式ソースからの公式リレーで提供され、約20%オフの料金(チャージ特典と為替レートの優位性を組み合わせたもの)で、さまざまな優れた大規模モデルを集約しています。速度制限なし、アカウント停止リスクなし、従量課金、長期的に信頼できるサービスです。
🔥 現在おすすめのモデル
以下は、現在安定供給されている人気モデルです。完全なモデル一覧とリアルタイム価格は、APIYI コンソールの料金ページ またはサイト内の モデル料金概要 をご覧ください。コンテキスト列の「—」は、提供元が確定値を公開していないことを意味します。コンソールと公式ドキュメントをご参照ください。価格はすべて 100万 tokens あたりの定価で、チャージ特典と併用できます。
モデルカテゴリ
🤖 OpenAIシリーズ
🆕 最新モデル
GPT-5.6の2グループ提供:デフォルトの公式リレーグループ(default / svip)は公式価格に準拠し、最大20%のチャージボーナス(定価の約83%)が適用されます。
CodexReverseグループにはデフォルトで0.7の割引が適用され、コスト重視のバッチ処理に適しています。既存のGPT-5.5コードでは、modelフィールドを置き換えるだけで利用できます。GPT-5.6のリリースノートをご覧ください。✅ 安定版 / クラシック
画像・動画生成モデルは専用ページに移動しました。完全な一覧と料金については、画像・動画生成モデルをご覧ください。
🎭 Claude シリーズ (Anthropic)
🆕 最新モデル
✅ 安定版 / クラシック
最新: Claude Opus 5 は、Opus 4.8 と同じ $5/$25 で、Fable 5 の知能に半額で迫る、負担の少ないアップグレードです。Sonnet 5 は、これまでで最もエージェント的な Sonnet とされ、Opus 4.8 に近い一方で、より高速かつ低価格です。安定版: Opus 4.7 と Sonnet 4.6 は、すでに本番ワークフローで実績のある、実戦投入済みのモデルです。Haiku 4.5 は、2倍の速度を優れたコストパフォーマンスで提供します。
🌟 Google Gemini シリーズ
🆕 最新モデル
✅ 安定版 / クラシック
最新: Gemini 3.6 Flash と 3.5 Flash-Lite は、ネイティブ Gemini 形式と OpenAI 互換形式の両方で、それぞれ30件超のテストケースを用いてエンドツーエンドで検証され、すべてのネイティブツールが有効になっています。統合前に 3.6 Flash の概要 と 3.5 Flash-Lite の概要 をお読みください。安定版: Gemini 2.5 Pro(2M コンテキスト)と Gemini 2.5 Flash は、運用が安定した本番環境に適しています。
🚀 xAI Grok シリーズ
🆕 最新モデル
✅ 安定版 / クラシック
Grok 4.5 token efficiency: SWE Bench Pro では平均出力 token が 15,954 にすぎず、Opus 4.8(最大)の約 1/4.2 です。タスク手順を半減し、同じ作業での実支出を削減します。200K tokens を超えるリクエストは、ベンダーのより高い長文コンテキスト料金で課金されることに注意してください。
🔍 DeepSeek Series
🐘 中国モデルシリーズ
Zhipu AI (GLM)
🆕 最新: GLM-5.2 | ✅ 安定版 / クラシック: GLM-5.1, GLM-5, GLM-4.6GLM-5.2 の特長:
- コンテキストが GLM-5.1 の 200K から 1M tokens に拡大し、プロジェクト規模のコードや複数の長文ドキュメントを一度に読み込めます
- 744B MoE、Terminal-Bench 2.1 81.0 / SWE-bench Pro 62.1、長期コーディングでオープンソースをリード
- Vendor と連動した価格設定の Alibaba Cloud 公式リレーに直接接続(固定 1:7 レートで換算);チャージ特典込みで定価の約85%
- 長時間タスクでは、タイムアウトを 600 秒以上に設定してください。GLM-5.2 の公開ノートをご覧ください
Alibaba Qwen
🆕 最新: Qwen3.7-Max | ✅ 安定版 / クラシック: Qwen3.6 series, Qwen Max / Plus / TurboMoonshot Kimi Series
🆕 最新: Kimi K3 | ✅ 安定版 / クラシック: Kimi K2.6, K2.5, K2Kimi K3 の利用メモ:
- コンテキストはちょうど 1,048,576 tokens で、範囲全体で一律課金です。リポジトリ全体や長文ドキュメントを、段階差を気にせずそのまま投入できます
- 最大出力は初期値で 131,072 で、1,048,576 tokens まで引き上げられます。推論は全力で動くため、出力 tokens の予算にご注意ください
- 自動コンテキストキャッシュにより、キャッシュ済み入力は $0.30/1M(未キャッシュ料金の1/10)で課金され、複数ターン会話で大きな効果があります
ByteDance Seed Series
🆕 最新: Seed 2.1 Turbo | ✅ 安定版 / クラシック: Seed 2.0 Pro / Lite / Mini🌐 MiniMax シリーズ
🆕 最新: MiniMax-M3 | ✅ 安定版 / クラシック: MiniMax-M2.7, M2.5MiniMax-M3 の課金に関する注意:
- 段階制課金: 0-512K の範囲では 1M tokens あたり入力 $0.30 / 出力 $1.20。これを超える部分はより高い料金帯で課金されます
- モデル名は大文字・小文字を区別します:
MiniMax-M3(MiniMax-M2.7-highspeedのような兄弟モデルも同様です) - 100万 token 規模のコンテキストジョブを実行する前にコストを見積もってください
💰 料金情報
課金方法
- 従量課金: 実際の token 使用量に基づいて課金されます
- 最低課金なし: 支払う分だけご利用いただけます
- 残高の有効期限: チャージ日から365日間有効で、次回のチャージ時に自動的にリセットされます(チャージ特典を参照)
- リアルタイム差し引き: 各呼び出しの直後に料金が残高から即時に差し引かれます
料金面のメリット
- 公式リレーを利用したわずかな価格優位があります
- 大口利用者は、より良い料金についてカスタマーサービスへお問い合わせいただけます
- 新規アカウントには $0.05 の試用クレジットが付与され、連携が正常に動作するか確認するのに十分です
リアルタイム料金を確認
最新の全モデル料金については、APIYI コンソールの料金ページをご覧いただくか、サイト内のモデル料金概要をご確認ください。🛠️ 使用上の推奨事項
モデル選択ガイド
プログラミング開発- 最高性能: Claude Opus 5(Fable 5 に近い知能で半額)、GPT-5.6 Sol(Terminal-Bench 2.1 で 88.8%)、Claude Sonnet 5(SWE-bench で 85.2%)、Kimi K3
- コストパフォーマンス重視: GPT-5.6 Terra(GPT-5.5 レベルの性能を半額で実現)、Gemini 3.6 Flash、GLM-5.2、MiniMax-M3、DeepSeek V4 Flash
- 代替: Grok 4.5、Qwen3.7-Max、Kimi K2.6、Gemini 3.5 Flash
- 第一候補: GPT-5.6 Sol / Terra、Claude Opus 5、Claude Sonnet 5、Gemini 3.6 Flash
- 代替: chat-latest、Claude Sonnet 4.6、GLM-5.2、GPT-4.1
- 第一候補: Gemini 3.5 Flash-Lite(デフォルトで推論なし、約 2 秒)、Claude Haiku 4.5(2 倍高速)、GPT-5.6 Luna
- 代替: Gemini 3.1 Flash Lite、Gemini 2.5 Flash、Seed 2.1 Turbo(推論を明示的に無効化)
- 超長コンテキスト: Gemini 2.5 Pro(2M)、Kimi K3(1M、一律料金)、MiniMax-M3(1M)、GLM-5.2(1M)、Claude Opus 5(1M)
- 注意: 一部のモデルでは、しきい値を超えるとより高い課金ティアに切り替わります(Grok 4.5 は 200K 超、MiniMax-M3 は 512K 超)。長時間のジョブを実行する前にコストを見積もってください
- 最新の推奨: gpt-image-2.5-flare / gpt-image-2.5-sunburst(2026 年 9 月提供開始、ネイティブ 4K、サイズと品質を正確に制御、gpt-image-2 と同価格、それぞれより高速 / より正確な編集)、Nano Banana Pro(4K HD、テキスト描画に最適)
- コストパフォーマンス重視: Nano Banana 2($0.055/画像、従量課金では $0.025 から)、Nano Banana Lite(画像 1 枚あたり約 4 秒、$0.025/画像)
- プロフェッショナルデザイン: Seedream 5.0 Pro($0.12/回、インタラクティブ編集 + 最大 10 枚の参照画像)、Seedream 5.0 Lite($0.035/画像)
- 最安: gpt-image-2-all(リバースチャネル、$0.03/画像)
- 公式リレーの第一候補: VEO 3.1 Official($0.3 / $1.2/回、4/6/8 秒、ネイティブで音声同期)
- 中国ベンダーの主力モデル: Seedance 2.5 および 2.0 シリーズ(2.5 / standard / fast / mini)、Wan2.7、HappyHorse 1.1
- 注意: Sora 2 のチャネルは廃止されました。上記のオプションを使用してください。画像・動画生成モデル を参照してください
- ネイティブ Web アクセス: Grok 4 All、Grok 3 All(ツール呼び出し不要)
- 検索グラウンディング: Gemini 3.6 Flash / 3.5 Flash-Lite(ネイティブ tools が有効)
コスト最適化の推奨事項
- 段階的な利用: 単純なタスクにはより安価なモデルを、複雑なタスクには高度なモデルを使用します
- テストの最適化: まず小規模モデルでテストし、必要性を判断した後に大規模モデルを使用します
- バッチ処理: 類似したタスクを大量に処理する場合は、Luna / Lite / Mini ティアを選択します
- キャッシュの再利用: 各ベンダーのコンテキストキャッシュを活用します(Kimi K3、Seed 2.1 Turbo、Claude シリーズでは、キャッシュ済み入力の課金が 1/10 まで低くなります)
- 不要な推論をオフにする: 一部のモデルはデフォルトで推論します(Seed 2.1 Turbo、Gemini 3.6 Flash)。短時間で頻繁に行う Q&A では、これを無効にすることでコストと時間の両方を節約できます
🔗 関連リソース
- モデル料金の概要 - ライブ料金付きのモデル一覧
- モデル比較テスト - 画像生成の効果比較
- リアルタイム料金照会 - 最新の料金情報
- APIドキュメント - 詳細なインターフェース仕様
- クイックスタート - 統合ガイド
モデル一覧は継続的に更新されます。新しくリリースされた優れたモデルは順次追加します。最新のリリースは更新履歴をご確認ください。特定のモデルのご要望や大量利用のご要件がある場合は、カスタマーサービスまでお問い合わせください。