Skip to main content
APIYI は 400+ の主流 AI モデルをサポートしています。このページでは、モデルの詳細情報、料金、使用方法を提供します。
エンタープライズグレードのプロフェッショナルで安定したAI大規模モデルAPIハブ すべてのモデルは公式ソースからの公式リレーで提供され、約20%オフの料金(チャージ特典と為替レートの優位性を組み合わせたもの)で、さまざまな優れた大規模モデルを集約しています。速度制限なし、アカウント停止リスクなし、従量課金、長期的に信頼できるサービスです。

🔥 現在おすすめのモデル

以下は、現在安定供給されている人気モデルです。完全なモデル一覧とリアルタイム価格は、APIYI コンソールの料金ページ またはサイト内の モデル料金概要 をご覧ください。
モデル更新のおすすめ: 最良のパフォーマンスを得るには最新モデルの利用をおすすめしますが、次の点にご注意ください:
  1. 初期の不安定さはよくあります: 新しく公開されたモデルは、提供元の計算資源が限られているため、応答の遅延、タイムアウト、または時折のエラーが発生する場合があります — 通常、これは数日から数週間で安定します
  2. パラメータ互換性を確認する: 新しいモデルでは、max_completion_tokensmax_tokens に置き換わるなど、パラメータが追加または変更されることがあります。アップグレード前に、API パラメータが旧モデルと互換性を保っていることを確認してください
  3. 本番投入前に必ずテストする: 新しいモデルを本番環境にデプロイする前に、テスト環境で十分に検証し、出力品質と API 互換性が期待どおりであることを確認してください
コンテキスト列の「—」は、提供元が確定値を公開していないことを意味します。コンソールと公式ドキュメントをご参照ください。価格はすべて 100万 tokens あたりの定価で、チャージ特典と併用できます。

モデルカテゴリ

🤖 OpenAI シリーズ

🆕 最新モデル

GPT-5.6 のデュアルグループ供給: デフォルトの公式リレーグループ(default / svip)は公式価格と一致し、最大 20% のチャージボーナス(定価の約 83%)があります。CodexReverse グループはデフォルトで 0.7 の割引があり、コスト重視のバッチ処理により適しています。既存の GPT-5.5 コードは model フィールドを入れ替えるだけで対応できます。GPT-5.6 のローンチノート をご覧ください。
GPT Pro シリーズ(例: gpt-5.5-progpt-5.4-pro)の利用上の注意:
  1. /v1/responses エンドポイントのみ: /v1/chat/completions は使えません — 呼び出す前に SDK / code を Responses API に切り替えてください
  2. 非常に高価: 1 回の呼び出しで数ドルかかる場合があり、Default グループでの誤使用を防ぐため、SVIP グループのみに開放されています
  3. 非専門用途には推奨しません: 日常的なタスクには GPT-5.6 Sol / Terra を使用し、Pro は極めて深い推論を要する研究や最上位の業務のみに適しています

✅ 安定版 / クラシック

GPT-5 以降のシリーズの利用上の注意:
  1. temperature パラメータ temperature は 1 に設定する必要があります(1 のみサポート)
  2. max_completion_tokensmax_tokens の代わりに使用してください
  3. top_p パラメータは渡さないでください
画像生成および動画生成モデル は専用ページに移動しました。全一覧と価格については 画像生成 & 動画生成モデル をご覧ください。

🎭 Claude シリーズ (Anthropic)

🆕 最新モデル

Fable 5 / Mythos 5 の30日間データ保持コンプライアンス: これらのモデルは高度な機能を持つため、Bedrock と Anthropic は高リスクの悪用に対して追加のチェックを実施しています。これら2つのモデルでは、深刻な悪用を検出するために入力と出力を30日間保持します。既定では自動安全システムが参照し、潜在的な危害がフラグ付けされた場合のみ人手でレビューします。保持は AWS / Anthropic 側で行われ、APIYI は純粋な透過プロキシであり、自身では一切保持しません。他の Claude モデルには影響しません。 詳細はFable 5 のリリースノートをご覧ください。

✅ 安定版 / クラシック

最新: Claude Opus 5 は、Opus 4.8 と同じ $5/$25 で、Fable 5 の知能に半額で迫る、負担の少ないアップグレードです。Sonnet 5 は、これまでで最もエージェント的な Sonnet とされ、Opus 4.8 に近い一方で、より高速かつ低価格です。安定版: Opus 4.7 と Sonnet 4.6 は、すでに本番ワークフローで実績のある、実戦投入済みのモデルです。Haiku 4.5 は、2倍の速度を優れたコストパフォーマンスで提供します。

🌟 Google Gemini シリーズ

🆕 最新モデル

: Gemini 3 Pro Preview は 2026 年 3 月 9 日に提供終了しました。Gemini 3.1 Pro Preview または Gemini 3.6 Flash へ移行してください。

✅ 安定版 / クラシック

最新: Gemini 3.6 Flash と 3.5 Flash-Lite は、ネイティブ Gemini 形式と OpenAI 互換形式の両方で、それぞれ30件超のテストケースを用いてエンドツーエンドで検証され、すべてのネイティブツールが有効になっています。統合前に 3.6 Flash の概要3.5 Flash-Lite の概要 をお読みください。安定版: Gemini 2.5 Pro(2M コンテキスト)と Gemini 2.5 Flash は、運用が安定した本番環境に適しています。

🚀 xAI Grok シリーズ

🆕 最新モデル

✅ 安定版 / クラシック

Grok 4.5 token efficiency: SWE Bench Pro では平均出力 token が 15,954 にすぎず、Opus 4.8(最大)の約 1/4.2 です。タスク手順を半減し、同じ作業での実支出を削減します。200K tokens を超えるリクエストは、ベンダーのより高い長文コンテキスト料金で課金されることに注意してください。

🔍 DeepSeek Series

🐘 中国モデルシリーズ

Zhipu AI (GLM)

🆕 最新: GLM-5.2 | ✅ 安定版 / クラシック: GLM-5.1, GLM-5, GLM-4.6
GLM-5.2 の特長:
  • コンテキストが GLM-5.1 の 200K から 1M tokens に拡大し、プロジェクト規模のコードや複数の長文ドキュメントを一度に読み込めます
  • 744B MoE、Terminal-Bench 2.1 81.0 / SWE-bench Pro 62.1、長期コーディングでオープンソースをリード
  • Vendor と連動した価格設定の Alibaba Cloud 公式リレーに直接接続(固定 1:7 レートで換算);チャージ特典込みで定価の約85%
  • 長時間タスクでは、タイムアウトを 600 秒以上に設定してください。GLM-5.2 の公開ノートをご覧ください

Alibaba Qwen

🆕 最新: Qwen3.7-Max | ✅ 安定版 / クラシック: Qwen3.6 series, Qwen Max / Plus / Turbo

Moonshot Kimi Series

🆕 最新: Kimi K3 | ✅ 安定版 / クラシック: Kimi K2.6, K2.5, K2
Kimi K3 の利用メモ:
  • コンテキストはちょうど 1,048,576 tokens で、範囲全体で一律課金です。リポジトリ全体や長文ドキュメントを、段階差を気にせずそのまま投入できます
  • 最大出力は初期値で 131,072 で、1,048,576 tokens まで引き上げられます。推論は全力で動くため、出力 tokens の予算にご注意ください
  • 自動コンテキストキャッシュにより、キャッシュ済み入力は $0.30/1M(未キャッシュ料金の1/10)で課金され、複数ターン会話で大きな効果があります

ByteDance Seed Series

🆕 最新: Seed 2.1 Turbo | ✅ 安定版 / クラシック: Seed 2.0 Pro / Lite / Mini
Seed 2.1 Turbo はデフォルトで深い思考を有効化します: パラメータを何も設定しない場合、1行の質問でも最初に数百の thinking tokens を出力します(1文の自己紹介で 444 output tokens、そのうち 409 が thinking と計測)。thinking は通常の output tokens として課金されます。高頻度の短い Q&A では、thinking: {"type": "disabled"} を基準値にしてください。統合ガイドをご覧ください。

🌐 MiniMax シリーズ

🆕 最新: MiniMax-M3 | ✅ 安定版 / クラシック: MiniMax-M2.7, M2.5
MiniMax-M3 の課金に関する注意:
  • 段階制課金: 0-512K の範囲では 1M tokens あたり入力 $0.30 / 出力 $1.20。これを超える部分はより高い料金帯で課金されます
  • モデル名は大文字・小文字を区別します: MiniMax-M3MiniMax-M2.7-highspeed のような兄弟モデルも同様です)
  • 100万 token 規模のコンテキストジョブを実行する前にコストを見積もってください

💰 料金情報

課金方法

  • 従量課金: 実際の token 使用量に基づいて課金されます
  • 最低課金なし: 支払う分だけご利用いただけます
  • 残高の有効期限: チャージ日から365日間有効で、次回のチャージ時に自動的にリセットされます(チャージ特典を参照)
  • リアルタイム差し引き: 各呼び出しの直後に料金が残高から即時に差し引かれます

料金面のメリット

  • 公式リレーを利用したわずかな価格優位があります
  • 大口利用者は、より良い料金についてカスタマーサービスへお問い合わせいただけます
  • 新規アカウントには $0.05 の試用クレジットが付与され、連携が正常に動作するか確認するのに十分です

リアルタイム料金を確認

最新の全モデル料金については、APIYI コンソールの料金ページをご覧いただくか、サイト内のモデル料金概要をご確認ください。

🛠️ 使用のおすすめ

モデル選定ガイド

プログラミング開発
  • 最高性能: Claude Opus 5(Fable 5に近い知能を半額で), GPT-5.6 Sol(Terminal-Bench 2.1 88.8%), Claude Sonnet 5(SWE-bench 85.2%), Kimi K3
  • 高いコストパフォーマンス: GPT-5.6 Terra(GPT-5.5相当の性能を半額で), Gemini 3.6 Flash, GLM-5.2, MiniMax-M3, DeepSeek V4 Flash
  • 代替候補: Grok 4.5, Qwen3.7-Max, Kimi K2.6, Gemini 3.5 Flash
テキスト作成
  • 第一候補: GPT-5.6 Sol / Terra, Claude Opus 5, Claude Sonnet 5, Gemini 3.6 Flash
  • 代替候補: chat-latest, Claude Sonnet 4.6, GLM-5.2, GPT-4.1
迅速な応答
  • 第一候補: Gemini 3.5 Flash-Lite(デフォルトで推論なし、約2秒), Claude Haiku 4.5(2倍高速), GPT-5.6 Luna
  • 代替候補: Gemini 3.1 Flash Lite, Gemini 2.5 Flash, Seed 2.1 Turbo(推論を明示的に無効化)
長文処理
  • 超長文コンテキスト: Gemini 2.5 Pro(2M), Kimi K3(1M、定額課金), MiniMax-M3(1M), GLM-5.2(1M), Claude Opus 5(1M)
  • 注: 一部のモデルは、しきい値を超えるとより高い課金ティアに切り替わります(Grok 4.5 は200K超、MiniMax-M3 は512K超)— 長時間のジョブでは事前にコストを見積もってください
画像生成
  • 最新のおすすめ: gpt-image-2(ネイティブ4K、正確なサイズ/品質制御), Nano Banana Pro(4K HD、最高のテキスト描画)
  • 高いコストパフォーマンス: Nano Banana 2($0.055/image, from $0.025 pay-as-you-go), Nano Banana Lite(画像あたり約4秒、$0.025/image)
  • プロ向けデザイン: Seedream 5.0 Pro($0.12/call, インタラクティブ編集 + 最大10枚の参照画像), Seedream 5.0 Lite($0.035/image)
  • 最安: gpt-image-2-all(リバースチャネル、$0.03/image)
動画生成
  • 公式リレーの第一候補: VEO 3.1 Official($0.3 / $1.2 per call, 4/6/8s, ネイティブ同期音声)
  • 中国系ベンダーの主力: Seedance 2.0 series(standard / fast / mini), Wan2.7, HappyHorse 1.1
  • 注: Sora 2 のチャネルは廃止されました — 上記の विकल्पを使用してください。Image & Video Generation Models をご覧ください
ウェブ検索
  • ネイティブなウェブアクセス: Grok 4 All, Grok 3 All(ツール呼び出し不要)
  • 検索のグラウンディング: Gemini 3.6 Flash / 3.5 Flash-Lite(ネイティブツール有効)

コスト最適化のおすすめ

  1. 段階的な利用: 簡単なタスクには安価なモデルを使い、複雑なタスクには高性能モデルを使ってください
  2. テスト最適化: まず小さなモデルでテストし、必要性を確認してから大きなモデルを使ってください
  3. バッチ処理: 類似タスクを大量に処理する場合は、Luna / Lite / Mini ティアを選んでください
  4. キャッシュ再利用: 各ベンダーのコンテキストキャッシュを積極的に活用してください(Kimi K3、Seed 2.1 Turbo、Claude 系列はキャッシュ済み入力を1/10程度まで課金)
  5. 不要な推論をオフにする: 一部のモデルはデフォルトで推論します(Seed 2.1 Turbo, Gemini 3.6 Flash)— 短い高頻度Q&Aでは無効化すると、コストと時間の両方を節約できます

🔗 関連リソース

モデル一覧は継続的に更新されます。新しくリリースされた優れたモデルは順次追加します。最新のリリースは更新履歴をご確認ください。特定のモデルのご要望や大量利用のご要件がある場合は、カスタマーサービスまでお問い合わせください。