Skip to main content
APIYI は 400+ の主流 AI モデルをサポートしています。このページでは、モデルの詳細情報、料金、使用方法を提供します。
エンタープライズグレードのプロフェッショナルで安定したAI大規模モデルAPIハブ すべてのモデルは公式ソースからの公式リレーで提供され、約20%オフの料金(チャージ特典と為替レートの優位性を組み合わせたもの)で、さまざまな優れた大規模モデルを集約しています。速度制限なし、アカウント停止リスクなし、従量課金、長期的に信頼できるサービスです。

🔥 現在おすすめのモデル

以下は、現在安定供給されている人気モデルです。完全なモデル一覧とリアルタイム価格は、APIYI コンソールの料金ページ またはサイト内の モデル料金概要 をご覧ください。
モデル更新のおすすめ: 最良のパフォーマンスを得るには最新モデルの利用をおすすめしますが、次の点にご注意ください:
  1. 初期の不安定さはよくあります: 新しく公開されたモデルは、提供元の計算資源が限られているため、応答の遅延、タイムアウト、または時折のエラーが発生する場合があります — 通常、これは数日から数週間で安定します
  2. パラメータ互換性を確認する: 新しいモデルでは、max_completion_tokensmax_tokens に置き換わるなど、パラメータが追加または変更されることがあります。アップグレード前に、API パラメータが旧モデルと互換性を保っていることを確認してください
  3. 本番投入前に必ずテストする: 新しいモデルを本番環境にデプロイする前に、テスト環境で十分に検証し、出力品質と API 互換性が期待どおりであることを確認してください
コンテキスト列の「—」は、提供元が確定値を公開していないことを意味します。コンソールと公式ドキュメントをご参照ください。価格はすべて 100万 tokens あたりの定価で、チャージ特典と併用できます。

モデルカテゴリ

🤖 OpenAIシリーズ

🆕 最新モデル

GPT-5.6の2グループ提供:デフォルトの公式リレーグループ(default / svip)は公式価格に準拠し、最大20%のチャージボーナス(定価の約83%)が適用されます。CodexReverseグループにはデフォルトで0.7の割引が適用され、コスト重視のバッチ処理に適しています。既存のGPT-5.5コードでは、modelフィールドを置き換えるだけで利用できます。GPT-5.6のリリースノートをご覧ください。
GPT Proシリーズ(例:gpt-5.5-progpt-5.4-pro)の利用上の注意
  1. /v1/responsesエンドポイントのみ/v1/chat/completionsは利用できません。呼び出す前にSDK / コードをResponses APIへ切り替えてください
  2. 非常に高額:1回の呼び出しで数ドルかかる場合があり、Defaultグループでの誤使用を防ぐためSVIPグループのみ利用可能です
  3. 専門家以外の用途には推奨しません:日常的なタスクにはGPT-5.6 Sol / Terraを使用してください。Proは、極めて深い推論を必要とする研究や最高水準の業務にのみ適しています

✅ 安定版 / クラシック

GPT-5以降のシリーズの利用上の注意
  1. temperatureパラメータtemperatureは1に設定する必要があります(1のみサポート)
  2. max_tokensの代わりにmax_completion_tokensを使用してください
  3. top_pパラメータは渡さないでください
画像・動画生成モデルは専用ページに移動しました。完全な一覧と料金については、画像・動画生成モデルをご覧ください。

🎭 Claude シリーズ (Anthropic)

🆕 最新モデル

Fable 5 / Mythos 5 の30日間データ保持コンプライアンス: これらのモデルは高度な機能を持つため、Bedrock と Anthropic は高リスクの悪用に対して追加のチェックを実施しています。これら2つのモデルでは、深刻な悪用を検出するために入力と出力を30日間保持します。既定では自動安全システムが参照し、潜在的な危害がフラグ付けされた場合のみ人手でレビューします。保持は AWS / Anthropic 側で行われ、APIYI は純粋な透過プロキシであり、自身では一切保持しません。他の Claude モデルには影響しません。 詳細はFable 5 のリリースノートをご覧ください。

✅ 安定版 / クラシック

最新: Claude Opus 5 は、Opus 4.8 と同じ $5/$25 で、Fable 5 の知能に半額で迫る、負担の少ないアップグレードです。Sonnet 5 は、これまでで最もエージェント的な Sonnet とされ、Opus 4.8 に近い一方で、より高速かつ低価格です。安定版: Opus 4.7 と Sonnet 4.6 は、すでに本番ワークフローで実績のある、実戦投入済みのモデルです。Haiku 4.5 は、2倍の速度を優れたコストパフォーマンスで提供します。

🌟 Google Gemini シリーズ

🆕 最新モデル

: Gemini 3 Pro Preview は 2026 年 3 月 9 日に提供終了しました。Gemini 3.1 Pro Preview または Gemini 3.6 Flash へ移行してください。

✅ 安定版 / クラシック

最新: Gemini 3.6 Flash と 3.5 Flash-Lite は、ネイティブ Gemini 形式と OpenAI 互換形式の両方で、それぞれ30件超のテストケースを用いてエンドツーエンドで検証され、すべてのネイティブツールが有効になっています。統合前に 3.6 Flash の概要3.5 Flash-Lite の概要 をお読みください。安定版: Gemini 2.5 Pro(2M コンテキスト)と Gemini 2.5 Flash は、運用が安定した本番環境に適しています。

🚀 xAI Grok シリーズ

🆕 最新モデル

✅ 安定版 / クラシック

Grok 4.5 token efficiency: SWE Bench Pro では平均出力 token が 15,954 にすぎず、Opus 4.8(最大)の約 1/4.2 です。タスク手順を半減し、同じ作業での実支出を削減します。200K tokens を超えるリクエストは、ベンダーのより高い長文コンテキスト料金で課金されることに注意してください。

🔍 DeepSeek Series

🐘 中国モデルシリーズ

Zhipu AI (GLM)

🆕 最新: GLM-5.2 | ✅ 安定版 / クラシック: GLM-5.1, GLM-5, GLM-4.6
GLM-5.2 の特長:
  • コンテキストが GLM-5.1 の 200K から 1M tokens に拡大し、プロジェクト規模のコードや複数の長文ドキュメントを一度に読み込めます
  • 744B MoE、Terminal-Bench 2.1 81.0 / SWE-bench Pro 62.1、長期コーディングでオープンソースをリード
  • Vendor と連動した価格設定の Alibaba Cloud 公式リレーに直接接続(固定 1:7 レートで換算);チャージ特典込みで定価の約85%
  • 長時間タスクでは、タイムアウトを 600 秒以上に設定してください。GLM-5.2 の公開ノートをご覧ください

Alibaba Qwen

🆕 最新: Qwen3.7-Max | ✅ 安定版 / クラシック: Qwen3.6 series, Qwen Max / Plus / Turbo

Moonshot Kimi Series

🆕 最新: Kimi K3 | ✅ 安定版 / クラシック: Kimi K2.6, K2.5, K2
Kimi K3 の利用メモ:
  • コンテキストはちょうど 1,048,576 tokens で、範囲全体で一律課金です。リポジトリ全体や長文ドキュメントを、段階差を気にせずそのまま投入できます
  • 最大出力は初期値で 131,072 で、1,048,576 tokens まで引き上げられます。推論は全力で動くため、出力 tokens の予算にご注意ください
  • 自動コンテキストキャッシュにより、キャッシュ済み入力は $0.30/1M(未キャッシュ料金の1/10)で課金され、複数ターン会話で大きな効果があります

ByteDance Seed Series

🆕 最新: Seed 2.1 Turbo | ✅ 安定版 / クラシック: Seed 2.0 Pro / Lite / Mini
Seed 2.1 Turbo はデフォルトで深い思考を有効化します: パラメータを何も設定しない場合、1行の質問でも最初に数百の thinking tokens を出力します(1文の自己紹介で 444 output tokens、そのうち 409 が thinking と計測)。thinking は通常の output tokens として課金されます。高頻度の短い Q&A では、thinking: {"type": "disabled"} を基準値にしてください。統合ガイドをご覧ください。

🌐 MiniMax シリーズ

🆕 最新: MiniMax-M3 | ✅ 安定版 / クラシック: MiniMax-M2.7, M2.5
MiniMax-M3 の課金に関する注意:
  • 段階制課金: 0-512K の範囲では 1M tokens あたり入力 $0.30 / 出力 $1.20。これを超える部分はより高い料金帯で課金されます
  • モデル名は大文字・小文字を区別します: MiniMax-M3MiniMax-M2.7-highspeed のような兄弟モデルも同様です)
  • 100万 token 規模のコンテキストジョブを実行する前にコストを見積もってください

💰 料金情報

課金方法

  • 従量課金: 実際の token 使用量に基づいて課金されます
  • 最低課金なし: 支払う分だけご利用いただけます
  • 残高の有効期限: チャージ日から365日間有効で、次回のチャージ時に自動的にリセットされます(チャージ特典を参照)
  • リアルタイム差し引き: 各呼び出しの直後に料金が残高から即時に差し引かれます

料金面のメリット

  • 公式リレーを利用したわずかな価格優位があります
  • 大口利用者は、より良い料金についてカスタマーサービスへお問い合わせいただけます
  • 新規アカウントには $0.05 の試用クレジットが付与され、連携が正常に動作するか確認するのに十分です

リアルタイム料金を確認

最新の全モデル料金については、APIYI コンソールの料金ページをご覧いただくか、サイト内のモデル料金概要をご確認ください。

🛠️ 使用上の推奨事項

モデル選択ガイド

プログラミング開発
  • 最高性能: Claude Opus 5(Fable 5 に近い知能で半額)、GPT-5.6 Sol(Terminal-Bench 2.1 で 88.8%)、Claude Sonnet 5(SWE-bench で 85.2%)、Kimi K3
  • コストパフォーマンス重視: GPT-5.6 Terra(GPT-5.5 レベルの性能を半額で実現)、Gemini 3.6 Flash、GLM-5.2、MiniMax-M3、DeepSeek V4 Flash
  • 代替: Grok 4.5、Qwen3.7-Max、Kimi K2.6、Gemini 3.5 Flash
文章作成
  • 第一候補: GPT-5.6 Sol / Terra、Claude Opus 5、Claude Sonnet 5、Gemini 3.6 Flash
  • 代替: chat-latest、Claude Sonnet 4.6、GLM-5.2、GPT-4.1
高速レスポンス
  • 第一候補: Gemini 3.5 Flash-Lite(デフォルトで推論なし、約 2 秒)、Claude Haiku 4.5(2 倍高速)、GPT-5.6 Luna
  • 代替: Gemini 3.1 Flash Lite、Gemini 2.5 Flash、Seed 2.1 Turbo(推論を明示的に無効化)
長文処理
  • 超長コンテキスト: Gemini 2.5 Pro(2M)、Kimi K3(1M、一律料金)、MiniMax-M3(1M)、GLM-5.2(1M)、Claude Opus 5(1M)
  • 注意: 一部のモデルでは、しきい値を超えるとより高い課金ティアに切り替わります(Grok 4.5 は 200K 超、MiniMax-M3 は 512K 超)。長時間のジョブを実行する前にコストを見積もってください
画像生成
  • 最新の推奨: gpt-image-2.5-flare / gpt-image-2.5-sunburst(2026 年 9 月提供開始、ネイティブ 4K、サイズと品質を正確に制御、gpt-image-2 と同価格、それぞれより高速 / より正確な編集)、Nano Banana Pro(4K HD、テキスト描画に最適)
  • コストパフォーマンス重視: Nano Banana 2($0.055/画像、従量課金では $0.025 から)、Nano Banana Lite(画像 1 枚あたり約 4 秒、$0.025/画像)
  • プロフェッショナルデザイン: Seedream 5.0 Pro($0.12/回、インタラクティブ編集 + 最大 10 枚の参照画像)、Seedream 5.0 Lite($0.035/画像)
  • 最安: gpt-image-2-all(リバースチャネル、$0.03/画像)
動画生成
  • 公式リレーの第一候補: VEO 3.1 Official($0.3 / $1.2/回、4/6/8 秒、ネイティブで音声同期)
  • 中国ベンダーの主力モデル: Seedance 2.5 および 2.0 シリーズ(2.5 / standard / fast / mini)、Wan2.7、HappyHorse 1.1
  • 注意: Sora 2 のチャネルは廃止されました。上記のオプションを使用してください。画像・動画生成モデル を参照してください
Web 検索
  • ネイティブ Web アクセス: Grok 4 All、Grok 3 All(ツール呼び出し不要)
  • 検索グラウンディング: Gemini 3.6 Flash / 3.5 Flash-Lite(ネイティブ tools が有効)

コスト最適化の推奨事項

  1. 段階的な利用: 単純なタスクにはより安価なモデルを、複雑なタスクには高度なモデルを使用します
  2. テストの最適化: まず小規模モデルでテストし、必要性を判断した後に大規模モデルを使用します
  3. バッチ処理: 類似したタスクを大量に処理する場合は、Luna / Lite / Mini ティアを選択します
  4. キャッシュの再利用: 各ベンダーのコンテキストキャッシュを活用します(Kimi K3、Seed 2.1 Turbo、Claude シリーズでは、キャッシュ済み入力の課金が 1/10 まで低くなります)
  5. 不要な推論をオフにする: 一部のモデルはデフォルトで推論します(Seed 2.1 Turbo、Gemini 3.6 Flash)。短時間で頻繁に行う Q&A では、これを無効にすることでコストと時間の両方を節約できます

🔗 関連リソース

モデル一覧は継続的に更新されます。新しくリリースされた優れたモデルは順次追加します。最新のリリースは更新履歴をご確認ください。特定のモデルのご要望や大量利用のご要件がある場合は、カスタマーサービスまでお問い合わせください。