Skip to main content
Kimi K2.5は、Moonshot AIのネイティブなマルチモーダル旗艦モデルで、2026年1月27日にリリースされました。これはビジュアルコーディングと自律的なAgent Swarmオーケストレーションに重点を置いており、追加料金なしで提供される256Kのコンテキストウィンドウを備えています。APIYIは、これを本番環境向けの安定性のためにAlibaba Cloudの公式リレーチャネル経由で統合しています。ベースのグループレート倍率は公式課金の0.88倍で、入金ボーナス($100入金→$10無料分以上)を重ねると、実質コストは公式課金の80%未満になります。
Kimi K2.5はAPIYIで利用できます: Alibaba Cloudの公式リレーチャネル、OpenAI互換エンドポイント、モデルID kimi-k2.5。Kimiの公式サイトとは異なり、Thinkingモードはリクエストボディ内の enable_thinking: true によって明示的に有効化する必要があります。デフォルトではモデルはInstantモードで実行されます。

主な利点

256K コンテキスト

追加料金なしで 256K token を利用できます。中規模のコードベース全体や長文ドキュメントを 1 回の呼び出しで収められます。

推論モード

enable_thinking: true による高度な推論を有効化できます。複雑な計画立案、根本原因分析、エージェント向けに設計されています。

ネイティブなマルチモーダル + ビジュアルコーディング

画像とコードをネイティブに理解します。UI モックアップ、スクリーンショット、図表を実行可能なコードに変換するのが得意です。

安定した Alibaba Cloud 公式転送

Alibaba Cloud の公式転送チャネル経由でルーティングされます。高い同時実行数でもエンタープライズグレードの SLA を提供します。

モデル情報

Kimi の組み込みの $web_search ツールは、現在 Thinking モードと互換性がありません。Moonshot のガイダンスに従い、web_search ツールが必要な場合は enable_thinking を無効にしてください。この制限は公式プラットフォームと一致しています。

料金

料金に関する注意: APIYI は、基本のグループ料金として 0.88×のレート倍率(公式の定価の88%)を採用しています。オンボーディング / 大口チャージ特典(例: $100 チャージで $10 以上の無料分)を重ねると、実質コストは公式の80%未満になります。詳細は チャージ特典 をご覧ください。

Thinkingモードを有効にする方法

Kimiの公式サイトとの最大の違いは、APIYIではデフォルトがInstantモードである点です。リクエストボディ内でenable_thinkingを明示的に有効にする必要があります。

cURLの例(Thinking有効)

呼び出し方法

エンドポイント

基本的な使い方(即時モード)

詳細な使い方(推論モード)

ストリーミング

リクエストパラメータ

レスポンス形式

ベストプラクティス

  1. タスクごとにモードを切り替える: 日常のチャットや短い生成では Instant mode をオンのままにし、複雑な推論、コードレビュー、エージェントのプランニングでは enable_thinking: true に設定します。
  2. 256K のコンテキストを活用する: 中規模の repo、製品ドキュメント一式、長い会議の文字起こしを 1 回の呼び出しに収められます — 追加料金なしです。
  3. マルチモーダルなビジュアルコーディング: UI のスクリーンショット / デザインモックアップを送って、K2.5 に「読み取り → 計画 → コーディング」を一気に任せます。
  4. 節約効果をさらに伸ばす: $100以上の入金ボーナスと 0.88× のグループレートを組み合わせると、実質コストは公式の80%未満に下がります。
  5. web_search の注意点に留意する: Moonshot の内蔵 $web_search ツールが必要な場合は enable_thinking を無効にしてください。

よくある質問

Thinking modeはデフォルトではオフです。リクエスト本文に"enable_thinking": trueが含まれていることを確認してください。OpenAI Python SDKではextra_body内に指定し、Node.js SDKではトップレベルのフィールドとして指定できます。
はい — 同じ上流モデルで、Alibaba Cloud の official-transfer チャネル経由でルーティングされています。唯一の違いは、Thinking mode がデフォルトでオフであり、enable_thinkingを通じて有効化する必要があることです。
APIYI コンソールで API token を作成する際、Kimi K2.5 を含むグループに割り当てると、課金に 0.88× の倍率が自動的に適用されます。チャージ特典と組み合わせると、合計コストはさらに下がります。チャージ特典をご覧ください。
はい。標準的な OpenAI スタイルの tools 定義を渡してください。なお、公式の $web_search 組み込みツールは Thinking mode と排他的です。別々の呼び出しで使用してください。
Thinking トレースは出力 token としてカウントされ、通常どおり課金されます。複雑なタスクでは出力 token が大幅に増える場合があるため、より深い推論が必要な場合にのみ有効化してください。

関連リソース

API マニュアル

API の完全な利用ガイド

チャージ特典

ボーナスを積み重ねて、価格をさらに下げます

モデル情報

利用可能なすべてのモデルとグループを閲覧します

ユースケース

クライアント統合の手順