Kimi K2.5はAPIYIで利用できます: Alibaba Cloudの公式リレーチャネル、OpenAI互換エンドポイント、モデルID
kimi-k2.5。Kimiの公式サイトとは異なり、Thinkingモードはリクエストボディ内の enable_thinking: true によって明示的に有効化する必要があります。デフォルトではモデルはInstantモードで実行されます。主な利点
256K コンテキスト
追加料金なしで 256K token を利用できます。中規模のコードベース全体や長文ドキュメントを 1 回の呼び出しで収められます。
推論モード
enable_thinking: true による高度な推論を有効化できます。複雑な計画立案、根本原因分析、エージェント向けに設計されています。ネイティブなマルチモーダル + ビジュアルコーディング
画像とコードをネイティブに理解します。UI モックアップ、スクリーンショット、図表を実行可能なコードに変換するのが得意です。
安定した Alibaba Cloud 公式転送
Alibaba Cloud の公式転送チャネル経由でルーティングされます。高い同時実行数でもエンタープライズグレードの SLA を提供します。
モデル情報
料金
料金に関する注意: APIYI は、基本のグループ料金として 0.88×のレート倍率(公式の定価の88%)を採用しています。オンボーディング / 大口チャージ特典(例: $100 チャージで $10 以上の無料分)を重ねると、実質コストは公式の80%未満になります。詳細は チャージ特典 をご覧ください。
Thinkingモードを有効にする方法
Kimiの公式サイトとの最大の違いは、APIYIではデフォルトがInstantモードである点です。リクエストボディ内でenable_thinkingを明示的に有効にする必要があります。
cURLの例(Thinking有効)
呼び出し方法
エンドポイント
基本的な使い方(即時モード)
詳細な使い方(推論モード)
ストリーミング
リクエストパラメータ
レスポンス形式
ベストプラクティス
- タスクごとにモードを切り替える: 日常のチャットや短い生成では Instant mode をオンのままにし、複雑な推論、コードレビュー、エージェントのプランニングでは
enable_thinking: trueに設定します。 - 256K のコンテキストを活用する: 中規模の repo、製品ドキュメント一式、長い会議の文字起こしを 1 回の呼び出しに収められます — 追加料金なしです。
- マルチモーダルなビジュアルコーディング: UI のスクリーンショット / デザインモックアップを送って、K2.5 に「読み取り → 計画 → コーディング」を一気に任せます。
- 節約効果をさらに伸ばす: $100以上の入金ボーナスと 0.88× のグループレートを組み合わせると、実質コストは公式の80%未満に下がります。
- web_search の注意点に留意する: Moonshot の内蔵
$web_searchツールが必要な場合はenable_thinkingを無効にしてください。
よくある質問
なぜ私のリクエストはThinking modeを使っていないのですか?
なぜ私のリクエストはThinking modeを使っていないのですか?
Thinking modeはデフォルトではオフです。リクエスト本文に
"enable_thinking": trueが含まれていることを確認してください。OpenAI Python SDKではextra_body内に指定し、Node.js SDKではトップレベルのフィールドとして指定できます。APIYI の Kimi K2.5 は Moonshot のものと同じモデルですか?
APIYI の Kimi K2.5 は Moonshot のものと同じモデルですか?
はい — 同じ上流モデルで、Alibaba Cloud の official-transfer チャネル経由でルーティングされています。唯一の違いは、Thinking mode がデフォルトでオフであり、
enable_thinkingを通じて有効化する必要があることです。0.88×のグループレートはどのように機能しますか?
0.88×のグループレートはどのように機能しますか?
APIYI コンソールで API token を作成する際、Kimi K2.5 を含むグループに割り当てると、課金に 0.88× の倍率が自動的に適用されます。チャージ特典と組み合わせると、合計コストはさらに下がります。チャージ特典をご覧ください。
function calling / tool use に対応していますか?
function calling / tool use に対応していますか?
はい。標準的な OpenAI スタイルの
tools 定義を渡してください。なお、公式の $web_search 組み込みツールは Thinking mode と排他的です。別々の呼び出しで使用してください。Thinking mode は追加料金がかかりますか?
Thinking mode は追加料金がかかりますか?
Thinking トレースは出力 token としてカウントされ、通常どおり課金されます。複雑なタスクでは出力 token が大幅に増える場合があるため、より深い推論が必要な場合にのみ有効化してください。
関連リソース
API マニュアル
API の完全な利用ガイド
チャージ特典
ボーナスを積み重ねて、価格をさらに下げます
モデル情報
利用可能なすべてのモデルとグループを閲覧します
ユースケース
クライアント統合の手順