gpt-6-astra)は、2026年9月3日にOpenAIがリリースした新世代のフラッグシップで、コンピュータ利用、ソフトウェアエンジニアリング、科学、長期的なエージェント作業向けに位置付けられています。1,050,000-tokenのコンテキストウィンドウ、128,000-tokenの最大出力、調整可能な推論強度を備えています。APIYIでは、Responses と Chat Completions の両エンドポイントを公開しており、リリース当日に3系統(OpenAI直結の公式リレー、Azure経由の公式リレー、Codex_Reverse)で同一の74項目マトリクスを実行しました。
gpt-6-astraです。default / svipの公式リレーグループはOpenAIと完全に同一の価格で、OpenAI直結とAzureという2つの公式系統により提供されます。Codex_Reverseグループ(Codexのリバースエンジニアリング済みリソース)は、0.5倍の割引で課金されます。関数呼び出しとエージェントツールチェーンはResponsesでのみ利用可能なため、新規プロジェクトはそちらで開始してください。注目される理由
タスクを完了するために構築
105 万のコンテキスト、実測済み
完全な Responses ツールチェーン
web_search および code_interpreter ツールも動作します。暗号化された推論項目はステートレスに再実行できます。厳格な JSON Schema 出力はフィールドセットに完全に一致しました。3 つのラインを測定し、すべての差異を特定
モデル情報
実測機能マトリクス
2026年9月5日、各系統74項目をチェック(公式系統ではコストを抑えるため、70K-tokenの長大コンテキストバリアントを使用):reasoning の強度
Responses での同じ川渡りパズル。1 行あたりの reasoning_tokens:料金
公式リレーグループ(default / svip)
各リクエストの入力tokens数に応じて2つのティアがあり、入力が272Kを超えると、OpenAIと同様にリクエスト全体がティア2で課金されます。
Codex_Reverse グループ
公式価格の0.5倍です。ティア1は入力 $5.00/出力 $25.00/キャッシュ読み取り $0.50/キャッシュ書き込み $6.25 です。グループの選択
例
Responses エンドポイント(推奨)
Chat Completions エンドポイント(既存コードの移行、関数 tools なし)
差異の帰属
同じマトリクスを3つの系統で実行すると、すべての差異は3つの区分のいずれかに分類されます。アップストリームの制限(3系統すべてで同一)
Chat Completions には関数 tools がない
Chat Completions には関数 tools がない
tools を含むすべての Chat リクエストは、両方の公式系統で400を返し、Responses を使用するよう案内するアップストリームの文言が返されます。reasoning_effort を省略しても、tool_choice: required を追加しても変化はありません。Codex_Reverse グループが通過するのは、そのパイプラインが内部で Responses に変換するためだけなので、これを機能対応の証拠として扱わないでください。関数呼び出しには Responses を使用してください。reasoning.effort の max は xhigh としてエコーされる
reasoning.effort の max は xhigh としてエコーされる
max に対する3/3のリクエストで、3系統すべてにおいて xhigh がエコーされました。公式系統では、max は xhigh より明らかに多くの推論 tokens を使用します(OpenAI 直接接続では278対379、Azureでは342対516対320)が、レベルは正規化されたエコーとともに適用されている可能性があります。Codex_Reverse では違いはありません。4段階のレベルを提供します。Chat パラメータ: max_tokens と temperature は400を返す
Chat パラメータ: max_tokens と temperature は400を返す
max_tokens を400で拒否し、max_completion_tokens を使用するよう求めます。temperature は、推論モデルでは通常どおり、未対応として400を返します。Codex_Reverse は両方を受け入れますが無視します。既存コードを移行する際は両方を削除してください。computer_use_preview は利用不可
computer_use_preview は利用不可
Codex_Reverse グループのみ(5項目)
1. Chat は system メッセージを完全に破棄する
1. Chat は system メッセージを完全に破棄する
developer メッセージとして送ると3/3でした。両方の公式系統では system が3/3で通過します。Chat では developer を使用してください。これは3系統すべてで機能します。2. 3つの出力上限パラメータはいずれも強制されない
2. 3つの出力上限パラメータはいずれも強制されない
max_output_tokens: 20、max_tokens: 20、または max_completion_tokens: 20 を指定しても、出力は403 tokens であり、Responses は max_output_tokens: null をエコーしました。公式系統では incomplete / length により20で正しく切り詰められます。コスト管理のために上限が重要な場合は、公式リレーのグループを使用してください。3. previous_response_id は暗黙的に無視される
3. previous_response_id は暗黙的に無視される
store: true は依然として false をエコーし、2ターン目は最初のターンを記憶せずに200を返します。両方の公式系統では正しく記憶されます。このグループでは履歴をクライアント側で保持し、ステートレスな再実行のために include: ["reasoning.encrypted_content"] と組み合わせてください(3系統すべてで検証済み)。GET /v1/responses/{id} はどこでも503を返します。4. Chat は画像 URL を暗黙的に破棄する
4. Chat は画像 URL を暗黙的に破棄する
5. effort none は約4.2K tokens の隠し指示を注入する
5. effort none は約4.2K tokens の隠し指示を注入する
none は medium に書き換えられ、input_tokens は14から4394に増加します(4224はキャッシュレートで usage.attribution.request_fields.instructions に帰属)。minimal は low に書き換えられます。このグループにはホスト型の code_interpreter tool もありません(400)。Azure 系統のみ(1項目)
web_search は一時的に無効化されている
web_search は一時的に無効化されている
web_search / web_search_preview を含むリクエストは400を返し、Azure Bing の課金がレビュー中のため web_search は一時的に無効化されており、ほかの tools は影響を受けないというゲートウェイ通知が返されます。OpenAI 直接接続系統と Codex_Reverse グループは通常どおり機能します。復旧時にこのページを更新します。移行ガイド
gpt-5.6-sol からの移行
gpt-5.6-sol からの移行
model フィールドのみを変更します。Chat では、tools を使用するものはすべて Responses に移行し、max_tokens と temperature を削除する必要があります。価格は Sol の現在のプロモーションレートの 2.5 倍($4 / $20 → $10 / $50)であるため、まずエージェント、自動化、複雑なエンジニアリングタスクで直接比較を実施してください。日常的なチャット、分類、抽出は Terra / Luna のままにしてください。Chat Completions から Responses への移行
Chat Completions から Responses への移行
messages → input、reasoning_effort → reasoning: {"effort": ...}、response_format → text: {"format": ...}、system → instructions、max_completion_tokens → max_output_tokens。ツール定義は {"type": "function", "function": {...}} から {"type": "function", "name": ..., "parameters": ...} にフラット化されます。完全なマッピングについては、Responses 移行ガイドを参照してください。長大なコンテキストのコストを制御する
長大なコンテキストのコストを制御する
セキュリティタスクは拒否されますか?
セキュリティタスクは拒否されますか?