gpt-6-astra)是 OpenAI 2026 年 9 月 3 日发布的新一代旗舰,官方定位是电脑操作、软件工程、科研与长程 Agent 任务,1,050,000 上下文、128,000 最大输出、推理力度可调。API易 已开通 Responses 与 Chat Completions 双端点,上线当天在官转(OpenAI 直连、Azure)与 Codex_Reverse 三条线路各跑了一遍 74 项能力矩阵。
API易 已接入 GPT-6 Astra:模型名
gpt-6-astra。default / svip 官转分组与官网逐项同价,由 OpenAI 直连与 Azure 两条官方线路承载;Codex_Reverse 分组(Codex 逆向资源)按官网价 0.5 折扣计费。函数调用与 Agent 工具链只在 Responses 端点上,新项目请直接用 Responses。核心优势
为「把任务做完」而生
Terminal-Bench 4.0 由 37.3% 提到 57.9%、ScreenSpot-Pro 由 76.9% 提到 92.7%、OSWorld 2.0 72.6%。提升最大的全是 Agent 类任务,官方称复杂任务平均完成时间从约 75 分钟压到 40 分钟。
1.05M 上下文实测可用
30.8 万字符(210,657 tokens)大海捞针 10.3 秒答对。官方称同等任务 token 消耗比 GPT-5.6 Sol 低约 70%,单价高 2.5 倍,实际任务成本差距小于价差。
Responses 工具链完整
函数调用单次 / 并行 / 回传 / 流式全通,web_search 与 code_interpreter 托管工具可用,加密推理块可无状态回放。JSON Schema 严格模式字段集完全匹配。
三线路实测、差异逐项归属
同一矩阵在 OpenAI 直连、Azure、Codex_Reverse 各跑一遍,模型能力三线一致;差异全在链路层,本页按「上游限制 / 分组特有 / 线路特有」逐项标注。
模型信息
实测能力矩阵
2026 年 9 月 5 日,三条线路各跑 74 项(官转线路的长上下文用 7 万 token 缩量版控成本):推理档位
同一道过河题,Responses 端点,三条线路的 reasoning_tokens:定价
官转分组(default / svip)
按单次请求的输入 tokens 分两档,超过 272K 后整单按第二档计,与官网一致:
Codex_Reverse 分组
按官网价 0.5 折扣计费:第一档输入 $5.00 / 输出 $25.00 / 缓存读取 $0.50 / 缓存创建 $6.25。API易 的模型价格与原厂逐项对齐,折扣通过分组与充值加赠体现,详见 充值优惠。分组差异见 Codex、ClaudeCode 和 Default 分组有什么区别。实时价格以 模型价格页 为准。
分组怎么选
调用示例
Responses 端点(推荐)
Chat Completions 端点(存量代码平迁,无函数工具)
差异归属
三条线路跑同一矩阵后,差异可以清楚地分成三类。上游限制(三线一致)
Chat Completions 不支持函数工具
Chat Completions 不支持函数工具
官转两线带
tools 的 Chat 请求一律 400,上游原文要求改用 Responses;不带 reasoning_effort、加 tool_choice: required 都一样。Codex_Reverse 分组能过是因为链路内部转成了 Responses,不要把它当能力依据。需要函数调用请直接用 Responses。reasoning.effort: max 回显为 xhigh
reasoning.effort: max 回显为 xhigh
三条线路 3/3 次请求
max 都回显 xhigh。官转线路 max 的推理 token 明显高于 xhigh(OpenAI 直连 278 至 379 对 246,Azure 342 至 516 对 320),可能是档位已生效只是回显被归一化;Codex_Reverse 上两者无差别。对外只承诺四档。Chat 端点参数:max_tokens 与 temperature 会 400
Chat 端点参数:max_tokens 与 temperature 会 400
官转线路对旧参数
max_tokens 返回 400 并要求改用 max_completion_tokens;temperature 返回 400 unsupported(推理模型常态)。Codex_Reverse 分组接受这两个参数但不生效。存量代码迁移时把这两处一并清掉。computer_use_preview 工具不可用
computer_use_preview 工具不可用
三条线路都返回 400「Tool ‘computer_use_preview’ is not supported with gpt-6-astra」。官方发布材料中的电脑操作能力目前不通过这个工具类型对 API 开放。
Codex_Reverse 分组特有(5 项)
1. Chat 端点的 system 消息被整段丢弃
1. Chat 端点的 system 消息被整段丢弃
指令型与信息型 system 各 0/3 命中,同样内容改成
developer 角色 3/3 命中;官转两线 system 3/3 正常。Chat 调用统一用 developer,三条线路都通。2. 三种输出上限参数都不生效
2. 三种输出上限参数都不生效
max_output_tokens: 20、max_tokens: 20、max_completion_tokens: 20 下输出均为 403 tokens,Responses 回显 max_output_tokens: null。官转两线 20 → incomplete / length 正常截断。依赖上限控费的场景请用官转分组。3. previous_response_id 静默失效
3. previous_response_id 静默失效
store: true 仍回显 false,第二轮返回 200 但不记得上一轮;官转两线正常回忆。多轮在该分组请客户端自带历史,配合 include: ["reasoning.encrypted_content"] 无状态回放(三线均已验证)。GET /v1/responses/{id} 三线都是 503。4. Chat 端点的图片 URL 静默丢弃
4. Chat 端点的图片 URL 静默丢弃
Chat 传 http(s) 图片链接时 prompt_tokens 只有 15,模型回答「没有看到图片」;官转两线同一链接正常识图。base64 三线两端点都正常。该分组 Chat 传图请用 base64。
5. effort none 注入约 4.2K token 隐藏指令
5. effort none 注入约 4.2K token 隐藏指令
none 被改成 medium,input_tokens 从 14 涨到 4394(4224 落在 usage.attribution.request_fields.instructions,按缓存价计);minimal 被改成 low。另外该分组不支持 code_interpreter 托管工具(400)。Azure 线路特有(1 项)
web_search 临时停用
web_search 临时停用
Azure 线路上带
web_search / web_search_preview 的请求返回 400,网关提示「web_search 已临时停用(Azure Bing 计费排查中),其他工具调用不受影响」。OpenAI 直连线路与 Codex_Reverse 分组正常。恢复后本页会更新。迁移指南
从 gpt-5.6-sol 迁移
从 gpt-5.6-sol 迁移
Responses 端点只改
model 字段。Chat 端点若用到 tools,必须迁到 Responses;同时清掉 max_tokens 与 temperature。价格是 Sol 现行优惠价的 2.5 倍($4 / $20 → $10 / $50),先在 Agent、自动化、复杂工程任务上做一轮对照,日常对话与分类抽取类负载留在 Terra / Luna。从 Chat Completions 迁到 Responses
从 Chat Completions 迁到 Responses
messages → input,reasoning_effort → reasoning: {"effort": ...},response_format → text: {"format": ...},system → instructions,max_completion_tokens → max_output_tokens。工具定义从 {"type": "function", "function": {...}} 扁平化为 {"type": "function", "name": ..., "parameters": ...}。完整对照见 Responses 迁移指南。长上下文怎么控成本
长上下文怎么控成本
输入超过 272K tokens 时整单按第二档计(输入翻倍、输出 1.5 倍)。除非确实需要一次装下整个仓库,日常把上下文压在 272K 以内;稳定前缀放在消息开头以命中缓存(缓存读取是标准输入价的十分之一)。
网络安全类任务会被拒吗
网络安全类任务会被拒吗
Astra 是首个被划入 Preparedness Framework 网络安全「Critical」级的模型,公开版拒绝漏洞挖掘、漏洞利用代码编写等进攻性任务。防御性用途不受影响:三条线路上「Web 应用防 SQL 注入的工程做法」都正常给出参数化查询、最小权限等完整答案。