Skip to main content

核心要点

  • 价格又降了gpt-6-sol 输入 $2 / 输出 $10,gpt-6-luna 输入 $0.10 / 输出 $0.50(每百万 tokens),约为上一代 gpt-5.6-sol / gpt-5.6-luna 的一半。OpenAI 明确这是长期价格,不是限时促销
  • 两档分工清晰:Sol 面向写功能、审代码、调试、数据分析这类日常复杂工作;Luna 面向摘要、抽取、简单问答等大批量任务
  • 规格与旗舰同级:两款都是 1.05M 上下文、128K 最大输出,推理力度六档(nonemax),默认 medium
  • API易 已上线default / svip / CodexResponses 分组可用,四项计费与官网一致;/v1/chat/completions/v1/responses 双端点、含函数调用全部实测通过
  • 与 Claude 同日降价:同一天 Anthropic 发布了降价的 Claude Opus 5.5。两家旗舰厂商同时让利,最直接的受益者是开发者和终端用户

背景介绍

9 月 3 日 OpenAI 发布了新旗舰 GPT-6 Astra,定价 $10 / $50,定位是电脑操作与长程 Agent。19 天后的 9 月 22 日,GPT-6 系列补齐了中档和轻量档:Sol 和 Luna 这次发布的重点不在跑分,而在价格。Sol 的输入输出价比上一代 gpt-5.6-sol 各降一半,Luna 的输出价从 $1.20 降到 $0.50。官方特别说明这组价格是长期定价,不是上线期的促销价。 巧合的是,同一天 Anthropic 也发布了 Claude Opus 5.5,价格同样低于上一代。两家头部厂商在同一天降价,说明大模型价格竞争还在继续:同样的预算能做更多事,或者同样的任务花更少的钱。对在 API易 上同时使用两家模型的团队来说,这是一次可以直接体现在账单上的利好。 API易 已同步上线 gpt-6-solgpt-6-luna输入、输出、缓存读取、缓存写入四项计费全部与官网一致

详细解析

两个模型怎么选

GPT-6 Sol:日常主力

写功能、审代码、调试、数据分析等复杂但重复发生的工作。DeepSWE v1.1 得分 68.8%,FrontierCode 在 xhigh 档与 Claude Fable 5.1 持平

GPT-6 Luna:大批量

摘要、信息抽取、简单问答、分类等边界清晰的任务。输出 $0.50 每百万 tokens,DeepSWE v1.1 仍有 66.6%
和系列内另外一档的关系:需要电脑操作、最长程 Agent 任务时用 gpt-6-astra;其余大部分负载先用 Sol 评测;量大、任务简单的交给 Luna。

性能基准

官方给了一组性价比对比:AutomationBench 上,Sol 在 xhigh 档得 33.2%,每个任务成本约 $0.27;Claude Opus 5 在 max 档得 26.9%,成本约为 Sol 的 11 倍。
数据来源:OpenAI 官方发布材料,以及 VentureBeat、MarkTechPost 的转述(2026 年 9 月 22 日),尚无独立复现。表中括号为测试时的推理力度档位。数据获取时间:2026 年 9 月 23 日。

技术规格

API易 端点实测(2026 年 9 月 23 日)

上线当天我们对两个模型各做了 5 组最小请求,10 组全部 HTTP 200
和 GPT-6 Astra 不同,Sol 和 Luna 在 Chat Completions 端点上可以带函数工具toolsreasoning_effort 也能同时传。存量的 Chat 代码只需改模型名。
输出上限要给推理留余量:推理 token 计入输出上限。实测 Luna 在 max_output_tokens 设为 64 时,额度全部用在推理上,没有返回正文。日常调用不要把上限压得太紧。

实际应用

代码示例

最佳实践

  • 从 5.6 迁移只改模型名gpt-5.6-solgpt-6-solgpt-5.6-lunagpt-6-luna,两个端点的请求结构都不变
  • 推理力度按任务选:默认 medium。编程、Agent 任务可以提到 highxhigh;Luna 跑批量摘要、抽取时用 lownone,速度更快、推理 token 更少
  • 用好缓存:缓存读取是标准输入价的十分之一。把系统提示、工具定义这些稳定内容放在消息开头,多轮对话每一轮都能命中
  • 上下文尽量压在 272K 以内:超过后整单进入更高一档计费(见下方阶梯表)

价格与可用性

定价信息

原厂公布价格(单位:美元 / 百万 tokens,输入 272K 以内): 上表同时就是 API易 的定价:四项计费与官网逐项一致,没有加价
**我们的定价与官网一致,不在模型价格上加价。**在此之上,部分分组另有折扣,也可叠加充值加赠活动,这部分是我们的让利,与模型本身的定价无关。充值按固定汇率 1:7 结算。

长上下文阶梯

与官网一致,单次请求输入超过 272K tokens 时,整条请求按第二档计费(输入与缓存 ×2,输出 ×1.5): 阶梯按单次请求判定,不按账户累计。具体数值以 模型价格页 实时数据为准。

可用分组与端点

分组差异见 分组说明

叠加网站充值活动

可结合 API易 充值加赠活动进一步降低实际成本,详见:充值优惠说明

总结与建议

GPT-6 Sol 和 Luna 把 OpenAI 的主力档和轻量档价格都降到了上一代的一半左右,而且是长期价格。加上同一天发布的 Claude Opus 5.5 也在降价,两家头部厂商同时让利,开发者可以用更少的预算跑更多的任务。 使用建议
  1. 正在用 gpt-5.6-sol / gpt-5.6-luna 的用户:直接换模型名,成本约减半,Chat 与 Responses 两个端点都不用改代码
  2. 成本敏感的批量任务:Luna 输出只要 $0.50 每百万 tokens,配合 low 推理力度和缓存,适合大规模摘要、抽取
  3. 不确定选哪家:API易 上 GPT-6 与 Claude 两个系列都能用同一个 Key 调用,可以拿自己的任务分别跑一轮对比
信息来源:OpenAI 官方模型文档 developers.openai.com/api/docs/models/gpt-6-soldevelopers.openai.com/api/docs/models/gpt-6-luna,以及 VentureBeat、MarkTechPost、TechCrunch 等媒体报道。端点实测由 API易 于 2026 年 9 月 23 日完成。API易定价以平台实时数据为准。