GPT-5.6 Luna 直接降价 80%:百万 Token 输出只要 1.2 美元
OpenAI 下调 GPT-5.6 Terra 与 Luna API 价格:Terra 降价 20%,Luna 降价 80%,输入最低 0.20 美元、输出 1.20 美元 / 百万 token,Sol 价格不变。
本文发布于 51 天前,内容可能已过时,请注意甄别。
OpenAI 宣布下调 GPT-5.6 系列中 Terra 与 Luna 的价格。
从 7 月 30 日起,Terra 输入价格下降 20%,Luna 输入与输出价格下降 80%。Sol 价格不变,ChatGPT 和 Codex 订阅价格、配额预算也不变;但 Terra 与 Luna 在订阅产品中的使用会消耗更少额度。
新旧价格
以下为每百万 token 的标准 API 价格:
| 模型 | 原输入 / 输出 | 新输入 / 输出 | 降幅 |
|---|---|---|---|
| GPT-5.6 Sol | $5 / $30 | $5 / $30 | 不变 |
| GPT-5.6 Terra | $2.50 / $15 | $2 / $12 | 20% |
| GPT-5.6 Luna | $1 / $6 | $0.20 / $1.20 | 80% |
Luna 的新价格尤其激进:输入每百万 token 只要 0.20 美元,输出 1.20 美元。对批量分类、代码实现、文档处理和多步骤 Agent 来说,价格已经从“尝试更强模型”变成了“可以默认接入生产流程”。
这次降价意味着什么?
OpenAI 给出的解释是,模型路由、推理系统、生产软件和上下文管理都变得更高效,因此把成本节省让渡给客户。
对开发者而言,最直接的变化是模型分工更清晰:
- Sol:复杂推理、关键决策和高难度任务,价格保持不变
- Terra:日常知识工作和中等复杂度 Agent,成为更便宜的平衡选项
- Luna:高并发、低成本和重复性工作,适合大规模调用
一个典型工作流可以先用 Sol 制定方案、处理不确定性,再用 Luna 执行已经明确的代码修改、测试和结果检查。OpenAI 也明确把这种“按任务阶段匹配模型”的方式作为 GPT-5.6 系列的主要使用逻辑。
API 还有一个变化:Priority Processing 更名 Fast mode
OpenAI 同时在 API 中推出 Fast mode,替代原来的 Priority Processing。
GPT-5.6 Sol 使用 Fast mode 时,速度最高可达到 Standard 处理的 2.5 倍,价格为标准价格的 2 倍,但模型智能水平不变。原先带有 service_tier: "priority" 的请求仍然兼容,会自动使用 Fast mode。
个人用户能直接省钱吗?
要区分 API 和订阅产品:
- API 用户:Terra、Luna 立即按照新价格计费
- ChatGPT Work 与 Codex 用户:订阅价格不变,但 Terra、Luna 会占用更少额度
- Sol 用户:API 价格和订阅价格均没有变化
所以,这不是一次 ChatGPT Plus 或 Pro 直接降价,而是 OpenAI 对模型调用成本的调整。真正能感受到美元账单变化的,主要是 API 开发者和高频调用企业。
最后
GPT-5.6 这次最重要的变化不是 Sol 变便宜,而是 Luna 把高质量模型的批量调用门槛大幅压低。Terra 负责更稳妥的日常任务,Luna 负责规模化执行,Sol 继续承担高价值难题。
模型价格战正在从“旗舰模型谁更强”转向“同一工作流能否用更便宜的模型完成更多步骤”。对开发者来说,现在值得重新测一遍现有 Agent 的路由策略:很多原本只能用中高端模型完成的环节,可能已经可以交给 Luna。
来源:OpenAI:Advancing the price-performance frontier with GPT-5.6
更多文章