OpenAI 将 GPT-5.6 Luna API 价格下调 80%,并新增更快的 Sol 层
Luna 的输入费用降至每百万个 token $0.20,输出费用降至每百万个 token $1.20;Sol Fast 模式承诺在价格为标准费率两倍的情况下提供最高 2.5 倍的速度。
By Ryan Merket · Published
Primary source: OpenAI on X
Why it matters
Luna's 80% price cut can materially lower the cost of coding agents, review systems and high-volume automation. OpenAI is using inference pricing and latency tiers to drive API adoption without cutting Sol's standard rate.

OpenAI (@OpenAI) 在 7 月 30 日将 GPT-5.6 Luna 的 API 价格下调了 80%,将 GPT-5.6 Terra 下调了 20%,同时为其旗舰模型 GPT-5.6 Sol 推出了一种更快的处理选项。此次降价将 Luna 的价格降至每百万输入标记 $0.20、每百万输出标记 $1.20,而 Terra 现在的输入为每百万 $2、输出为每百万 $12。(developers.openai.com)
对于联合创始人兼 CEO Sam Altman,这一定价举措推进了他在四月重申的一个分发论点:OpenAI 希望将越来越强大的通用 AI 放到尽可能多人的手中。直接的商业影响更狭窄且更易衡量。开发者现在可以在 Luna 上以 GPT-5.6 系列在 7 月 9 日正式可用时 OpenAI 收取价格的五分之一来运行高量工作负载。(openai.com)
OpenAI 以三档发布了 GPT-5.6:Sol 用于最高能力的工作,Terra 用于在性能和成本之间平衡的工作负载,Luna 则面向对成本敏感的高量级应用。发布时,OpenAI 将 Luna 定价为每百万输入标记 $1、每百万输出标记 $6。Terra 则分别为 $2.50 和 $15。Sol 的标准价格仍为每百万输入 $5、每百万输出 $30。(openai.com)
发生了什么变化
更新后的 Luna 文档 列出了一项 $0.02 的缓存输入费率,外加新的 $0.20 输入和 $1.20 输出价格。Terra 文档 列出缓存输入为 $0.20、标准输入为 $2、输出为 $12。两款模型均保留了 105 万标记的上下文窗口和 128,000 标记的最大输出。包含超过 272,000 输入标记的请求仍适用于更高的长上下文费率。(developers.openai.com)
OpenAI 还为 GPT-5.6 Sol 引入了 [Fast mode],承诺在模型智力不变的情况下,速度最高可达 Standard 处理的 2.5 倍。Fast mode 的每标记费率为标准的两倍,使得短上下文的 Sol 请求定价为每百万输入标记 $10、每百万缓存输入标记 $1 以及每百万输出标记 $60。开发者可以通过 service_tier: "fast" 或旧的 service_tier: "priority" 设置来激活它。OpenAI 在 7 月 30 日将 Priority processing 重命名为 Fast mode。(developers.openai.com)
这一定价在响应时间影响转化率、完成率或人工审核的应用场景中创造了直接的权衡。开发者可以将 Sol 的 Standard 处理用于后台工作,然后在面向用户且延迟成本高于标记成本的请求上支付溢价使用 Fast mode。OpenAI 的文档建议不要通过 Fast mode 发送大型批处理或数据处理作业。(developers.openai.com)
OpenAI 将 Luna 更深入地推入代理工作流程
公司还将 ChatGPT 应用和 Codex CLI 中的 Auto-review 从 GPT-5.4 迁移到 GPT-5.6 Luna。OpenAI 表示,模型更换和降价应该会将 Auto-review 的成本降低约 10 倍。该估算由公司提供,实际节省将取决于一次审查消耗的标记数量以及工作负载是否触发长上下文定价。
Auto-review 的变更展示了 OpenAI 预计定价影响最大的领域。Agent 产品可能会为规划、工具使用、验证和审查反复调用模型,因此工作流的成本可能比单次提示的价格增长得更快。80% 的降幅为开发者在运行二次检查、维持更长会话或为低价值任务提供服务时留出了更大的空间,而无需将这些任务移出 GPT-5.6 系列。
OpenAI 在 6 月 26 日发布了有限的 GPT-5.6 预览,并在 7 月 9 日将该系列普遍开放。仅在三周后就下调 Luna 的价格表明推理经济性已成为产品发布周期本身的一部分。OpenAI 正在利用低成本模型来扩大 API 的分发,同时为 Sol 保留溢价定价,并在客户需要更高速度时单独收费。(openai.com)