← 返回 Blog

OpenAI 打响夏季价格战:Luna 从 $1/$6 直降至 $0.20/$1.20,Terra、Sol 怎么变?

2026 年 7 月 30 日,OpenAI 对 GPT-5.6 系列祭出一套阶梯式调价方案:入门级 Luna 定价由 1 美元/6 美元下调至 0.20 美元/1.20 美元,降幅高达 80%;中端 Terra 自 2.50 美元/15 美元降至 2 美元/12 美元,降幅 20%;旗舰型号 Sol 标准单价维持不变,但在 API 中新增"Fast 模式",以标准模式 2 倍价格提供最高 2.5 倍推理速度,模型智能水平保持不变 。

OpenAIChatGPTGPT-5.6 三档重构

降价早已不止是简单下调价格:GPT-5.6 三档重构,智能体经济门槛整体下沉

2026 年 7 月 30 日,OpenAI 对 GPT-5.6 系列祭出一套阶梯式调价方案:入门级 Luna 定价由 1 美元/6 美元下调至 0.20 美元/1.20 美元,降幅高达 80%;中端 Terra 自 2.50 美元/15 美元降至 2 美元/12 美元,降幅 20%;旗舰型号 Sol 标准单价维持不变,但在 API 中新增"Fast 模式",以标准模式 2 倍价格提供最高 2.5 倍推理速度,模型智能水平保持不变 。

此时距离 GPT-5.6 系列 7 月 9 日正式发布,仅约三周 。如果你只看到"降价"二字,就完全错失了这件事释放的核心信号。

Luna:从简易轻量模型,变为智能体的"基础口粮"

本轮 Luna 的调价力度最为激进:每百万输入词元由 1 美元降至 0.2 美元,输出词元由 6 美元降至 1.2 美元。换算人民币,输入约 1.4 元,输出约 8.1 元 。

但真正值得深究的不是数字,而是 Luna 定位的重塑。

OpenAI 对 Luna 的官方定位是"GPT-5.6 系列中速度最快、成本最低的模型,适用于大规模、高频率任务处理,可支持工具调用和多步骤工作流程" 。通俗来讲:OpenAI 如今以过去简易小型模型的价位,对外售卖能够支撑智能体运行的完整能力模型

一套智能体工作流程需要发起数十次乃至上百次模型调用,过去仅词元开销就需要仔细核算。依托 Luna,这项成本已经低到近乎无需考量——这也是 OpenAI 敢于把 Luna 定位为"面向成本敏感、高负载场景"的根本底气 。

更值得关注的是,OpenAI 同步将 ChatGPT 应用与 Codex CLI 中的 Auto-review 从 GPT-5.4 升级到 GPT-5.6 Luna,结合 Luna 的新价格,Auto-review 预计成本将降低约 10 倍​ 。这意味着同样的订阅预算,企业用户能获得接近 10 倍的审查吞吐量。

Terra:中端防线的克制型降价

Terra 降幅仅有 20%,价格调整为 2 美元输入/12 美元输出。对比 Luna 近乎腰斩式降价,Terra 的调整显得相当克制。

克制背后暗藏微妙信号:OpenAI 将 Terra 定位为均衡场景下的"理性默认选择"——综合性能对标 GPT-5.5,成本却仅有后者一半 。这次 20% 降价,目标不是单纯压低售价,而是守住竞争最激烈的中端市场阵地

第三方评测机构 Artificial Analysis Intelligence Index v4.1 的数据显示,调价后的 GPT-5.6 Luna 在单位任务成本与模型综合得分构成的性价比维度,已经超越 DeepSeek V4 Pro 。Terra 的克制降价,恰好卡在竞品中端价格线之下,形成"Luna 打性价比、Terra 守中端、Sol 保利润"的三段防守。

Sol:原价不变,"速度"独立商品化

Sol 维持 5 美元输入/30 美元输出不变,但新增 Fast 模式:推理速度最高可达标准模式 2.5 倍,资费为标准模式两倍,模型智能水平保持不变 。

这并非"免费提速",而是把响应速度单独拆分出来进行售卖。原有的 Priority Processing 服务直接由 Fast 模式取代,已有标记 priority 的请求向后兼容,自动落入 Fast 模式 。

针对实时对话、流式输出这类延迟敏感场景,开发者可以选择支付双倍费用换取 2.5 倍推理速度。OpenAI 整套策略逻辑十分清晰:低价 Luna 抢占增量市场,中端 Terra 稳固阵地,高端 Sol 依靠"速度溢价"保障利润

💡 Terra 和 Luna 的降价已同步反映在 Codex 和 ChatGPT Work 的计费规则中——同样的企业订阅额度,现在能跑出更多的任务量。这是本次调价对企业用户最直接的红利 。

降价背后真正的秘密:AI 开始为自身降本

这次调价最令人脊背发凉的点,不在于价格数字,而是降价的底层动因。

OpenAI 在 7 月 29 日发布的官方技术博客中披露:GPT-5.6 Sol 通过 Codex 接入了 OpenAI 的生产推理栈,自主参与了自身运行环境的优化工作 。具体而言,Sol 在三层架构中完成了核心优化:

  • 生产 GPU 内核重写:Sol 学习并运用 OpenAI 自研的 Triton、Gluon 两套 GPU 编程语言,识别可预计算、可避免或可并行的工作,自主改写和优化生产环境中的 GPU 内核

  • 负载均衡优化:分析全网生产流量,发现工程师未曾留意的负载不均衡问题,测试全新路由调度策略

  • 推测解码(speculative decoding)升级:Sol 自主设计并运行了上百组词元生成实验,优化草稿模型,词元生成效率提升 15% 以上

  • 训练流程监控:在实验过程中出现硬件或训练异常时主动干预

优化成果十分明确:GPU 内核优化带来端到端服务成本下降 20%​ 。OpenAI 总裁 Greg Brockman 直言:让 GPT-5.6 Sol 去提升生产服务效率,"正是它又强又便宜的原因之一"。

AI 正在优化运行 AI 的底层代码,左脚踩右脚,原地实现效能飞升。​ Codex 负责人蒂博将这套模式总结为两步:第一步,训出一个足够强的模型;第二步,用这个模型去把一切变得更好,包括运行它自己的基础设施、推理栈和内核 。

这场价格战,OpenAI 本不愿打响

新品发布仅仅三周就大幅调价,原因并不复杂:被动应战

GPT-5.6 系列于 7 月 9 日正式发布,三周后立刻大幅降价,显然并非预先规划的节奏。压力来自两端:一边是 Anthropic 刚刚推出 Claude Opus 5,宣称是"性价比标杆产品";另一边来自中国厂商——DeepSeek V4 Pro 开启缓存后,输入价格低至 0.0036 美元/百万词元,月之暗面的 Kimi K3 也持续分流海外开发者 。EMARKETER 高级分析师雅各布·伯恩评价此次降价是"Token 最大化时代的终结"——企业已经意识到"烧词元却不产生回报"有多容易,正在对这些不断上涨的 AI 账单说"不" 。

不过 OpenAI 的应对不只是跟风降价。Artificial Analysis Intelligence Index v4.1 的评测数据显示,调价后的 GPT-5.6 Luna,在单位任务成本与模型综合得分构成的性价比维度,已经超越 DeepSeek V4 Pro 。奥尔特曼在 X 上明确表态:"我们希望在每一个层级都提供最佳的价格与智能水平的平衡。"

三大信号,指向同一个结论

本次定价调整释放三条清晰信号:

第一,智能体经济的成本壁垒正在瓦解。

Luna 以昔日简易分类模型的定价,提供完整智能体运行能力。当调用成本低到无需精打细算,开发者搭建智能体的决策逻辑,会从"尽可能节省开支"转向"只要有用就可以部署",这是本质性质变。

第二,"速度"成为独立付费维度。

Sol Fast 模式将响应速度拆分单独定价,意味着 AI 服务的竞争赛道持续拓宽,比拼重心不再局限于"模型谁更聪明",开始延伸到"谁响应更快"。

第三,AI 已经开启自主优化进程。

这并非科幻设想。2026 年 7 月 30 日 OpenAI 官方博客明确说明,Sol 自主重写承载自身运行的内核代码。效率提升不再是线性增长,而是形成持续自我强化的正反馈循环 。

当模型能够自主优化支撑自身运转的基础设施,"降价"就不再是单纯营销手段,而是系统自我演化自然而然产生的副产品。而这一切变革的起点,正是 Luna 0.20 美元的输入定价。

对个人开发者而言,这意味着从今天起,调用一个具备完整智能体能力的模型,成本已经低到无需犹豫。而对更广泛的企业与开发者群体而言,如何把 GPT-5.6 Luna、GPT-5.6 Sol、Claude、Gemini、DeepSeek 等全球主流大模型能力,稳定、合规、低成本地接入自有业务系统,是另一个维度的现实课题。

在这一领域,UseAIAPI​ 作为源头大模型 API 供应商,提供了一站式解决方案:

  • 全生态模型矩阵:单一接口无缝调用 GPT、Claude、Gemini、DeepSeek 等全球热门大模型的最新版本,覆盖对话、推理、多模态、嵌入等全场景,官方能力秒级同步。GPT-5.6 系列发布即接入,Luna 0.20 美元/百万输入词元的低价红利可第一时间享用

  • 企业级定制化服务:提供企业级 SLA 保障与定制化接入方案,让你无忧直接接入使用,可融入核心系统、适配集团架构;Terra 和 Luna 的降价红利,可在企业计费体系中直接体现

  • 极具竞争力的接入成本:依托全球算力集采优势优化计费,优惠力度最高可达官方价格的 50%——当 OpenAI 把 Luna 打到 0.20 美元/百万输入词元时,企业侧通过 UseAIAPI 接入的综合成本可以进一步下探,让高强度内容生成与大规模智能体部署不再成为消耗负担,企业可将更多预算投入到核心业务创新中

  • 即接即用:兼容 OpenAI 协议,一行代码即可切换模型,国内直连低延迟;Auto-review 场景预计 10 倍成本优化的红利,也可在企业代码审查工作流中快速落地

从 OpenAI 那价值 0.20 美元、足以承载一百万次思考的算力,到企业业务流中每一次模型调用,AI 能力的获取效率与成本,将决定下一代应用的竞争力上限。选择合适的接入基础设施,让业务在 AI 时代始终保持领先。