← 返回 Blog

国产低价护城河被攻破?OpenAI Luna 综合性价比首超 DeepSeek V4 Pro 深度拆解

2026 年 7 月 30 日,OpenAI 打出一记令整个 AI 行业猝不及防的重拳:发布仅三周的 GPT-5.6 Luna 大幅调价,输入单价从 1 美元降至 0.20 美元,输出单价从 6 美元下调至 1.20 美元,降幅高达 80%。 OpenAI CEO 萨姆·奥尔特曼在 X 上直言:"我们希望在每一个层级,都提供最佳的价格与智能比(price/intelligence tradeoff)。"这绝非普通调价,而是一封宣战书。

OpenAIChatGPTGPT-5.6 Luna 降价 80%

当低价护城河不再专属于中国:GPT-5.6 Luna 降价 80%,中美大模型价格战进入新阶段

2026 年 7 月 30 日,OpenAI 打出一记令整个 AI 行业猝不及防的重拳:发布仅三周的 GPT-5.6 Luna 大幅调价,输入单价从 1 美元降至 0.20 美元,输出单价从 6 美元下调至 1.20 美元,降幅高达 80%。

OpenAI CEO 萨姆·奥尔特曼在 X 上直言:"我们希望在每一个层级,都提供最佳的价格与智能比(price/intelligence tradeoff)。"这绝非普通调价,而是一封宣战书。

同系列 Terra 同步降价 20%,输入价由 2.5 美元降至 2 美元,输出价由 15 美元降至 12 美元。旗舰型号 Sol 维持原价不变,但新增 Fast 模式——以 2 倍价格提供最高 2.5 倍的推理速度,智能水平保持不变。

三款模型,三项调整,同一套战略逻辑:依靠 Luna 打响价格战,依托 Terra 守住中端市场,借助 Sol 维持高端利润。

纸面价格:Luna 输入端已低于 DeepSeek V4 Pro

先罗列两款模型的官方标价:

  • GPT-5.6 Luna(2026 年 7 月 30 日生效):输入 0.20 美元/百万词元,输出 1.20 美元/百万词元

  • DeepSeek V4 Pro 当前定价:输入 0.435 美元/百万词元(约人民币 3 元),输出 0.87 美元/百万词元(约人民币 6 元)

单看输入端,Luna 比 DeepSeek 便宜约 54%;单看输出端,DeepSeek 比 Luna 低约 27.5%。

但纸面对标价,远不能反映真实的成本结构。

DeepSeek 的真正王牌是缓存命中机制。缓存生效时,V4 Pro 输入单价从 3 元/百万词元骤降至 0.025 元/百万词元(约合 0.0036 美元),降幅超 99%。如果业务存在大量重复上下文输入,DeepSeek 实际使用成本几乎可以忽略不计。

DeepSeek 的软肋是峰谷分时计费。根据 DeepSeek 官方发给开发者的邮件,每日北京时间 9:00–12:00、14:00–18:00 为高峰时段,API 价格直接翻倍。高峰时段,V4 Pro 输入(缓存未命中)从 3 元涨至 6 元,输出从 6 元涨至 12 元。

换算成美元,DeepSeek V4 Pro 高峰时段输出单价约 1.4 美元/百万词元,已经高于 Luna 1.20 美元的输出定价

💡 这意味着:静态对比标价,Luna 在输入端碾压 DeepSeek;放到真实动态业务场景中,面对大量重复任务,DeepSeek 的缓存优势无可替代,但峰谷定价正在抹平它在输出端的成本优势。特别是在北京时间工作日的上午和下午核心时段——恰恰是企业调用 API 的最高频窗口——DeepSeek 的价格红利被显著压缩。

智能水平的差距,才是真正的分水岭

价格只是硬币的一面,另一面是模型智能能力。

第三方评测机构 Artificial Analysis 发布的 Intelligence Index v4.1 显示:GPT-5.6 Luna 智能指数突破 50 分,完成单任务平均成本约 0.05 美元(约合人民币 0.34 元);开启最大推理模式的 DeepSeek V4 Pro 智能指数约 44 分,单任务成本约 0.0448 美元。

OpenAI 在官方博客中放出基于该评测的价格-性能分布图,强调 Luna 在保持超过 50 分智能指数的同时,能够提供远超同智能水平模型的价格优势——Claude Opus 5、Gemini 3.6 Flash、GLM-5.2 Max 等模型拥有近乎相近的智能指数,但完成单项任务的成本更高。

DeepSeek V4 Pro 则位于更靠左的位置:单次任务成本低于多数前沿模型,但智能指数约为 44 分。

换算成"单位成本对应的智能水平",DeepSeek V4 Pro 拥有其自身的性价比优势;但 OpenAI 强调的重点是:在同等预算能够买到多少智能能力这一维度,Luna 实现了对 DeepSeek V4 Pro 的反超

这并非 Luna 单纯在"标价"上赢过 DeepSeek,而是在"价格-智能"综合坐标系上,把曲线向左上方推了近一步。

大幅降价的核心秘诀:AI 开始自我优化

如此激进的降价究竟如何实现?OpenAI 给出的答案令不少从业者感到警惕。

2026 年 7 月 29 日,OpenAI 发布技术博客披露:GPT-5.6 Sol 通过 Codex 接入了 OpenAI 的生产推理栈,自主参与了自身运行环境的优化工作

具体来看,Sol 在四层架构中完成了核心优化:

  • 生产 GPU 内核重写:Sol 学习并运用 OpenAI 自研的 Triton、Gluon 两套 GPU 编程语言,识别可预计算、可避免或可并行的工作,自主改写和优化生产环境中的 GPU 内核

  • 负载均衡优化:分析全网生产流量,发现工程师未曾留意的负载不均衡问题,测试全新路由调度策略

  • 推测解码(speculative decoding)升级:Sol 自主设计并运行了上百组词元生成实验,优化草稿模型,词元生成效率提升 15% 以上

  • 训练流程监控:在实验过程中出现硬件或训练异常时主动干预

优化成果十分明确:GPU 内核优化带来端到端服务成本下降 20%

💡 GPU 内核(GPU Kernel)可以理解为 GPU 上执行计算任务的底层程序。模型本身无需改动,只要底层代码运行效率更高,同一块 GPU 就能完成更多运算,单次调用成本随之下降。AI 正在优化运行 AI 的底层代码,左脚踩右脚,原地实现效能飞升。

Codex 负责人蒂博将这套模式总结为两步:第一步,训出一个足够强的模型;第二步,用这个模型去把一切变得更好,包括运行它自己的基础设施、推理栈和内核。OpenAI 总裁格雷格·布罗克曼直言:让 Sol 去提升生产服务效率,"正是它又强又便宜的原因之一"。

倒逼 OpenAI 降价的根本动因,并非技术,而是市场

拥有技术实现能力,不代表 OpenAI 愿意主动降价。真正迫使它下调定价的,是国产模型兵临硅谷城下的竞争压力。

CNBC 在 7 月 7 日发布一组震动硅谷的数据:在 OpenRouter 平台上,美国企业消耗的 Token 总量中,中国模型占比已经达到 46%。DeepSeek V4 Pro 长期维持 0.435 美元的低位输入价,叠加多家国内厂商持续推出高性价比 API 服务,不断分流海外中小开发者客户。

EMARKETER 高级分析师雅各布·伯恩评价此次降价是"Token 最大化时代的终结"——企业已经意识到"烧词元却不产生回报"有多容易,正在对这些不断上涨的 AI 账单说"不"。

OpenAI 推出定价 0.20 美元的 Luna,输入成本已经低于 DeepSeek V4 Pro。这是一场防御战:依靠 Luna 守住大规模推理业务的基本盘,依靠 Sol 稳住高端高利润业务底座。

一场非对称竞争

这场竞争的本质,不是单纯比拼"谁更便宜",而是两套商业逻辑的正面碰撞。

DeepSeek 的路线是极致成本优化:依托 MoE 混合专家架构、缓存机制、峰谷分时计费,把推理成本压缩至极限,护城河是低价。5 月 22 日,DeepSeek 宣布 V4 Pro API 价格永久降价 75%,创下全球顶级大模型价格新低,被网友戏称为"AI 大模型斩杀线"。

OpenAI 的策略是分层收割市场:Luna 冲锋打价格战抢夺流量,Terra 稳固中端市场,依靠 Sol 的智能溢价保障利润,护城河是更强的综合智能能力。

当 Luna 输入价低于 DeepSeek V4 Pro、智能指数高出近 6 分,同时 AI 实现底层自我优化——国产模型赖以立足的低价护城河正在被攻破。

当然,DeepSeek 缓存命中后的成本优势依旧是 Luna 难以企及的。在高频复用重复上下文的场景,DeepSeek 仍然拥有不可替代的成本优势。但这片"不可替代"的适用范围,正在不断收缩。

当"最低价"不再是中国模型独有的标签,大模型行业的下一轮战争,才刚刚拉开序幕。

对于企业与开发者而言,在 Luna 与 DeepSeek V4 Pro 之间二选一,往往意味着要在"性能"与"成本"之间反复权衡。而在实际生产中,更多企业面临的是多模型混合调度的现实需求——简单问答走 Luna,复杂推理走 Sol,缓存友好批量任务走 DeepSeek,视觉任务走 Gemini,长上下文分析走 Claude。

在这一领域,UseAIAPI​ 作为源头大模型 API 供应商,提供了一站式解决方案:

  • 全生态模型矩阵:单一接口无缝调用 GPT-5.6 Luna、GPT-5.6 Sol、Claude、Gemini、DeepSeek 等全球热门大模型的最新版本,覆盖对话、推理、多模态、嵌入等全场景,官方能力秒级同步。GPT-5.6 Luna 0.20 美元/百万输入词元的新低价红利,可第一时间享用

  • 企业级定制化服务:提供企业级 SLA 保障与定制化接入方案,让你无忧直接接入使用,可融入核心系统、适配集团架构;原生支持详尽日志溯源、细粒度权限审计与子账号管控,架构完全符合上市企业及跨国集团的 IT 数据安全与合规标准

  • 极具竞争力的接入成本:依托全球算力集采优势优化计费,优惠力度最低可达官方价格的 50%——当 OpenAI 把 Luna 打到 0.20 美元/百万输入词元、DeepSeek V4 Pro 缓存命中价低至 0.0036 美元时,企业侧通过 UseAIAPI 接入的综合成本可以进一步下探,让高强度内容生成与大规模智能体部署不再成为消耗负担

  • 智能语义缓存降本:平台内置智能语义缓存机制,与 DeepSeek 的上下文缓存机制异曲同工——对于存在大量重复上下文的企业级场景,可进一步压缩实际调用成本,让"缓存红利"在跨模型调度中同样生效

  • 极致性能架构:全球边缘节点加速,45ms 骨干网络超低延迟,99.9% 极致可用性保障;自研智能负载均衡,稳健承载百万美元级 API 吞吐,无惧流量洪峰

从 OpenAI 那张"Luna 综合性价比超越 DeepSeek V4 Pro"的评测图,到企业业务流中每一次模型调用,AI 能力的获取效率与成本,将决定下一代应用的竞争力上限。选择合适的接入基础设施,让业务在 AI 时代始终保持领先。