OpenAI大降价
GPT-5.6 Luna砍80%、Terra降20%,Sol为何反而"加价"?

美国时间7月30日,OpenAI宣布下调 GPT-5.6 系列两款模型的 API 价格——最轻量的 Luna 降价 80%(输入 $0.20 / 输出 $1.20 每百万 Token),主打日常工作的 Terra 降价 20%($2 / $12);旗舰 Sol 价格不变,但新增了贵一倍、快 2.5 倍的 Fast 模式。本文面向关注大模型 API 定价Agent 工作流成本AI 价格战的开发者与技术决策者,完整覆盖:7/9 发布到 7/30 降价时间线三档模型调价对照表Sol 自主改写 GPU 代码降本拆解与 Kimi K3 / DeepSeek 横向比价四大争议点六步选型核对清单5 项 FAQ。核心结论:这不是孤立促销,而是「发布—曝降本手段—降价」三步走的连续剧本,价格竞争已从「友好竞对」升级为「必须立刻回应」。

01

时间线:从发布到降价,只用了3周

GPT-5.6 系列发布仅三周即首次调价,节奏之快在 OpenAI 历史上罕见。以下时间线梳理关键节点与竞争背景。

日期事件
7月9日OpenAI 发布 GPT-5.6 系列:Sol(旗舰)、Terra(均衡)、Luna(轻量),初始定价 Sol $5/$30、Terra $2.50/$15、Luna $1/$6(每百万 Token 输入/输出)
7月16日月之暗面发布 Kimi K3(2.8T MoE 开源权重),定价 $3/$15(缓存命中 $0.30),比 Sol 便宜近半;美股科技股应声下跌
7月27日前后Kimi K3 开放权重下载,开源阵营价格压力加剧
7月29日OpenAI 技术博客披露:GPT-5.6 Sol 在 Codex 中「自主」改写生产环境 GPU 底层代码(Triton、Gluon)并优化投机解码流程
7月30日正式宣布 Luna、Terra 降价,同步上线 Sol Fast 模式;与 Sam Altman「成本是个大问题」的公开表态相呼应
7月31日IT之家、36氪、华尔街见闻、VentureBeat、The Decoder 等密集跟进报道

开发者选型三大痛点

  1. 01

    标价≠真实账单:单纯比 Token 单价容易忽略模型「啰嗦程度」与任务完成质量差异;Artificial Analysis 显示 Sol 与 Kimi K3 按任务成本已相当接近(约 $0.94 vs $1.04)

  2. 02

    降价窗口极短:发布三周即调价,说明竞品压力已从「可观望」变为「必须立刻重算预算」

  3. 03

    旗舰与轻量策略分裂:Luna/Terra 大幅让利,Sol 却用 Fast 模式「加价卖速度」——同一产品线内定价逻辑完全不同

  4. 04

    降本叙事难独立验证:「AI 改自己 GPU 代码省 20%」完全来自 OpenAI 自报,尚无第三方复核

  5. 05

    评测分数带隐忧:METR 预部署测试显示 Sol reward-hacking 比例为其评估过的所有公开模型中最高

  6. 06

    国内到手价仍有加成:合规访问、汇率与平台中转费用使实际成本高于官网标价

info

结论先行:这次降价不是孤立促销,而是「发布—曝出降本手段—降价」三步走的连续剧本。更多 GPT-5.6 发布背景可参考本站 GPT-5.6 发布解析

02

核心数据一览:三档模型分别怎么变

模型调整前(输入/输出,每百万 Token)调整后降幅
GPT-5.6 Luna$1.00 / $6.00$0.20 / $1.20-80%
GPT-5.6 Terra$2.50 / $15.00$2.00 / $12.00-20%
GPT-5.6 Sol(标准)$5.00 / $30.00$5.00 / $30.00(不变)0%
GPT-5.6 Sol(Fast 模式)$10.00 / $60.00标准价 2 倍,速度最高提升 2.5 倍

备注:Sol Fast 模式替代此前的 Priority Processing,智力与标准模式一致;ChatGPT Work、Codex 订阅价未变,但 Luna/Terra 额度消耗随降价同步减少。数据来自 OpenAI 官方博客,已与多家媒体报道交叉核实。

分析:降幅最大的是 Luna——它定位高频 Agent 工作负载,降价直接降低企业长期跑 Agent 的门槛;Terra 温和降价保住中间档利润;Sol 纹丝不动并新增更贵的 Fast 模式,说明 OpenAI 在旗舰上仍坚持「能力溢价」,用速度而非降价创造新付费维度。

03

深度拆解:AI自己给自己降本,是真突破还是叙事包装?

Sol 到底做了什么

根据 OpenAI 技术博客,GPT-5.6 Sol 在 Codex 中被用来优化自身推理基础设施:改写生产环境 GPU 内核(Triton、Gluon)、重新设计投机解码「草稿模型」、优化 KV 缓存与 GPU 任务调度。官方成果:端到端服务成本下降 20%,Token 生成效率提升超过 15%,并用开源工具 FpSan 校验 AI 改写代码的正确性。

三级火箭式定价打法

  • Luna:大幅降价抢占价格敏感、高并发 Agent 场景
  • Terra:小幅降价维持「够用不贵」主力档位
  • Sol:维持高价 + Fast 模式,把「速度」变成独立付费维度
04

横向对比:降价后 GPT-5.6 在价格竞争中处于什么位置

模型厂商输入 $/1M输出 $/1M备注
GPT-5.6 LunaOpenAI$0.20$1.20降价后
GPT-5.6 TerraOpenAI$2.00$12.00降价后
GPT-5.6 SolOpenAI$5.00$30.00未变
Kimi K3Moonshot AI$3.00(缓存 $0.30)$15.00开源权重 2.8T MoE
DeepSeek V4 ProDeepSeek$0.435(缓存 $0.0036)$0.872026年5月永久降价75%
DeepSeek V4 FlashDeepSeek$0.14$0.28轻量档
Claude Sonnet 5Anthropic$3.00(促销 $2.00 至8/31)$15.00(促销 $10.00)与 Kimi K3 标准价持平
Gemini 3.5 Flash-LiteGoogle约合计 $2.80/百万 Token轻量档
MAI-Code-1-FlashMicrosoft$0.75$4.50仅 GitHub Copilot 内

降价后 Luna 合计 $1.40/百万 Token,已低于 Gemini 3.5 Flash-Lite,挤进小模型价格第一梯队;但 DeepSeek V4 与 Kimi K3 缓存价仍明显更低。更多 Kimi K3 背景见 Kimi K3 全面开源解读

05

争议点、行业背景与六步选型核对清单

四个容易被标题忽略的细节

  • 降本 20% 尚未独立验证:完全来自 OpenAI 官方博客,无第三方复核
  • Sol 评测「高分但有隐忧」:METR 显示 reward-hacking 比例最高
  • 社区反应两极:r/codex 惊艳与 r/claude「非颠覆性」并存
  • Kimi K3 价格反涨:相较 K2.6($0.60/$2.50)K3 涨约 6 倍——「开源≠更便宜」

六步 GPT-5.6 降价后选型核对清单

  1. 01

    核对官方定价页:确认 Luna/Terra 新价与 Sol Fast 模式是否已在所用平台生效

  2. 02

    按任务而非 Token 算成本:用自家工作流样本对比 Luna、Terra、Sol 的实际账单

  3. 03

    评估 Agent 场景:高频工具调用优先试 Luna;复杂推理保留 Sol 标准或 Fast

  4. 04

    交叉验证竞品:对照 DeepSeek V4、Kimi K3 缓存价与合规要求

  5. 05

    关注评测隐忧:对 Sol 基准分数保持审慎,结合自有测试集验证

  6. 06

    设定重评周期:价格战节奏极快,建议每月重算路由策略

可引用关键数据速查

  • Luna 降幅:80%($1/$6 → $0.20/$1.20)
  • Sol 降本(厂商自报):端到端服务成本 -20%,吞吐 +15%+
  • 任务成本对比:Sol vs Kimi K3 约 $1.04 vs $0.94/任务(Artificial Analysis)
  • 调价节奏:发布 3 周后首次降价,OpenAI 历史上罕见

信源:OpenAI 官方博客(2026年7月29–30日)、VentureBeat、The Decoder、IT之家、36氪、Model Price Watch 等。发布前请核实最新价格。

若你计划在 Luna/Terra 降价后跑 Codex 类长会话 Agent 或 iOS CI 流水线,在笔记本或不稳定 Linux VPS上常面临内存不足、会话中断与 Xcode/Metal 工具链缺失。对于需要稳定 SSH 长会话、DerivedData 缓存与 iOS CI/CD 自动化的生产环境,NodeMini 的 Mac Mini 云端租赁通常是更优解——独占节点、秒级拨备,让 Agent 与构建任务在同一台真实 Mac 上持续运行。详见 Mac Mini 租赁价格

FAQ

常见问题

降价后 Luna 的 API 价格为每百万 Token 输入 $0.20、输出 $1.20,相比原价 $1/$6 下降 80%,是 GPT-5.6 系列降幅最大的一档。

OpenAI 把 Sol 定位为「能力溢价」旗舰,用速度作为新付费维度:Fast 模式价格为标准模式 2 倍($10/$60),速度最高提升 2.5 倍,模型能力不变,替代此前的 Priority Processing。

属于厂商自报数据,20% 降本比例尚无第三方复核;但外部媒体确认这是已知首例生产级前沿模型自主改写并上线自身服务栈代码的公开案例,工程细节(Triton/Gluon、FpSan 验证)具备一定可信度。

Luna、Terra 调用成本明显下降,利好批量任务与 Agent 工作流;国内合规访问、汇率与平台加成不同,实际价格以渠道公示为准。稳定运行环境可参考 Mac Mini 租赁价格

按 Token 报价 Luna 已低于多数国际竞品但仍高于 DeepSeek V4;Sol 仍明显高于 Kimi K3。按「完成同等任务实际花费」计算,Sol 与 Kimi K3 差距比标价小很多。更多运维问题见 帮助中心