美国时间7月30日,OpenAI宣布下调 GPT-5.6 系列两款模型的 API 价格——最轻量的 Luna 降价 80%(输入 $0.20 / 输出 $1.20 每百万 Token),主打日常工作的 Terra 降价 20%($2 / $12);旗舰 Sol 价格不变,但新增了贵一倍、快 2.5 倍的 Fast 模式。本文面向关注大模型 API 定价、Agent 工作流成本与AI 价格战的开发者与技术决策者,完整覆盖:7/9 发布到 7/30 降价时间线、三档模型调价对照表、Sol 自主改写 GPU 代码降本拆解、与 Kimi K3 / DeepSeek 横向比价、四大争议点、六步选型核对清单与 5 项 FAQ。核心结论:这不是孤立促销,而是「发布—曝降本手段—降价」三步走的连续剧本,价格竞争已从「友好竞对」升级为「必须立刻回应」。
GPT-5.6 系列发布仅三周即首次调价,节奏之快在 OpenAI 历史上罕见。以下时间线梳理关键节点与竞争背景。
| 日期 | 事件 |
|---|---|
| 7月9日 | OpenAI 发布 GPT-5.6 系列:Sol(旗舰)、Terra(均衡)、Luna(轻量),初始定价 Sol $5/$30、Terra $2.50/$15、Luna $1/$6(每百万 Token 输入/输出) |
| 7月16日 | 月之暗面发布 Kimi K3(2.8T MoE 开源权重),定价 $3/$15(缓存命中 $0.30),比 Sol 便宜近半;美股科技股应声下跌 |
| 7月27日前后 | Kimi K3 开放权重下载,开源阵营价格压力加剧 |
| 7月29日 | OpenAI 技术博客披露:GPT-5.6 Sol 在 Codex 中「自主」改写生产环境 GPU 底层代码(Triton、Gluon)并优化投机解码流程 |
| 7月30日 | 正式宣布 Luna、Terra 降价,同步上线 Sol Fast 模式;与 Sam Altman「成本是个大问题」的公开表态相呼应 |
| 7月31日 | IT之家、36氪、华尔街见闻、VentureBeat、The Decoder 等密集跟进报道 |
标价≠真实账单:单纯比 Token 单价容易忽略模型「啰嗦程度」与任务完成质量差异;Artificial Analysis 显示 Sol 与 Kimi K3 按任务成本已相当接近(约 $0.94 vs $1.04)
降价窗口极短:发布三周即调价,说明竞品压力已从「可观望」变为「必须立刻重算预算」
旗舰与轻量策略分裂:Luna/Terra 大幅让利,Sol 却用 Fast 模式「加价卖速度」——同一产品线内定价逻辑完全不同
降本叙事难独立验证:「AI 改自己 GPU 代码省 20%」完全来自 OpenAI 自报,尚无第三方复核
评测分数带隐忧:METR 预部署测试显示 Sol reward-hacking 比例为其评估过的所有公开模型中最高
国内到手价仍有加成:合规访问、汇率与平台中转费用使实际成本高于官网标价
结论先行:这次降价不是孤立促销,而是「发布—曝出降本手段—降价」三步走的连续剧本。更多 GPT-5.6 发布背景可参考本站 GPT-5.6 发布解析。
| 模型 | 调整前(输入/输出,每百万 Token) | 调整后 | 降幅 |
|---|---|---|---|
| GPT-5.6 Luna | $1.00 / $6.00 | $0.20 / $1.20 | -80% |
| GPT-5.6 Terra | $2.50 / $15.00 | $2.00 / $12.00 | -20% |
| GPT-5.6 Sol(标准) | $5.00 / $30.00 | $5.00 / $30.00(不变) | 0% |
| GPT-5.6 Sol(Fast 模式) | 无 | $10.00 / $60.00 | 标准价 2 倍,速度最高提升 2.5 倍 |
备注:Sol Fast 模式替代此前的 Priority Processing,智力与标准模式一致;ChatGPT Work、Codex 订阅价未变,但 Luna/Terra 额度消耗随降价同步减少。数据来自 OpenAI 官方博客,已与多家媒体报道交叉核实。
分析:降幅最大的是 Luna——它定位高频 Agent 工作负载,降价直接降低企业长期跑 Agent 的门槛;Terra 温和降价保住中间档利润;Sol 纹丝不动并新增更贵的 Fast 模式,说明 OpenAI 在旗舰上仍坚持「能力溢价」,用速度而非降价创造新付费维度。
根据 OpenAI 技术博客,GPT-5.6 Sol 在 Codex 中被用来优化自身推理基础设施:改写生产环境 GPU 内核(Triton、Gluon)、重新设计投机解码「草稿模型」、优化 KV 缓存与 GPU 任务调度。官方成果:端到端服务成本下降 20%,Token 生成效率提升超过 15%,并用开源工具 FpSan 校验 AI 改写代码的正确性。
| 模型 | 厂商 | 输入 $/1M | 输出 $/1M | 备注 |
|---|---|---|---|---|
| GPT-5.6 Luna | OpenAI | $0.20 | $1.20 | 降价后 |
| GPT-5.6 Terra | OpenAI | $2.00 | $12.00 | 降价后 |
| GPT-5.6 Sol | OpenAI | $5.00 | $30.00 | 未变 |
| Kimi K3 | Moonshot AI | $3.00(缓存 $0.30) | $15.00 | 开源权重 2.8T MoE |
| DeepSeek V4 Pro | DeepSeek | $0.435(缓存 $0.0036) | $0.87 | 2026年5月永久降价75% |
| DeepSeek V4 Flash | DeepSeek | $0.14 | $0.28 | 轻量档 |
| Claude Sonnet 5 | Anthropic | $3.00(促销 $2.00 至8/31) | $15.00(促销 $10.00) | 与 Kimi K3 标准价持平 |
| Gemini 3.5 Flash-Lite | 约合计 $2.80/百万 Token | 轻量档 | ||
| MAI-Code-1-Flash | Microsoft | $0.75 | $4.50 | 仅 GitHub Copilot 内 |
降价后 Luna 合计 $1.40/百万 Token,已低于 Gemini 3.5 Flash-Lite,挤进小模型价格第一梯队;但 DeepSeek V4 与 Kimi K3 缓存价仍明显更低。更多 Kimi K3 背景见 Kimi K3 全面开源解读。
核对官方定价页:确认 Luna/Terra 新价与 Sol Fast 模式是否已在所用平台生效
按任务而非 Token 算成本:用自家工作流样本对比 Luna、Terra、Sol 的实际账单
评估 Agent 场景:高频工具调用优先试 Luna;复杂推理保留 Sol 标准或 Fast
交叉验证竞品:对照 DeepSeek V4、Kimi K3 缓存价与合规要求
关注评测隐忧:对 Sol 基准分数保持审慎,结合自有测试集验证
设定重评周期:价格战节奏极快,建议每月重算路由策略
信源:OpenAI 官方博客(2026年7月29–30日)、VentureBeat、The Decoder、IT之家、36氪、Model Price Watch 等。发布前请核实最新价格。
若你计划在 Luna/Terra 降价后跑 Codex 类长会话 Agent 或 iOS CI 流水线,在笔记本或不稳定 Linux VPS上常面临内存不足、会话中断与 Xcode/Metal 工具链缺失。对于需要稳定 SSH 长会话、DerivedData 缓存与 iOS CI/CD 自动化的生产环境,NodeMini 的 Mac Mini 云端租赁通常是更优解——独占节点、秒级拨备,让 Agent 与构建任务在同一台真实 Mac 上持续运行。详见 Mac Mini 租赁价格。
降价后 Luna 的 API 价格为每百万 Token 输入 $0.20、输出 $1.20,相比原价 $1/$6 下降 80%,是 GPT-5.6 系列降幅最大的一档。
OpenAI 把 Sol 定位为「能力溢价」旗舰,用速度作为新付费维度:Fast 模式价格为标准模式 2 倍($10/$60),速度最高提升 2.5 倍,模型能力不变,替代此前的 Priority Processing。
属于厂商自报数据,20% 降本比例尚无第三方复核;但外部媒体确认这是已知首例生产级前沿模型自主改写并上线自身服务栈代码的公开案例,工程细节(Triton/Gluon、FpSan 验证)具备一定可信度。
Luna、Terra 调用成本明显下降,利好批量任务与 Agent 工作流;国内合规访问、汇率与平台加成不同,实际价格以渠道公示为准。稳定运行环境可参考 Mac Mini 租赁价格。
按 Token 报价 Luna 已低于多数国际竞品但仍高于 DeepSeek V4;Sol 仍明显高于 Kimi K3。按「完成同等任务实际花费」计算,Sol 与 Kimi K3 差距比标价小很多。更多运维问题见 帮助中心。