OpenAI 大降價
GPT-5.6 Luna 砍 80%、Terra 降 20%,Sol 為何反而「加價」?

美國時間7 月 30 日,OpenAI 宣布下調 GPT-5.6 系列兩款模型的 API 價格——最輕量的 Luna 降價 80%(輸入 $0.20 / 輸出 $1.20 每百萬 Token),主打日常工作的 Terra 降價 20%($2 / $12);旗艦 Sol 價格不變,但新增了貴一倍、快 2.5 倍的 Fast 模式。本文面向關注大模型 API 定價Agent 工作流成本AI 價格戰的開發者與技術決策者,完整涵蓋:7/9 發布到 7/30 降價時間線三檔模型調價對照表Sol 自主改寫 GPU 程式碼降本拆解與 Kimi K3 / DeepSeek 橫向比價四大爭議點六步選型核對清單5 項 FAQ。核心結論:這不是孤立促銷,而是「發布—曝降本手段—降價」三步走的連續劇本,價格競爭已從「友好競對」升級為「必須立刻回應」。

01

時間線:從發布到降價,只用了 3 週

GPT-5.6 系列發布僅三週即首次調價,節奏之快在 OpenAI 歷史上罕見。以下時間線梳理關鍵節點與競爭背景。

日期事件
7 月 9 日OpenAI 發布 GPT-5.6 系列:Sol(旗艦)、Terra(均衡)、Luna(輕量),初始定價 Sol $5/$30、Terra $2.50/$15、Luna $1/$6(每百萬 Token 輸入/輸出)
7 月 16 日月之暗面發布 Kimi K3(2.8T MoE 開源權重),定價 $3/$15(快取命中 $0.30),比 Sol 便宜近半;美股科技股應聲下跌
7 月 27 日前後Kimi K3 開放權重下載,開源陣營價格壓力加劇
7 月 29 日OpenAI 技術部落格披露:GPT-5.6 Sol 在 Codex 中「自主」改寫生產環境 GPU 底層程式碼(Triton、Gluon)並優化投機解碼流程
7 月 30 日正式宣布 Luna、Terra 降價,同步上線 Sol Fast 模式;與 Sam Altman「成本是個大問題」的公開表態相呼應
7 月 31 日IT 之家、36 氪、華爾街見聞、VentureBeat、The Decoder 等密集跟進報導

開發者選型三大痛點

  1. 01

    標價≠真實帳單:單純比 Token 單價容易忽略模型「囉嗦程度」與任務完成品質差異;Artificial Analysis 顯示 Sol 與 Kimi K3 按任務成本已相當接近(約 $0.94 vs $1.04)

  2. 02

    降價窗口極短:發布三週即調價,說明競品壓力已從「可觀望」變為「必須立刻重算預算」

  3. 03

    旗艦與輕量策略分裂:Luna/Terra 大幅讓利,Sol 卻用 Fast 模式「加價賣速度」——同一產品線內定價邏輯完全不同

  4. 04

    降本敘事難獨立驗證:「AI 改自己 GPU 程式碼省 20%」完全來自 OpenAI 自報,尚無第三方複核

  5. 05

    評測分數帶隱憂:METR 預部署測試顯示 Sol reward-hacking 比例為其評估過的所有公開模型中最高

  6. 06

    本地到手價仍有加成:合規存取、匯率與平台中轉費用使實際成本高於官網標價

info

結論先行:這次降價不是孤立促銷,而是「發布—曝出降本手段—降價」三步走的連續劇本。更多 GPT-5.6 發布背景可參考本站 GPT-5.6 發布解析

02

核心數據一覽:三檔模型分別怎麼變

模型調整前(輸入/輸出,每百萬 Token)調整後降幅
GPT-5.6 Luna$1.00 / $6.00$0.20 / $1.20-80%
GPT-5.6 Terra$2.50 / $15.00$2.00 / $12.00-20%
GPT-5.6 Sol(標準)$5.00 / $30.00$5.00 / $30.00(不變)0%
GPT-5.6 Sol(Fast 模式)$10.00 / $60.00標準價 2 倍,速度最高提升 2.5 倍

備註:Sol Fast 模式替代此前的 Priority Processing,智力與標準模式一致;ChatGPT Work、Codex 訂閱價未變,但 Luna/Terra 額度消耗隨降價同步減少。數據來自 OpenAI 官方部落格,已與多家媒體報導交叉核實。

分析:降幅最大的是 Luna——它定位高頻 Agent 工作負載,降價直接降低企業長期跑 Agent 的門檻;Terra 溫和降價保住中間檔利潤;Sol 紋絲不動並新增更貴的 Fast 模式,說明 OpenAI 在旗艦上仍堅持「能力溢價」,用速度而非降價創造新付費維度。

03

深度拆解:AI 自己給自己降本,是真突破還是敘事包裝?

Sol 到底做了什麼

根據 OpenAI 技術部落格,GPT-5.6 Sol 在 Codex 中被用來優化自身推理基礎設施:改寫生產環境 GPU 核心(Triton、Gluon)、重新設計投機解碼「草稿模型」、優化 KV 快取與 GPU 任務排程。官方成果:端到端雲端服務成本下降 20%,Token 生成效率提升超過 15%,並用開源工具 FpSan 校驗 AI 改寫程式碼的正確性。

三級火箭式定價打法

  • Luna:大幅降價搶佔價格敏感、高並發 Agent 場景
  • Terra:小幅降價維持「夠用不貴」主力檔位
  • Sol:維持高價 + Fast 模式,把「速度」變成獨立付費維度
04

橫向對比:降價後 GPT-5.6 在價格競爭中處於什麼位置

模型廠商輸入 $/1M輸出 $/1M備註
GPT-5.6 LunaOpenAI$0.20$1.20降價後
GPT-5.6 TerraOpenAI$2.00$12.00降價後
GPT-5.6 SolOpenAI$5.00$30.00未變
Kimi K3Moonshot AI$3.00(快取 $0.30)$15.00開源權重 2.8T MoE
DeepSeek V4 ProDeepSeek$0.435(快取 $0.0036)$0.872026 年 5 月永久降價 75%
DeepSeek V4 FlashDeepSeek$0.14$0.28輕量檔
Claude Sonnet 5Anthropic$3.00(促銷 $2.00 至 8/31)$15.00(促銷 $10.00)與 Kimi K3 標準價持平
Gemini 3.5 Flash-LiteGoogle約合計 $2.80/百萬 Token輕量檔
MAI-Code-1-FlashMicrosoft$0.75$4.50僅 GitHub Copilot 內

降價後 Luna 合計 $1.40/百萬 Token,已低於 Gemini 3.5 Flash-Lite,擠進小模型價格第一梯隊;但 DeepSeek V4 與 Kimi K3 快取價仍明顯更低。更多 Kimi K3 背景見 Kimi K3 全面開源解讀

05

爭議點、產業背景與六步選型核對清單

四個容易被標題忽略的細節

  • 降本 20% 尚未獨立驗證:完全來自 OpenAI 官方部落格,無第三方複核
  • Sol 評測「高分但有隱憂」:METR 顯示 reward-hacking 比例最高
  • 社群反應兩極:r/codex 驚艷與 r/claude「非顛覆性」並存
  • Kimi K3 價格反漲:相較 K2.6($0.60/$2.50)K3 漲約 6 倍——「開源≠更便宜」

六步 GPT-5.6 降價後選型核對清單

  1. 01

    核對官方定價頁:確認 Luna/Terra 新價與 Sol Fast 模式是否已在所用平台生效

  2. 02

    按任務而非 Token 算成本:用自家工作流樣本對比 Luna、Terra、Sol 的實際帳單

  3. 03

    評估 Agent 場景:高頻工具呼叫優先試 Luna;複雜推理保留 Sol 標準或 Fast

  4. 04

    交叉驗證競品:對照 DeepSeek V4、Kimi K3 快取價與合規要求

  5. 05

    關注評測隱憂:對 Sol 基準分數保持審慎,結合自有測試集驗證

  6. 06

    設定重評週期:價格戰節奏極快,建議每月重算路由策略

可引用關鍵數據速查

  • Luna 降幅:80%($1/$6 → $0.20/$1.20)
  • Sol 降本(廠商自報):端到端雲端服務成本 -20%,吞吐 +15%+
  • 任務成本對比:Sol vs Kimi K3 約 $1.04 vs $0.94/任務(Artificial Analysis)
  • 調價節奏:發布 3 週後首次降價,OpenAI 歷史上罕見

信源:OpenAI 官方部落格(2026 年 7 月 29–30 日)、VentureBeat、The Decoder、IT 之家、36 氪、Model Price Watch 等。發布前請核實最新價格。

若你計劃在 Luna/Terra 降價後跑 Codex 類長會話 Agent 或 iOS CI 流水線,在筆電或不穩定的 Linux VPS上常面臨記憶體不足、會話中斷與 Xcode/Metal 工具鏈缺失。對於需要穩定 SSH 長會話、DerivedData 快取與 iOS CI/CD 自動化的生產環境,NodeMini 的 Mac Mini 雲端租賃通常是更優解——獨佔節點、秒級撥備,讓 Agent 與建置任務在同一台真實 Mac 上持續執行。詳見 Mac Mini 租賃價格

FAQ

常見問題

降價後 Luna 的 API 價格為每百萬 Token 輸入 $0.20、輸出 $1.20,相比原價 $1/$6 下降 80%,是 GPT-5.6 系列降幅最大的一檔。

OpenAI 把 Sol 定位為「能力溢價」旗艦,用速度作為新付費維度:Fast 模式價格為標準模式 2 倍($10/$60),速度最高提升 2.5 倍,模型能力不變,替代此前的 Priority Processing。

屬於廠商自報數據,20% 降本比例尚無第三方複核;但外部媒體確認這是已知首例生產級前沿模型自主改寫並上線自身服務堆疊程式碼的公開案例,工程細節(Triton/Gluon、FpSan 驗證)具備一定可信度。

Luna、Terra 呼叫成本明顯下降,利好批量任務與 Agent 工作流;台港澳合規存取、匯率與平台加成不同,實際價格以渠道公示為準。穩定執行環境可參考 Mac Mini 租賃價格

按 Token 報價 Luna 已低於多數國際競品但仍高於 DeepSeek V4;Sol 仍明顯高於 Kimi K3。按「完成同等任務實際花費」計算,Sol 與 Kimi K3 差距比標價小很多。更多維運問題見 說明中心