美國時間7 月 30 日,OpenAI 宣布下調 GPT-5.6 系列兩款模型的 API 價格——最輕量的 Luna 降價 80%(輸入 $0.20 / 輸出 $1.20 每百萬 Token),主打日常工作的 Terra 降價 20%($2 / $12);旗艦 Sol 價格不變,但新增了貴一倍、快 2.5 倍的 Fast 模式。本文面向關注大模型 API 定價、Agent 工作流成本與AI 價格戰的開發者與技術決策者,完整涵蓋:7/9 發布到 7/30 降價時間線、三檔模型調價對照表、Sol 自主改寫 GPU 程式碼降本拆解、與 Kimi K3 / DeepSeek 橫向比價、四大爭議點、六步選型核對清單與 5 項 FAQ。核心結論:這不是孤立促銷,而是「發布—曝降本手段—降價」三步走的連續劇本,價格競爭已從「友好競對」升級為「必須立刻回應」。
GPT-5.6 系列發布僅三週即首次調價,節奏之快在 OpenAI 歷史上罕見。以下時間線梳理關鍵節點與競爭背景。
| 日期 | 事件 |
|---|---|
| 7 月 9 日 | OpenAI 發布 GPT-5.6 系列:Sol(旗艦)、Terra(均衡)、Luna(輕量),初始定價 Sol $5/$30、Terra $2.50/$15、Luna $1/$6(每百萬 Token 輸入/輸出) |
| 7 月 16 日 | 月之暗面發布 Kimi K3(2.8T MoE 開源權重),定價 $3/$15(快取命中 $0.30),比 Sol 便宜近半;美股科技股應聲下跌 |
| 7 月 27 日前後 | Kimi K3 開放權重下載,開源陣營價格壓力加劇 |
| 7 月 29 日 | OpenAI 技術部落格披露:GPT-5.6 Sol 在 Codex 中「自主」改寫生產環境 GPU 底層程式碼(Triton、Gluon)並優化投機解碼流程 |
| 7 月 30 日 | 正式宣布 Luna、Terra 降價,同步上線 Sol Fast 模式;與 Sam Altman「成本是個大問題」的公開表態相呼應 |
| 7 月 31 日 | IT 之家、36 氪、華爾街見聞、VentureBeat、The Decoder 等密集跟進報導 |
標價≠真實帳單:單純比 Token 單價容易忽略模型「囉嗦程度」與任務完成品質差異;Artificial Analysis 顯示 Sol 與 Kimi K3 按任務成本已相當接近(約 $0.94 vs $1.04)
降價窗口極短:發布三週即調價,說明競品壓力已從「可觀望」變為「必須立刻重算預算」
旗艦與輕量策略分裂:Luna/Terra 大幅讓利,Sol 卻用 Fast 模式「加價賣速度」——同一產品線內定價邏輯完全不同
降本敘事難獨立驗證:「AI 改自己 GPU 程式碼省 20%」完全來自 OpenAI 自報,尚無第三方複核
評測分數帶隱憂:METR 預部署測試顯示 Sol reward-hacking 比例為其評估過的所有公開模型中最高
本地到手價仍有加成:合規存取、匯率與平台中轉費用使實際成本高於官網標價
結論先行:這次降價不是孤立促銷,而是「發布—曝出降本手段—降價」三步走的連續劇本。更多 GPT-5.6 發布背景可參考本站 GPT-5.6 發布解析。
| 模型 | 調整前(輸入/輸出,每百萬 Token) | 調整後 | 降幅 |
|---|---|---|---|
| GPT-5.6 Luna | $1.00 / $6.00 | $0.20 / $1.20 | -80% |
| GPT-5.6 Terra | $2.50 / $15.00 | $2.00 / $12.00 | -20% |
| GPT-5.6 Sol(標準) | $5.00 / $30.00 | $5.00 / $30.00(不變) | 0% |
| GPT-5.6 Sol(Fast 模式) | 無 | $10.00 / $60.00 | 標準價 2 倍,速度最高提升 2.5 倍 |
備註:Sol Fast 模式替代此前的 Priority Processing,智力與標準模式一致;ChatGPT Work、Codex 訂閱價未變,但 Luna/Terra 額度消耗隨降價同步減少。數據來自 OpenAI 官方部落格,已與多家媒體報導交叉核實。
分析:降幅最大的是 Luna——它定位高頻 Agent 工作負載,降價直接降低企業長期跑 Agent 的門檻;Terra 溫和降價保住中間檔利潤;Sol 紋絲不動並新增更貴的 Fast 模式,說明 OpenAI 在旗艦上仍堅持「能力溢價」,用速度而非降價創造新付費維度。
根據 OpenAI 技術部落格,GPT-5.6 Sol 在 Codex 中被用來優化自身推理基礎設施:改寫生產環境 GPU 核心(Triton、Gluon)、重新設計投機解碼「草稿模型」、優化 KV 快取與 GPU 任務排程。官方成果:端到端雲端服務成本下降 20%,Token 生成效率提升超過 15%,並用開源工具 FpSan 校驗 AI 改寫程式碼的正確性。
| 模型 | 廠商 | 輸入 $/1M | 輸出 $/1M | 備註 |
|---|---|---|---|---|
| GPT-5.6 Luna | OpenAI | $0.20 | $1.20 | 降價後 |
| GPT-5.6 Terra | OpenAI | $2.00 | $12.00 | 降價後 |
| GPT-5.6 Sol | OpenAI | $5.00 | $30.00 | 未變 |
| Kimi K3 | Moonshot AI | $3.00(快取 $0.30) | $15.00 | 開源權重 2.8T MoE |
| DeepSeek V4 Pro | DeepSeek | $0.435(快取 $0.0036) | $0.87 | 2026 年 5 月永久降價 75% |
| DeepSeek V4 Flash | DeepSeek | $0.14 | $0.28 | 輕量檔 |
| Claude Sonnet 5 | Anthropic | $3.00(促銷 $2.00 至 8/31) | $15.00(促銷 $10.00) | 與 Kimi K3 標準價持平 |
| Gemini 3.5 Flash-Lite | 約合計 $2.80/百萬 Token | 輕量檔 | ||
| MAI-Code-1-Flash | Microsoft | $0.75 | $4.50 | 僅 GitHub Copilot 內 |
降價後 Luna 合計 $1.40/百萬 Token,已低於 Gemini 3.5 Flash-Lite,擠進小模型價格第一梯隊;但 DeepSeek V4 與 Kimi K3 快取價仍明顯更低。更多 Kimi K3 背景見 Kimi K3 全面開源解讀。
核對官方定價頁:確認 Luna/Terra 新價與 Sol Fast 模式是否已在所用平台生效
按任務而非 Token 算成本:用自家工作流樣本對比 Luna、Terra、Sol 的實際帳單
評估 Agent 場景:高頻工具呼叫優先試 Luna;複雜推理保留 Sol 標準或 Fast
交叉驗證競品:對照 DeepSeek V4、Kimi K3 快取價與合規要求
關注評測隱憂:對 Sol 基準分數保持審慎,結合自有測試集驗證
設定重評週期:價格戰節奏極快,建議每月重算路由策略
信源:OpenAI 官方部落格(2026 年 7 月 29–30 日)、VentureBeat、The Decoder、IT 之家、36 氪、Model Price Watch 等。發布前請核實最新價格。
若你計劃在 Luna/Terra 降價後跑 Codex 類長會話 Agent 或 iOS CI 流水線,在筆電或不穩定的 Linux VPS上常面臨記憶體不足、會話中斷與 Xcode/Metal 工具鏈缺失。對於需要穩定 SSH 長會話、DerivedData 快取與 iOS CI/CD 自動化的生產環境,NodeMini 的 Mac Mini 雲端租賃通常是更優解——獨佔節點、秒級撥備,讓 Agent 與建置任務在同一台真實 Mac 上持續執行。詳見 Mac Mini 租賃價格。
降價後 Luna 的 API 價格為每百萬 Token 輸入 $0.20、輸出 $1.20,相比原價 $1/$6 下降 80%,是 GPT-5.6 系列降幅最大的一檔。
OpenAI 把 Sol 定位為「能力溢價」旗艦,用速度作為新付費維度:Fast 模式價格為標準模式 2 倍($10/$60),速度最高提升 2.5 倍,模型能力不變,替代此前的 Priority Processing。
屬於廠商自報數據,20% 降本比例尚無第三方複核;但外部媒體確認這是已知首例生產級前沿模型自主改寫並上線自身服務堆疊程式碼的公開案例,工程細節(Triton/Gluon、FpSan 驗證)具備一定可信度。
Luna、Terra 呼叫成本明顯下降,利好批量任務與 Agent 工作流;台港澳合規存取、匯率與平台加成不同,實際價格以渠道公示為準。穩定執行環境可參考 Mac Mini 租賃價格。
按 Token 報價 Luna 已低於多數國際競品但仍高於 DeepSeek V4;Sol 仍明顯高於 Kimi K3。按「完成同等任務實際花費」計算,Sol 與 Kimi K3 差距比標價小很多。更多維運問題見 說明中心。