Claude Opus 5 價格減半逼近旗艦
Kimi K3 卻陷「自稱 Claude」蒸餾門 × 本週 AI 週報(2026)

若你正評估 Claude Opus 5 是否值得從 Fable 5 降級切換,或好奇 Kimi K3 蒸餾門 到底有沒有實錘——本週 AI 圈兩件大事都指向同一主題:性價比模型能力的真實來源。2026 年 7 月 24 日 Anthropic 發布 Opus 5 並設為 Claude Max 預設模型;月之暗面 K3 則遭白宮公開指控「產業級蒸餾」,獨立研究者更發現 K3 會自稱是 Claude 並吐出內部部署 ID。本文嚴格涵蓋源文件全部要點:Opus 5 定價與 Benchmark 對比、K3 白宮指控與專家時間線反駁、Ryan Greenblatt 技術證據、選型決策矩陣、六步落地指南與 FAQ最後更新:2026-07-25

01

本週 AI 圈兩大事件:開發者選型必須面對的六大痛點

Opus 5 與 K3 蒸餾門表面無關,實則都在回答同一個問題:前沿智慧到底值多少錢,以及「便宜」是否意味著「有問題」。以下六點是目前技術社群討論最集中的摩擦:

  1. 01

    旗艦 vs 日常主力難取捨:Fable 5 能力最強但價格翻倍;Opus 5 號稱 CursorBench 僅差 0.5% 卻半價——團隊需要重新評估預設路由。

  2. 02

    資料留存合規門檻:Fable 5 / Mythos 5 要求接受 30 天資料留存;Opus 5 延續歷代 Opus「預設不強制留存」——企業場景可能因此倒向 Opus。

  3. 03

    K3 能力無法獨立驗證:完整權重承諾 7 月 27 日才放出,爭議爆發時外部研究者無法複現 2.8T 架構與跑分(參見 K3 開源權重倒數)。

  4. 04

    蒸餾指控缺乏公開證據:白宮 OSTP 主任 Kratsios 7 月 22–23 日發文指控,但未公布支撐材料;月之暗面亦未回應訓練過程質詢。

  5. 05

    時間線邏輯存疑:Fable 5 7 月 1 日才公開可用,K3 7 月 16 日發布——僅兩週,獨立專家質疑「深度蒸餾」在算力與 API 成本上不可行。

  6. 06

    供應鏈與政策風險:指控還涉及未獲出口許可的 Nvidia GB300 晶片;若政策收緊,國產開放權重模型的合規成本可能上升。

「兩件事連起來看:Opus 5 用半價逼近旗艦回應性價比訴求;K3 爭議則是產業第一次公開攤牌——你的低價到底是技術優化,還是白嫖別人的模型?」

02

Claude Opus 5 發布:價格沒變,效能「跳級」——與 Fable 5 怎麼選?

2026 年 7 月 24 日(美國太平洋時間),Anthropic 正式發布 Claude Opus 5(模型 ID:claude-opus-5),並同步將其設為 Claude Max 預設模型,Claude Pro 使用者也可使用目前最強版本。定價與 Opus 4.8 完全相同:輸入 $5 / 百萬 tokens,輸出 $25 / 百萬 tokens;上下文視窗 100 萬 tokens(預設且唯一檔位),最大輸出 128K;Thinking 預設開啟。

維度Claude Opus 5Claude Fable 5
輸入 / 輸出定價$5 / $25 每百萬 tokens約 $10 / $50 每百萬 tokens(約為 Opus 5 兩倍)
CursorBench 3.2(max effort)與 Fable 5 峰值相差 0.5%峰值基準
Frontier-Bench v0.1超越所有模型,為 Opus 4.8 的 2 倍以上
ARC-AGI 3得分為次優模型的 3 倍
OSWorld 2.0用不到 Fable 5 三分之一成本超過其最佳成績電腦操作能力標竿
資料留存預設不強制資料留存需接受 30 天資料留存政策
產品定位日常主力 / Claude Max 預設旗艦 / 極限 Agent 任務

關鍵 Benchmark 與客戶回饋

  • Cursor 團隊:「Opus 5 以 Opus 速度與成本交付接近 Fable 5 的智慧,CursorBench 僅略低於 Fable 5。」
  • Zapier AutomationBench:Opus 5 登頂排行榜,端到端帳戶健康工作流 100% 通過率——此前模型均未通過。
  • Box 實測:資料分析工作流提升 11%,盡職調查場景提升 17%,整體準確率提升 8%。
  • 生命科學:從光譜推斷分子結構內部評測比 Opus 4.8 高 10.2 個百分點;蛋白質序列變異功能預測高 7.7 個百分點

安全性:最對齊的一代,但故意未刷網路安全前沿

Anthropic 自動化行為稽核顯示 Opus 5 是迄今為止最對齊的模型——欺騙行為發生率最低,最不容易被誘導濫用。但在網路安全攻擊、生物安全等高風險雙用途能力上,Anthropic 故意未讓 Opus 5 衝到最前——該位置仍由受限發行的 Mythos 5 佔據。Opus 5 網路安全分類器比 Fable 5 寬鬆約 85%,可用於原始碼級漏洞發現,但仍封鎖二進位漏洞掃描、滲透測試與 exploit 生成。

info

信源:Anthropic 官方發布(anthropic.com/news/claude-opus-5)、CNBC、The Verge、The New Stack。

03

Kimi K3「蒸餾門」:白宮下場、專家吐槽時間線、卻挖出新證據

如果說 Opus 5 是「正常發新品」,Kimi K3 的劇情則複雜得多。月之暗面 7 月 16 日發布 Kimi K3——總參數 2.8 萬億,全球首個進入「3T 級」的開源模型;稀疏 MoE 架構(896 專家 / 每 token 啟用 16 個,約等效 500 億啟用參數);100 萬 token 上下文 + 原生視覺理解。GPQA-Diamond 93.5%、BrowseComp 91.2% 均為發布時開源模型最高分(詳見 Kimi K3 深度評測)。

爭議時間線速覽

日期事件
2026-02Anthropic 首次公開指控月之暗面 / DeepSeek / MiniMax「產業級蒸餾攻擊」,稱偵測到 340 萬+ 異常 API 互動
2026-07-01Claude Fable 5 面向公眾正式可用
2026-07-16Kimi K3 API / 產品正式發布
2026-07-22/23白宮 OSTP 主任 Michael Kratsios 指控「大規模、隱蔽的產業級蒸餾」+ 涉嫌違規使用 Nvidia GB300 晶片
2026-07-23TechCrunch 刊發多位獨立研究者質疑「兩週內蒸餾不現實」的報導
2026-07-24Redwood Research 的 Ryan Greenblatt 發布「K3 自稱 Claude」統計分析(GitHub: rgreenblatt/which_claude_is_k3)
2026-07-27(計畫)Kimi K3 完整權重開源,外部可獨立驗證

白宮指控 vs 專家反駁

Kratsios 原話:「Large-scale, covert industrial distillation aimed at stealing proprietary U.S. technology… is unacceptable.」財政部長 Scott Bessent 隨後稱「在很多中國模型上發現了美國大模型的浮水印」——但財政部未說明「浮水印」具體指什麼。

「Fable 從 7 月 1 日才開始公開可用,你不可能在兩週內蒸餾出這麼多資料、訓練完模型還發布出來。」—— Braden Hancock,Snorkel AI 共同創辦人

Allen Institute for AI 研究員 Nathan Lambert 補充:隨著中國模型逼近前沿,簡單監督微調式蒸餾的邊際收益正在變小,真正拉開差距的是更耗時的強化學習訓練——「如果蒸餾真這麼好用,所有追趕者早就靠蒸餾追平了。」

warning

產業背景:Elon Musk 曾在庭審中承認 xAI 訓練 Grok 時蒸餾過 OpenAI 模型,並稱這在產業內很常見——「蒸餾」本身並不違法,核心在於「正常技術借鑑」與「隱蔽產業級竊取」的邊界如何界定。

04

Kimi K3 為什麼會「自稱是 Claude」?——迄今最具技術含量的間接證據

這是整個事件裡最值得細品的角度,也是英文 SEO 文件建議主攻的差異化關鍵字:Kimi K3 自稱是 Claude / Why does Kimi K3 say it's Claude。

Ryan Greenblatt 在 7 月 24 日前後公開統計分析,對比多個模型被問及「你是誰」時的身份自認行為。結果:

  • Kimi K3 異常高頻地自稱是 Claude,甚至會吐出 Claude 官方內部部署 ID 字串,如 claude-opus-4-5-20250929claude-sonnet-4-5-20250929
  • 真正的 Claude 模型自己都不會這樣報——Sonnet 4.5 只會說「我是 Claude Sonnet 4.5」,Opus 4.5 甚至可能報錯或不報版本號
  • K3 自稱的版本鎖定在「Claude 4.5 時代」(2025 年末),而非當前 Fable/Mythos 系列;上一代 K2 訊號指向更早的 Claude Sonnet 4——呈現「逐代追新」規律
example
# K3 可能輸出的內部部署 ID(真 Claude 模型通常不會主動報出)
claude-opus-4-5-20250929
claude-sonnet-4-5-20250929

# Greenblatt 解讀:模型說出「教師模型」部署中繼資料,
# 比教師模型自己說得還準 → 更可能指向訓練資料混入了
# 帶部署中繼資料標註的 Claude 資料(API 日誌或標註合成資料)

Greenblatt 本人強調:這不能直接證明「蒸餾發生了」——身份混淆也可能來自訓練資料污染、系統提示詞洩漏或公開資料集合樣本。但結合 Anthropic 2 月指控與本次統計規律,「蒸餾說」第一次有了比「白宮喊話」更紮實的技術支撐。

Opus 5 vs Kimi K3:本週選型決策矩陣

維度Claude Opus 5Kimi K3
定價層級閉源 API,約為 Fable 5 一半開源 + 低價,官方稱遠低於 Fable 5 / GPT-5.6 Sol
合規 / 資料留存預設不強制留存,Anthropic 官方渠道開放權重,但蒸餾指控帶來供應鏈風險
可獨立驗證API 即日可用,Benchmark 可複現完整權重 7 月 27 日前無法驗證架構
審查 / 拒答對齊策略嚴格,網路安全分類器仍攔截高風險操作社群認為賣點之一是更少內容審查限制
本地部署不支援(閉源)2.8T 參數,幾乎無人能在本地跑滿
適用場景合規敏感企業、日常 Agent / 編碼主力極限成本、可接受溯源爭議、等待權重驗證後實測
05

六步模型選型落地指南:先看場景,再看立場

  1. 01

    明確合規邊界:若場景涉及資料留存、出口管制或供應鏈稽核,優先評估 Opus 5「預設不強制留存」與 Anthropic 官方 SLA,而非僅看 Benchmark 分數。

  2. 02

    算清真實 Token 成本:Opus 5 與 Opus 4.8 同價但能力跳級——若你此前因 Fable 5 價格猶豫,用 CursorBench / AutomationBench 對照任務跑一輪 A/B 再定預設路由。

  3. 03

    K3 等到 7 月 27 日再下結論:完整權重放出前,架構細節與跑分均無法被外部獨立驗證;可參考 開源權重發布倒數 制定驗證清單。

  4. 04

    關注「身份混淆」類間接訊號:對開源模型做簡單的「你是誰」探針測試,異常部署 ID 輸出可能提示訓練資料污染風險——尤其用於生產 Agent 路由時。

  5. 05

    英文內容分發帶差異化角度:若營運雙語部落格,英文版標題/H2 應命中 Why does Kimi K3 say it's Claude 等母語者真實搜尋詞,而非直譯「蒸餾門」。

  6. 06

    執行層與模型層分離:無論 API 選 Opus 5 還是 K3,iOS CI/CD、CLI Agent 長連線、Keychain 隔離等 macOS 重負載仍需穩定執行節點——勿把模型降價等同於基礎設施免費。

可引用硬核資料(EEAT)

  • Opus 5 性價比:CursorBench 3.2 max effort 與 Fable 5 峰值相差 0.5%,成本約為 Fable 5 的 50%
  • K3 參數規模:總參數 2.8T,896 專家 MoE,每 token 啟用 16 專家(約 50B 啟用參數)
  • 蒸餾時間窗口:Fable 5 公開可用(7/1)至 K3 發布(7/16)僅 14 天——多位獨立研究者認為不足以完成 RL 式深度蒸餾
  • Anthropic 歷史指控:2026 年 2 月稱偵測到月之暗面相關 340 萬+ 異常 API 互動,歸因於「刻意能力提取」

Opus 5 讓雲端 API 的「日常主力」檔位大幅升級,K3 則把開源與閉源的能力差距壓縮到「天數級」——但廉價 Linux VPS 無法執行 xcodebuild、notarytool 或 Claude Code 所需的 macOS 工具鏈;本地 Mac 又常面臨記憶體與磁碟瓶頸。若團隊同時維護多模型 API 路由iOS CI/CD / CLI Agent 長連線,把 macOS 重負載放在可獨佔、SSH 穩定的遠端節點,通常比押注單台本地硬體更可靠——模型 API 再便宜也解決不了 Keychain 隔離與連線穩定性。對需要穩定 SSH 長連線、可預期頻寬的生產環境,NodeMini 的 Mac Mini 雲端租賃通常是更優解。規格見 租賃價格說明,接入見 幫助中心

最後更新:2026-07-25。K3 完整權重預計 7 月 27 日放出,建議屆時追更獨立驗證結果。

FAQ

常見問題

Opus 5 維持 $5/$25 每百萬輸入/輸出 token,約為 Fable 5($10/$50 量級)的一半;CursorBench 3.2 上與 Fable 5 峰值成績相差不到 1%。若需要穩定 macOS 執行層配合 Agent 工作流,可參考 租賃價格說明

是的,2026 年 7 月 24 日發布當天起 Opus 5 成為 Claude Max 預設模型,也是 Claude Pro 使用者可用的最強版本。可透過 Claude API、AWS Bedrock、Google Vertex AI、Microsoft Foundry 接入,模型 ID 為 claude-opus-5

截至本文發布仍是有爭議、未被最終證實的指控。白宮缺乏公開證據;專家從時間線質疑兩週內完成深度蒸餾不現實;Ryan Greenblatt 發現的「K3 自稱 Claude 並吐出內部版本號」是目前最具技術含量的間接證據。更多 K3 技術細節見 Kimi K3 深度評測

官方承諾 2026 年 7 月 27 日放出完整權重。本文發布時尚未放出,外部研究者尚無法完全獨立驗證架構與跑分。發布日核對清單見 開源權重倒數

Redwood Research 統計分析顯示 K3 在被問身份時異常高頻自稱 Claude,甚至輸出 claude-opus-4-5-20250929 等內部部署 ID——比真 Claude 模型報得還準。可能指向訓練資料混入了帶部署中繼資料標註的 Claude 資料,但不能直接證明蒸餾。遠端開發環境問題見 幫助中心