若你正評估 Claude Opus 5 是否值得從 Fable 5 降級切換,或好奇 Kimi K3 蒸餾門 到底有沒有實錘——本週 AI 圈兩件大事都指向同一主題:性價比與模型能力的真實來源。2026 年 7 月 24 日 Anthropic 發布 Opus 5 並設為 Claude Max 預設模型;月之暗面 K3 則遭白宮公開指控「產業級蒸餾」,獨立研究者更發現 K3 會自稱是 Claude 並吐出內部部署 ID。本文嚴格涵蓋源文件全部要點:Opus 5 定價與 Benchmark 對比、K3 白宮指控與專家時間線反駁、Ryan Greenblatt 技術證據、選型決策矩陣、六步落地指南與 FAQ。最後更新:2026-07-25
Opus 5 與 K3 蒸餾門表面無關,實則都在回答同一個問題:前沿智慧到底值多少錢,以及「便宜」是否意味著「有問題」。以下六點是目前技術社群討論最集中的摩擦:
旗艦 vs 日常主力難取捨:Fable 5 能力最強但價格翻倍;Opus 5 號稱 CursorBench 僅差 0.5% 卻半價——團隊需要重新評估預設路由。
資料留存合規門檻:Fable 5 / Mythos 5 要求接受 30 天資料留存;Opus 5 延續歷代 Opus「預設不強制留存」——企業場景可能因此倒向 Opus。
K3 能力無法獨立驗證:完整權重承諾 7 月 27 日才放出,爭議爆發時外部研究者無法複現 2.8T 架構與跑分(參見 K3 開源權重倒數)。
蒸餾指控缺乏公開證據:白宮 OSTP 主任 Kratsios 7 月 22–23 日發文指控,但未公布支撐材料;月之暗面亦未回應訓練過程質詢。
時間線邏輯存疑:Fable 5 7 月 1 日才公開可用,K3 7 月 16 日發布——僅兩週,獨立專家質疑「深度蒸餾」在算力與 API 成本上不可行。
供應鏈與政策風險:指控還涉及未獲出口許可的 Nvidia GB300 晶片;若政策收緊,國產開放權重模型的合規成本可能上升。
「兩件事連起來看:Opus 5 用半價逼近旗艦回應性價比訴求;K3 爭議則是產業第一次公開攤牌——你的低價到底是技術優化,還是白嫖別人的模型?」
2026 年 7 月 24 日(美國太平洋時間),Anthropic 正式發布 Claude Opus 5(模型 ID:claude-opus-5),並同步將其設為 Claude Max 預設模型,Claude Pro 使用者也可使用目前最強版本。定價與 Opus 4.8 完全相同:輸入 $5 / 百萬 tokens,輸出 $25 / 百萬 tokens;上下文視窗 100 萬 tokens(預設且唯一檔位),最大輸出 128K;Thinking 預設開啟。
| 維度 | Claude Opus 5 | Claude Fable 5 |
|---|---|---|
| 輸入 / 輸出定價 | $5 / $25 每百萬 tokens | 約 $10 / $50 每百萬 tokens(約為 Opus 5 兩倍) |
| CursorBench 3.2(max effort) | 與 Fable 5 峰值相差 0.5% | 峰值基準 |
| Frontier-Bench v0.1 | 超越所有模型,為 Opus 4.8 的 2 倍以上 | — |
| ARC-AGI 3 | 得分為次優模型的 3 倍 | — |
| OSWorld 2.0 | 用不到 Fable 5 三分之一成本超過其最佳成績 | 電腦操作能力標竿 |
| 資料留存 | 預設不強制資料留存 | 需接受 30 天資料留存政策 |
| 產品定位 | 日常主力 / Claude Max 預設 | 旗艦 / 極限 Agent 任務 |
Anthropic 自動化行為稽核顯示 Opus 5 是迄今為止最對齊的模型——欺騙行為發生率最低,最不容易被誘導濫用。但在網路安全攻擊、生物安全等高風險雙用途能力上,Anthropic 故意未讓 Opus 5 衝到最前——該位置仍由受限發行的 Mythos 5 佔據。Opus 5 網路安全分類器比 Fable 5 寬鬆約 85%,可用於原始碼級漏洞發現,但仍封鎖二進位漏洞掃描、滲透測試與 exploit 生成。
信源:Anthropic 官方發布(anthropic.com/news/claude-opus-5)、CNBC、The Verge、The New Stack。
如果說 Opus 5 是「正常發新品」,Kimi K3 的劇情則複雜得多。月之暗面 7 月 16 日發布 Kimi K3——總參數 2.8 萬億,全球首個進入「3T 級」的開源模型;稀疏 MoE 架構(896 專家 / 每 token 啟用 16 個,約等效 500 億啟用參數);100 萬 token 上下文 + 原生視覺理解。GPQA-Diamond 93.5%、BrowseComp 91.2% 均為發布時開源模型最高分(詳見 Kimi K3 深度評測)。
| 日期 | 事件 |
|---|---|
| 2026-02 | Anthropic 首次公開指控月之暗面 / DeepSeek / MiniMax「產業級蒸餾攻擊」,稱偵測到 340 萬+ 異常 API 互動 |
| 2026-07-01 | Claude Fable 5 面向公眾正式可用 |
| 2026-07-16 | Kimi K3 API / 產品正式發布 |
| 2026-07-22/23 | 白宮 OSTP 主任 Michael Kratsios 指控「大規模、隱蔽的產業級蒸餾」+ 涉嫌違規使用 Nvidia GB300 晶片 |
| 2026-07-23 | TechCrunch 刊發多位獨立研究者質疑「兩週內蒸餾不現實」的報導 |
| 2026-07-24 | Redwood Research 的 Ryan Greenblatt 發布「K3 自稱 Claude」統計分析(GitHub: rgreenblatt/which_claude_is_k3) |
| 2026-07-27(計畫) | Kimi K3 完整權重開源,外部可獨立驗證 |
Kratsios 原話:「Large-scale, covert industrial distillation aimed at stealing proprietary U.S. technology… is unacceptable.」財政部長 Scott Bessent 隨後稱「在很多中國模型上發現了美國大模型的浮水印」——但財政部未說明「浮水印」具體指什麼。
「Fable 從 7 月 1 日才開始公開可用,你不可能在兩週內蒸餾出這麼多資料、訓練完模型還發布出來。」—— Braden Hancock,Snorkel AI 共同創辦人
Allen Institute for AI 研究員 Nathan Lambert 補充:隨著中國模型逼近前沿,簡單監督微調式蒸餾的邊際收益正在變小,真正拉開差距的是更耗時的強化學習訓練——「如果蒸餾真這麼好用,所有追趕者早就靠蒸餾追平了。」
產業背景:Elon Musk 曾在庭審中承認 xAI 訓練 Grok 時蒸餾過 OpenAI 模型,並稱這在產業內很常見——「蒸餾」本身並不違法,核心在於「正常技術借鑑」與「隱蔽產業級竊取」的邊界如何界定。
這是整個事件裡最值得細品的角度,也是英文 SEO 文件建議主攻的差異化關鍵字:Kimi K3 自稱是 Claude / Why does Kimi K3 say it's Claude。
Ryan Greenblatt 在 7 月 24 日前後公開統計分析,對比多個模型被問及「你是誰」時的身份自認行為。結果:
claude-opus-4-5-20250929、claude-sonnet-4-5-20250929# K3 可能輸出的內部部署 ID(真 Claude 模型通常不會主動報出) claude-opus-4-5-20250929 claude-sonnet-4-5-20250929 # Greenblatt 解讀:模型說出「教師模型」部署中繼資料, # 比教師模型自己說得還準 → 更可能指向訓練資料混入了 # 帶部署中繼資料標註的 Claude 資料(API 日誌或標註合成資料)
Greenblatt 本人強調:這不能直接證明「蒸餾發生了」——身份混淆也可能來自訓練資料污染、系統提示詞洩漏或公開資料集合樣本。但結合 Anthropic 2 月指控與本次統計規律,「蒸餾說」第一次有了比「白宮喊話」更紮實的技術支撐。
| 維度 | Claude Opus 5 | Kimi K3 |
|---|---|---|
| 定價層級 | 閉源 API,約為 Fable 5 一半 | 開源 + 低價,官方稱遠低於 Fable 5 / GPT-5.6 Sol |
| 合規 / 資料留存 | 預設不強制留存,Anthropic 官方渠道 | 開放權重,但蒸餾指控帶來供應鏈風險 |
| 可獨立驗證 | API 即日可用,Benchmark 可複現 | 完整權重 7 月 27 日前無法驗證架構 |
| 審查 / 拒答 | 對齊策略嚴格,網路安全分類器仍攔截高風險操作 | 社群認為賣點之一是更少內容審查限制 |
| 本地部署 | 不支援(閉源) | 2.8T 參數,幾乎無人能在本地跑滿 |
| 適用場景 | 合規敏感企業、日常 Agent / 編碼主力 | 極限成本、可接受溯源爭議、等待權重驗證後實測 |
明確合規邊界:若場景涉及資料留存、出口管制或供應鏈稽核,優先評估 Opus 5「預設不強制留存」與 Anthropic 官方 SLA,而非僅看 Benchmark 分數。
算清真實 Token 成本:Opus 5 與 Opus 4.8 同價但能力跳級——若你此前因 Fable 5 價格猶豫,用 CursorBench / AutomationBench 對照任務跑一輪 A/B 再定預設路由。
K3 等到 7 月 27 日再下結論:完整權重放出前,架構細節與跑分均無法被外部獨立驗證;可參考 開源權重發布倒數 制定驗證清單。
關注「身份混淆」類間接訊號:對開源模型做簡單的「你是誰」探針測試,異常部署 ID 輸出可能提示訓練資料污染風險——尤其用於生產 Agent 路由時。
英文內容分發帶差異化角度:若營運雙語部落格,英文版標題/H2 應命中 Why does Kimi K3 say it's Claude 等母語者真實搜尋詞,而非直譯「蒸餾門」。
執行層與模型層分離:無論 API 選 Opus 5 還是 K3,iOS CI/CD、CLI Agent 長連線、Keychain 隔離等 macOS 重負載仍需穩定執行節點——勿把模型降價等同於基礎設施免費。
Opus 5 讓雲端 API 的「日常主力」檔位大幅升級,K3 則把開源與閉源的能力差距壓縮到「天數級」——但廉價 Linux VPS 無法執行 xcodebuild、notarytool 或 Claude Code 所需的 macOS 工具鏈;本地 Mac 又常面臨記憶體與磁碟瓶頸。若團隊同時維護多模型 API 路由與iOS CI/CD / CLI Agent 長連線,把 macOS 重負載放在可獨佔、SSH 穩定的遠端節點,通常比押注單台本地硬體更可靠——模型 API 再便宜也解決不了 Keychain 隔離與連線穩定性。對需要穩定 SSH 長連線、可預期頻寬的生產環境,NodeMini 的 Mac Mini 雲端租賃通常是更優解。規格見 租賃價格說明,接入見 幫助中心。
最後更新:2026-07-25。K3 完整權重預計 7 月 27 日放出,建議屆時追更獨立驗證結果。
Opus 5 維持 $5/$25 每百萬輸入/輸出 token,約為 Fable 5($10/$50 量級)的一半;CursorBench 3.2 上與 Fable 5 峰值成績相差不到 1%。若需要穩定 macOS 執行層配合 Agent 工作流,可參考 租賃價格說明。
是的,2026 年 7 月 24 日發布當天起 Opus 5 成為 Claude Max 預設模型,也是 Claude Pro 使用者可用的最強版本。可透過 Claude API、AWS Bedrock、Google Vertex AI、Microsoft Foundry 接入,模型 ID 為 claude-opus-5。
截至本文發布仍是有爭議、未被最終證實的指控。白宮缺乏公開證據;專家從時間線質疑兩週內完成深度蒸餾不現實;Ryan Greenblatt 發現的「K3 自稱 Claude 並吐出內部版本號」是目前最具技術含量的間接證據。更多 K3 技術細節見 Kimi K3 深度評測。
官方承諾 2026 年 7 月 27 日放出完整權重。本文發布時尚未放出,外部研究者尚無法完全獨立驗證架構與跑分。發布日核對清單見 開源權重倒數。
Redwood Research 統計分析顯示 K3 在被問身份時異常高頻自稱 Claude,甚至輸出 claude-opus-4-5-20250929 等內部部署 ID——比真 Claude 模型報得還準。可能指向訓練資料混入了帶部署中繼資料標註的 Claude 資料,但不能直接證明蒸餾。遠端開發環境問題見 幫助中心。