Claude Opus 5로 Fable 5에서 전환할지, Kimi K3 증류 논란에 실질적 증거가 있는지 판단 중이라면 이번 주 AI 업계 두 가지 이슈는 같은 질문을 던집니다. 가성비와 모델 능력의 실제 출처입니다. 2026년 7월 24일 Anthropic은 Opus 5를 출시하고 Claude Max 기본 모델로 지정했습니다. Moonshot AI의 K3는 백악관의 '산업급 증류' 공개 비난과 함께, 독립 연구자가 K3가 Claude라고 자칭하며 내부 배포 ID를 출력한다는 분석을 공개했습니다. 본 글은 Opus 5 가격·벤치마크 비교, K3 백악관 의혹·전문가 시간선 반박, Ryan Greenblatt 기술 증거, 선택 결정 매트릭스, 6단계 실행 가이드, FAQ를 다룹니다. 최종 업데이트: 2026-07-25
Opus 5와 K3 증류 논란은 겉보기에 무관하지만, 같은 질문에 답합니다. 최첨단 지능이 얼마의 가치를 가지며, '저렴함'이 '문제 있음'을 의미하는가입니다. 기술 커뮤니티에서 가장 집중적으로 논의되는 6가지 마찰 지점은 다음과 같습니다.
플래그십 vs 일상 주력 모델: Fable 5는 능력은 최고지만 가격이 2배입니다. Opus 5는 CursorBench 기준 0.5% 차이에 절반 가격이라 주장합니다. 팀은 기본 라우팅을 재평가해야 합니다.
데이터 보존 컴플라이언스: Fable 5 / Mythos 5는 30일 데이터 보존 정책 수락이 필요합니다. Opus 5는 역대 Opus처럼 기본적으로 보존을 강제하지 않습니다. 기업 환경에서는 Opus 쪽으로 기울 수 있습니다.
K3 능력의 독립 검증 불가: 전체 가중치는 7월 27일 공개 예정이며, 논란 당시 외부 연구자는 2.8T 아키텍처와 점수를 재현할 수 없었습니다(K3 오픈 가중치 카운트다운 참고).
증류 의혹에 공개 증거 부재: 백악관 OSTP 국장 Kratsios가 7월 22–23일 비난을 공개했으나 근거 자료는 공개하지 않았습니다. Moonshot AI도 학습 과정 질의에 응답하지 않았습니다.
시간선 논리 의문: Fable 5는 7월 1일 공개, K3는 7월 16일 출시로 겨우 2주입니다. 독립 전문가들은 이 기간에 '깊은 증류'가 연산·API 비용상 불가능하다고 지적합니다.
공급망·정책 리스크: 의혹에는 수출 허가 없이 사용된 Nvidia GB300 칩도 포함됩니다. 정책이 강화되면 국산 오픈 가중치 모델의 컴플라이언스 비용이 상승할 수 있습니다.
「두 이슈를 함께 보면, Opus 5는 절반 가격으로 플래그십에 근접해 가성비에 답하고, K3 논란은 업계가 처음 공개적으로 맞닥뜨리는 질문입니다. 당신의 저가는 기술 최적화인가, 타사 모델 무단 활용인가?」
2026년 7월 24일(미국 태평양 시간) Anthropic은 Claude Opus 5(모델 ID: claude-opus-5)를 공식 출시하고 Claude Max 기본 모델로 지정했습니다. Claude Pro 사용자도 현재 최강 버전을 사용할 수 있습니다. 가격은 Opus 4.8과 동일합니다. 입력 $5/백만 토큰, 출력 $25/백만 토큰입니다. 컨텍스트 창은 100만 토큰(기본·유일), 최대 출력 128K이며 Thinking은 기본 활성화입니다.
| 항목 | Claude Opus 5 | Claude Fable 5 |
|---|---|---|
| 입력 / 출력 가격 | $5 / $25 per 1M tokens | 약 $10 / $50 per 1M tokens (Opus 5의 약 2배) |
| CursorBench 3.2 (max effort) | Fable 5 최고 점수와 0.5% 차이 | 최고 기준점 |
| Frontier-Bench v0.1 | 모든 모델 상회, Opus 4.8의 2배 이상 | — |
| ARC-AGI 3 | 차순위 모델의 3배 점수 | — |
| OSWorld 2.0 | Fable 5 최고 기록의 1/3 미만 비용으로 상회 | 컴퓨터 조작 벤치마크 |
| 데이터 보존 | 기본적으로 보존 강제 없음 | 30일 데이터 보존 정책 수락 필요 |
| 제품 포지션 | 일상 주력 / Claude Max 기본 | 플래그십 / 극한 Agent 작업 |
Anthropic 자동화 행동 감사에 따르면 Opus 5는 지금까지 가장 정렬된 모델입니다. 기만 행위 발생률이 가장 낮고 악용 유도에 가장 잘 견딥니다. 다만 사이버 보안 공격, 생물안전 등 고위험 이중용도 능력에서는 Anthropic이 Opus 5를 의도적으로 최전선에 두지 않았습니다. 해당 자리는 제한 배포 Mythos 5가 차지합니다. Opus 5 사이버 보안 분류기는 Fable 5보다 약 85% 완화되어 소스 수준 취약점 발견에 활용 가능하나, 바이너리 취약점 스캔·침투 테스트·exploit 생성은 여전히 차단됩니다.
출처: Anthropic 공식 발표(anthropic.com/news/claude-opus-5), CNBC, The Verge, The New Stack.
Opus 5가 '정상적인 신제품 출시'라면 Kimi K3의 전개는 훨씬 복잡합니다. Moonshot AI는 7월 16일 Kimi K3를 출시했습니다. 총 파라미터 2.8조로 글로벌 최초 '3T급' 오픈 모델입니다. 희소 MoE(896 전문가 / 토큰당 16개 활성, 약 500억 활성 파라미터), 100만 토큰 컨텍스트 + 네이티브 시각 이해를 갖췄습니다. GPQA-Diamond 93.5%, BrowseComp 91.2%는 출시 당시 오픈 모델 최고점입니다(Kimi K3 심층 리뷰 참고).
| 날짜 | 사건 |
|---|---|
| 2026-02 | Anthropic, Moonshot AI / DeepSeek / MiniMax '산업급 증류 공격' 최초 공개 비난, 340만+ 비정상 API 상호작용 탐지 |
| 2026-07-01 | Claude Fable 5 대중 공개 |
| 2026-07-16 | Kimi K3 API / 제품 공식 출시 |
| 2026-07-22/23 | 백악관 OSTP 국장 Michael Kratsios, '대규모·은밀한 산업급 증류' + Nvidia GB300 칩 무허가 사용 의혹 |
| 2026-07-23 | TechCrunch, 독립 연구자들의 '2주 내 증류 비현실' 보도 |
| 2026-07-24 | Redwood Research Ryan Greenblatt, 'K3 Claude 자칭' 통계 분석 공개 (GitHub: rgreenblatt/which_claude_is_k3) |
| 2026-07-27 (예정) | Kimi K3 전체 가중치 오픈, 외부 독립 검증 가능 |
Kratsios 원문: 「Large-scale, covert industrial distillation aimed at stealing proprietary U.S. technology… is unacceptable.」 재무장관 Scott Bessent는 이어 「많은 중국 모델에서 미국 대형 모델의 워터마크를 발견했다」고 했으나, 재무부는 '워터마크'의 구체적 의미를 밝히지 않았습니다.
「Fable 5는 7월 1일부터 공개 사용 가능했습니다. 2주 만에 이 정도 데이터를 증류하고 모델을 학습·출시하는 것은 불가능합니다.」— Braden Hancock, Snorkel AI 공동창업자
Allen Institute for AI 연구원 Nathan Lambert는 중국 모델이 최전선에 근접할수록 단순 SFT식 증류의 한계가 줄어든다고 보충했습니다. 진짜 격차는 더 오래 걸리는 강화학습 학습에서 벌어집니다. 「증류가 그렇게 효과적이었다면 모든 추격자가 이미 증류로 따라잡았을 것」이라고 덧붙였습니다.
업계 맥락: Elon Musk는 재판에서 xAI가 Grok 학습 시 OpenAI 모델을 증류했다고 인정했으며, 업계에서 흔한 일이라고 했습니다. '증류' 자체가 불법은 아니며, 핵심은 '정상적 기술 참고'와 '은밀한 산업급 탈취'의 경계입니다.
이 사건에서 가장 주목할 각도입니다. 핵심 키워드는 Kimi K3 Claude 자칭 / Why does Kimi K3 say it's Claude입니다.
Ryan Greenblatt는 7월 24일 전후 공개 통계 분석으로 여러 모델의 '당신은 누구입니까' 응답을 비교했습니다. 결과는 다음과 같습니다.
claude-opus-4-5-20250929, claude-sonnet-4-5-20250929 등 Claude 공식 내부 배포 ID 문자열까지 출력합니다.# K3가 출력할 수 있는 내부 배포 ID (실제 Claude는 보통 능동 보고하지 않음) claude-opus-4-5-20250929 claude-sonnet-4-5-20250929 # Greenblatt 해석: 모델이 '교사 모델' 배포 메타데이터를 말함 # → 교사 모델보다 더 정확 → 배포 메타데이터가 포함된 # Claude 학습 데이터(API 로그 또는 라벨 합성 데이터) 혼입 가능성
Greenblatt 본인은 이것이 「증류가 발생했다」를 직접 증명하지는 않는다고 강조합니다. 정체성 혼동은 학습 데이터 오염, 시스템 프롬프트 유출, 공개 데이터셋 합성 샘플에서도 발생할 수 있습니다. 다만 Anthropic 2월 비난과 이번 통계 패턴을 결합하면, '증류설'이 '백악관 구호'보다 더 견고한 기술적 뒷받침을 처음 갖게 되었습니다.
| 항목 | Claude Opus 5 | Kimi K3 |
|---|---|---|
| 가격대 | 폐쇄 API, Fable 5의 약 절반 | 오픈 + 저가, 공식적으로 Fable 5 / GPT-5.6 Sol 대비 훨씬 저렴 |
| 컴플라이언스 / 데이터 보존 | 기본 보존 강제 없음, Anthropic 공식 채널 | 오픈 가중치, 증류 의혹으로 공급망 리스크 |
| 독립 검증 가능성 | API 즉시 사용, 벤치마크 재현 가능 | 7월 27일 전까지 아키텍처 검증 불가 |
| 검열 / 거부 | 정렬 정책 엄격, 사이버 보안 분류기가 고위험 작업 차단 | 커뮤니티는 검열 제한이 적은 점을 강점으로 봄 |
| 로컬 배포 | 폐쇄, 로컬 불가 | 2.8T 파라미터, 로컬 풀 구동은 사실상 불가 |
| 적합 시나리오 | 컴플라이언스 민감 기업, 일상 Agent / 코딩 주력 | 극한 비용, 출처 논란 수용, 가중치 검증 후 실측 대기 |
컴플라이언스 경계를 명확히 합니다: 데이터 보존, 수출 통제, 공급망 감사가 관련되면 벤치마크 점수만이 아니라 Opus 5의 '기본 보존 강제 없음'과 Anthropic 공식 SLA를 우선 평가합니다.
실제 토큰 비용을 계산합니다: Opus 5는 Opus 4.8과 동일 가격이지만 능력은 급상승했습니다. Fable 5 가격 때문에 망설였다면 CursorBench / AutomationBench로 작업 A/B 후 기본 라우팅을 결정합니다.
K3는 7월 27일까지 결론을 보류합니다: 전체 가중치 공개 전에는 아키텍처와 점수를 외부가 독립 검증할 수 없습니다. 오픈 가중치 카운트다운으로 검증 체크리스트를 준비합니다.
'정체성 혼동' 간접 신호에 주목합니다: 오픈 모델에 간단한 '당신은 누구입니까' 프로브를 실행합니다. 비정상적 배포 ID 출력은 학습 데이터 오염 위험을 시사하며, 프로덕션 Agent 라우팅에서 특히 중요합니다.
다국어 콘텐츠는 차별화 각도를 반영합니다: 영문 블로그 H2는 Why does Kimi K3 say it's Claude 같은 실제 검색어를 타겟하고, '증류 논란'을 직역하지 않습니다.
실행 계층과 모델 계층을 분리합니다: API가 Opus 5든 K3든 iOS CI/CD, CLI Agent 장세션, Keychain 격리 등 macOS 고부하 작업에는 안정적 실행 노드가 필요합니다. 모델 가격 인하가 인프라 비용을 대체하지는 않습니다.
Opus 5는 클라우드 API '일상 주력' 티어를 크게 끌어올렸고, K3는 오픈·폐쇄 격차를 '일 단위'로 압축했습니다. 그러나 저가 Linux VPS는 xcodebuild, notarytool, Claude Code에 필요한 macOS 툴체인을 실행할 수 없습니다. 로컬 Mac은 메모리·디스크 병목이 흔합니다. 팀이 다중 모델 API 라우팅과 iOS CI/CD / CLI Agent 장세션을 동시에 운영한다면, macOS 고부하를 SSH가 안정적인 전용 원격 노드에 두는 편이 단일 로컬 하드웨어에 의존하는 것보다 신뢰성이 높습니다. 모델 API가 아무리 저렴해도 Keychain 격리와 세션 안정성 문제는 해결되지 않습니다. 안정적 SSH 장세션과 예측 가능한 대역폭이 필요한 프로덕션 환경에서는 NodeMini Mac Mini 클라우드 임대가 일반적으로 더 나은 선택입니다. 사양은 임대 가격 안내를, 접속은 고객센터를 참고하세요.
최종 업데이트: 2026-07-25. K3 전체 가중치는 7월 27일 공개 예정이며, 공개 후 독립 검증 결과를 추적할 것을 권장합니다.
Opus 5는 $5/$25 per 1M 입력/출력 토큰으로 Fable 5($10/$50 수준)의 약 절반입니다. CursorBench 3.2 기준 Fable 5 최고와 1% 미만 차이입니다. Agent 워크플로와 함께 안정적 macOS 실행 계층이 필요하면 임대 가격 안내를 참고하세요.
예. 2026년 7월 24일 출시 당일부터 Opus 5가 Claude Max 기본 모델이 되었으며, Claude Pro 사용자도 현재 최강 버전을 사용할 수 있습니다. Claude API, AWS Bedrock, Google Vertex AI, Microsoft Foundry에서 모델 ID claude-opus-5로 접근할 수 있습니다.
본문 작성 시점까지는 최종 입증되지 않은 논쟁입니다. 백악관은 공개 증거를 제시하지 않았고, 전문가들은 2주 내 깊은 증류가 비현실적이라고 지적합니다. Ryan Greenblatt가 발견한 'K3 Claude 자칭 및 내부 버전 출력'이 현재 가장 기술적인 간접 증거입니다. K3 기술 세부는 Kimi K3 심층 리뷰를 참고하세요.
공식적으로 2026년 7월 27일 전체 가중치 공개를 약속했습니다. 본문 작성 시점에는 아직 공개되지 않아 외부 연구자가 아키텍처와 점수를 완전히 독립 검증할 수 없었습니다. 공개일 체크리스트는 오픈 가중치 카운트다운을 참고하세요.
Redwood Research 통계 분석에 따르면 K3는 정체성 질문에 비정상적으로 자주 Claude라고 답하며 claude-opus-4-5-20250929 등 내부 배포 ID를 출력합니다. 실제 Claude 모델보다 더 정확하게 보고하는 경향이 있어, 배포 메타데이터가 포함된 Claude 학습 데이터 혼입 가능성을 시사하지만 증류를 직접 증명하지는 않습니다. 원격 개발 환경 문제는 고객센터를 참고하세요.