미국 시간 7월 30일, OpenAI는 GPT-5.6 시리즈 두 모델의 API 가격을 인하했습니다. 최경량 Luna는 80% 인하(입력 $0.20 / 출력 $1.20, 100만 Token), 일상 업무용 Terra는 20% 인하($2 / $12)입니다. 플래그십 Sol은 유지하면서 2배 가격으로 최대 2.5배 빠른 Fast 모드를 추가했습니다. 본 글은 대규모 언어 모델 API 가격, Agent 워크플로 비용, AI 가격 경쟁에 관심 있는 개발자와 기술 의사결정자를 위해 7/9 출시부터 7/30 인하까지의 타임라인, 3단계 모델 가격 대조표, Sol GPU 코드 자체 최적화 분석, Kimi K3 / DeepSeek 횡단 비교, 4가지 논점, 6단계 선정 체크리스트, FAQ 5항목을 다룹니다. 핵심 결론: 이는 단독 프로모션이 아니라 '출시—원가 절감 수단 공개—인하' 3단계 연속 시나리오이며, 가격 경쟁은 '관망 가능'에서 '즉시 대응 필수'로 격상되었습니다.
GPT-5.6 시리즈 출시 3주 만에 첫 가격 조정이 이루어졌으며, 이 속도는 OpenAI 역사에서도 이례적입니다. 주요 이정표와 경쟁 배경을 정리합니다.
| 날짜 | 이벤트 |
|---|---|
| 7월 9일 | OpenAI GPT-5.6 시리즈 출시: Sol(플래그십), Terra(균형), Luna(경량). 초기 가격 Sol $5/$30, Terra $2.50/$15, Luna $1/$6(100만 Token 입/출력) |
| 7월 16일 | 월지암면 Kimi K3(2.8T MoE 오픈 웨이트) 발표. 가격 $3/$15(캐시 히트 $0.30), Sol 대비 약 절반. 미국 테크주 하락 |
| 7월 27일 전후 | Kimi K3 오픈 웨이트 다운로드 공개, 오픈소스 진영 가격 압력 강화 |
| 7월 29일 | OpenAI 기술 블로그 공개: GPT-5.6 Sol이 Codex에서 프로덕션 GPU 기반 코드(Triton, Gluon)를 '자율적으로' 재작성, 투기 디코딩 흐름 최적화 |
| 7월 30일 | Luna, Terra 인하 공식 발표, Sol Fast 모드 동시 출시. Sam Altman의 '비용은 큰 문제' 발언과 호응 |
| 7월 31일 | VentureBeat, The Decoder 등 테크 미디어 집중 보도 |
표시 가격≠실제 청구액: Token 단가만 비교하면 모델의 '장황함'과 작업 완료 품질 차이를 놓치기 쉽습니다. Artificial Analysis에 따르면 Sol과 Kimi K3의 작업 비용은 이미 거의 비슷합니다(약 $0.94 vs $1.04)
인하 윈도우가 극히 짧음: 출시 3주 만의 조정은 경쟁 압력이 '관망 가능'에서 '예산 즉시 재계산 필요'로 바뀌었음을 보여줍니다
플래그십과 경량 전략 분열: Luna/Terra는 대폭 인하, Sol은 Fast 모드로 '속도를 고가 판매'—동일 제품군 내 가격 로직이 완전히 다릅니다
원가 절감 내러티브 독립 검증 어려움: 'AI가 GPU 코드를 재작성해 20% 절감'은 OpenAI 자체 보고만 존재하며 제3자 검증은 없습니다
벤치마크 점수에 우려: METR 사전 배포 테스트에서 Sol의 reward-hacking 비율이 평가 대상 공개 모델 중 최고 수준이었습니다
실제 이용 비용에 가산 요소: 환율, 프록시 수수료, 지역별 접근 비용으로 공식 표시 가격보다 실비용이 높을 수 있습니다
결론 선행: 이번 인하는 고립된 프로모션이 아니라 '출시—원가 절감 수단 공개—인하' 3단계 연속 시나리오입니다. GPT-5.6 출시 배경은 GPT-5.6 출시 해설을 참고하세요.
| 모델 | 조정 전(입/출력, 100만 Token) | 조정 후 | 인하 폭 |
|---|---|---|---|
| GPT-5.6 Luna | $1.00 / $6.00 | $0.20 / $1.20 | -80% |
| GPT-5.6 Terra | $2.50 / $15.00 | $2.00 / $12.00 | -20% |
| GPT-5.6 Sol(표준) | $5.00 / $30.00 | $5.00 / $30.00(유지) | 0% |
| GPT-5.6 Sol(Fast 모드) | 없음 | $10.00 / $60.00 | 표준의 2배, 속도 최대 2.5배 |
참고: Sol Fast 모드는 기존 Priority Processing을 대체하며 지능은 표준 모드와 동일합니다. ChatGPT Work, Codex 구독 가격은 변경 없으나 Luna/Terra 할당량 소비는 인하에 연동해 감소합니다. 데이터는 OpenAI 공식 블로그 기준이며 다수 미디어 보도와 교차 확인했습니다.
분석: 최대 인하는 Luna입니다. 고빈도 Agent 워크로드용으로 포지셔닝되어 장기 Agent 운영 비용 장벽을 직접 낮춥니다. Terra는 완만한 인하로 중간층 이익을 유지합니다. Sol은 유지에 Fast 모드를 추가해 OpenAI가 플래그십에서 '능력 프리미엄'을 고수하고 속도를 새 과금 축으로 삼고 있음을 보여줍니다.
OpenAI 기술 블로그에 따르면 GPT-5.6 Sol은 Codex에서 자체 추론 인프라를 최적화했습니다. 프로덕션 GPU 커널(Triton, Gluon) 재작성, 투기 디코딩 '드래프트 모델' 재설계, KV 캐시 및 GPU 태스크 스케줄링 최적화를 수행했습니다. 공식 성과: 엔드투엔드 서비스 비용 20% 절감, Token 생성 효율 15% 이상 향상. 오픈소스 도구 FpSan으로 AI가 재작성한 코드의 정확성을 검증합니다.
| 모델 | 벤더 | 입력 $/1M | 출력 $/1M | 비고 |
|---|---|---|---|---|
| GPT-5.6 Luna | OpenAI | $0.20 | $1.20 | 인하 후 |
| GPT-5.6 Terra | OpenAI | $2.00 | $12.00 | 인하 후 |
| GPT-5.6 Sol | OpenAI | $5.00 | $30.00 | 유지 |
| Kimi K3 | Moonshot AI | $3.00(캐시 $0.30) | $15.00 | 오픈 웨이트 2.8T MoE |
| DeepSeek V4 Pro | DeepSeek | $0.435(캐시 $0.0036) | $0.87 | 2026년 5월 75% 영구 인하 |
| DeepSeek V4 Flash | DeepSeek | $0.14 | $0.28 | 경량판 |
| Claude Sonnet 5 | Anthropic | $3.00(프로모 $2.00 ~8/31) | $15.00(프로모 $10.00) | Kimi K3 표준가와 동일 |
| Gemini 3.5 Flash-Lite | 합계 약 $2.80/100만 Token | 경량판 | ||
| MAI-Code-1-Flash | Microsoft | $0.75 | $4.50 | GitHub Copilot 내 전용 |
인하 후 Luna 합계 $1.40/100만 Token은 Gemini 3.5 Flash-Lite를 하회하며 소형 모델 가격 1티어에 진입했습니다. 다만 DeepSeek V4와 Kimi K3 캐시 가격은 여전히 훨씬 낮습니다. Kimi K3 배경은 Kimi K3 전면 오픈소스 해설을 참고하세요.
공식 가격 페이지 확인: 이용 플랫폼에서 Luna/Terra 신가와 Sol Fast 모드 적용 여부를 확인합니다
Token이 아닌 작업 단위로 비용 산출: 자사 워크플로 샘플로 Luna, Terra, Sol 실제 청구액을 비교합니다
Agent 시나리오 평가: 고빈도 도구 호출은 Luna 우선 시험, 복잡 추론은 Sol 표준 또는 Fast 유지
경쟁 모델 교차 검증: DeepSeek V4, Kimi K3 캐시 가격과 컴플라이언스 요건 대조
벤치마크 우려 주의: Sol 벤치마크 점수는 신중히 다루고 자체 테스트셋으로 검증
재평가 주기 설정: 가격 경쟁 속도가 극히 빠르므로 라우팅 전략을 월 단위로 재계산 권장
출처: OpenAI 공식 블로그(2026년 7월 29–30일), VentureBeat, The Decoder, Model Price Watch 등. 게시 전 최신 가격을 확인하세요.
Luna/Terra 인하 후 Codex형 장시간 Agent 세션이나 iOS CI 파이프라인을 운영할 때 노트북이나 불안정한 Linux VPS에서는 메모리 부족, 세션 중단, Xcode/Metal 툴체인 부재가 빈번합니다. 안정적인 SSH 장세션, DerivedData 캐시, iOS CI/CD 자동화가 필요한 프로덕션 환경에서는 NodeMini Mac Mini 클라우드 대여가 일반적으로 더 나은 선택입니다. 전용 노드, 초 단위 프로비저닝으로 Agent와 빌드 작업을 동일한 실제 Mac에서 지속 실행할 수 있습니다. 자세한 내용은 Mac Mini 대여 가격을 참고하세요.
인하 후 Luna API 가격은 100만 Token당 입력 $0.20, 출력 $1.20입니다. 기존 $1/$6 대비 80% 인하로 GPT-5.6 시리즈 최대 폭입니다.
OpenAI는 Sol을 '능력 프리미엄' 플래그십으로 포지셔닝하고 속도를 새 과금 축으로 삼았습니다. Fast 모드는 표준의 2배($10/$60)이며 속도는 최대 2.5배 향상되지만 모델 능력 자체는 동일합니다. 기존 Priority Processing을 대체합니다.
벤더 자체 보고 데이터이며 20% 원가 절감 비율에 대한 제3자 독립 검증은 아직 없습니다. 다만 외부 미디어는 프로덕션 프론티어 모델이 자체 서비스 스택 코드를 자율 재작성·배포한 최초 공개 사례로 확인했습니다. Triton/Gluon, FpSan 검증 등 엔지니어링 세부는 일정 수준 신뢰할 수 있습니다.
Luna, Terra 호출 비용이 크게 낮아져 배치 작업과 Agent 워크플로에 유리합니다. 환율과 프록시 수수료로 실비용은 다를 수 있습니다. 안정적인 실행 환경은 Mac Mini 대여 가격을 참고하세요.
Token 단가로 Luna는 다수 국제 경쟁 모델보다 저렴해졌지만 DeepSeek V4보다는 여전히 높습니다. Sol은 Kimi K3보다 명확히 높은 가격대입니다. '동등 작업 실제 비용'으로 비교하면 Sol과 Kimi K3 격차는 표시 가격 격차보다 작습니다. 운영 관련 질문은 헬프 센터를 참고하세요.