오픈AI가 2026년 7월 30일 GPT 5.6 루나 API 가격을 80% 인하해 입력 토큰 100만 개당 0.20달러로 책정…모델 스스로 생산용 GPU 커널을 재작성해 서빙 비용 20%, 토큰 생성 효율 15% 이상 개선한 덕분 플래그십 GPT 5.6 솔 가격은 유지했지만 2.5배 빠른 프리미엄 고속 모드 신설…중간 모델 테라는 20% 인하 중국 Moonshot AI의 2.8조 파라미터 공개 모델 'Kimi K3'와 Anthropic의 'Claude Opus 5' 등 경쟁사의 가격 공세, 기업들의 AI 지출 통제 요구가 가격 인하 배경

Create a landscape editorial hero image for this Studio Global article: What are the details of OpenAI's 80% price cut on GPT-5.6 Luna just three weeks after launch, including the new pricing for Luna, Terra, and. Article summary: On July 30, 2026 — roughly three weeks after launch — OpenAI slashed API prices on two GPT-5.6 models while introducing a faster, premium option for its flagship tier. The cuts were enabled by novel infrastructure optimi. Topic tags: general, general web, user generated, documentation, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, water
2026년 7월 30일, 출시 약 3주 만에 오픈AI(OpenAI)가 GPT-5.6 시리즈의 API 가격을 대폭 인하했습니다. 가장 빠르고 저렴한 모델인 '루나(Luna)'는 무려 80% 가격이 내려갔고, 중간 모델인 '테라(Terra)'도 20% 할인됐습니다. 플래그십 모델인 '솔(Sol)'은 가격이 그대로지만, 더 빠른 '고속 모드(Fast mode)'가 새로 추가됐습니다 .
이번 가격 인하는 단순한 프로모션이 아닙니다. 그 배경에는 모델이 스스로 자신을 최적화하는 전례 없는 엔지니어링 성과, 중국발(發) 저가 공세, 그리고 AI 비용에 민감해진 기업들의 요구가 복합적으로 작용했습니다.
| 모델 | 입력 (100만 토큰 당) | 출력 (100만 토큰 당) | 변동 폭 |
|---|---|---|---|
| GPT-5.6 루나 (저가/고속) | $0.20 | $1.20 | 80% 인하 ($1/$6 대비) |
| GPT-5.6 테라 (균형형) | $2.00 | $12.00 | 20% 인하 ($2.50/$15 대비) |
| GPT-5.6 솔 (플래그십) | $5.00 | $30.00 | 가격 유지, 고속 모드 추가 |
루나의 입력+출력 결합 가격은 100만 토큰당 1.40달러로, 현재 시장에서 가장 저렴한 최첨단 모델 중 하나가 됐습니다 . 솔의 고속 모드는 표준 처리보다 최대 2.5배 빠른 속도를 제공하며, 가격은 표준의 2배이지만 성능 저하는 없습니다
.
이번 가격 인하의 가장 놀라운 점은 그 동력이 모델 자체에서 나왔다는 사실입니다. 7월 29일, 오픈AI는 GPT-5.6 솔이 자율적으로 자사의 생산용 GPU 커널(GPU에서 모델을 실제로 구동하는 저수준 코드)을 재작성하고 최적화했다고 공개했습니다 .
솔은 Codex 개발 환경을 통해 오픈AI의 내부 인프라에 접속해 수백 가지 아키텍처 실험을 설계 및 실행하고, 배포를 진행하며 결과를 반복적으로 개선했습니다 . 이 과정에서 솔은 오픈AI 커널 스택에 사용되는 프로그래밍 언어인 Triton과 Gluon의 문법을 스스로 학습했습니다
.
이러한 개선은 더 광범위한 스택 최적화의 일환이었습니다. 보고서에 따르면 지리적 위치, 가속기 유형, 캐시 가용성에 따라 요청을 동적으로 분배하는 부하 분산(Load Balancing) 개선과 약 30분의 TTL(만료 시간)을 가져 캐시된 입력을 신규 입력보다 90% 저렴하게 만드는 프롬프트 캐싱(Prompt Caching) 도 포함됐습니다 .
오픈AI가 불과 3주 만에 이렇게 공격적으로 가격을 인하한 데는 불과 몇 주 사이에 극적으로 변화한 경쟁 구도가 자리 잡고 있습니다.
베이징 소재 스타트업 Moonshot AI의 'Kimi K3' (7월 17일 출시)는 2.8조 개의 파라미터를 가진 오픈 웨이트(open-weight) 모델로, 프론트엔드 코딩 벤치마크에서 GPT-5.6 솔과 Anthropic의 Fable 5를 능가하거나 동등한 성능을 보였습니다 . Arena의 프론트엔드 코드 리더보드에서 Kimi K3는 1,679점을 기록하며 GPT-5.6 솔과 Fable 5를 모두 제쳤습니다
. 7월 30일 Startrise AI Labs가 발표한 독립 벤치마크에서도 Kimi K3는 Anthropic의 Claude Opus 5와 프론트엔드 엔지니어링 테스트에서 동률을 기록했지만, 비용은 Claude Opus 5의 21.17달러에 비해 7.17달러에 불과해 3분의 1 수준이었습니다
.
Kimi K3는 세계 최대의 오픈 웨이트 AI 모델이 되었으며, 마이크로소프트(Microsoft)는 이를 코파일럿(Copilot)에 도입하는 방안을 검토 중인 것으로 알려졌습니다. 이 경우 마이크로소프트는 토큰당 최대 60%, 약 6억 달러를 절약할 수 있을 것으로 추산됩니다 .
Anthropic은 7월 24일 'Claude Opus 5'를 출시했습니다. Fable 5 가격의 절반인 100만 입력 토큰당 5달러에 책정됐지만, 여러 벤치마크에서 Fable 5를 능가하는 성능을 보여줬습니다 . 이는 GPT-5.6 솔이 경쟁하는 바로 그 가격대에 압박을 가한 셈입니다.
구글(Google) 과 마이크로소프트 역시 7월에 여러 비용 효율적인 모델을 출시하며 중저가 시장을 더욱 압박하고 있습니다 .
이러한 경쟁 속에서 오픈AI는 루나를 대규모 트래픽과 가격에 민감한 작업을 위한 '미끼 상품(loss leader)'으로 포지셔닝하고, 솔은 프리미엄 차별화 요소로 유지하는 전략을 취하고 있는 것으로 분석됩니다 .
이번 가격 인하는 기업들의 AI 지출에 대한 인식 변화와도 무관하지 않습니다. 기업들은 점차 AI 지출에 대해 클라우드 비용을 관리하듯 엄격한 예산 통제를 요구하고 있습니다.
오픈AI는 7월 22일 API 플랫폼에 강제적인 월간 지출 한도(Hard Spend Limits) 기능을 추가했습니다 . 6월 ChatGPT Enterprise에 도입된 소프트 한도(관찰용 대시보드 기능)와 달리, 7월 22일 기능은 설정된 월 예산이 소진되면 실시간 API 요청이 실패(HTTP 429 에러) 하도록 만듭니다
. 관리자는 조직 또는 프로젝트 수준에서 한도를 설정할 수 있으며, 한도는 매 billing cycle 시작 시 재설정됩니다
.
이는 확산되는 현실적인 문제에 대한 직접적인 대응이었습니다. 복수의 소식통에 따르면 아마존(Amazon) 을 비롯한 대형 기업들이 AI 지출에 대한 내부 및 고객 측 한도를 설정하고 있으며, 기업들은 AI 투자 수익률(ROI)을 면밀히 검토하고 있습니다 . Reuters는 비용에 민감한 기업들이 이제 AI를 '클라우드를 대하듯' 취급하며, 전용 예산 편성, 할당량 제한, 대규모 배포 시 CIO 수준의 승인을 요구하는 추세라고 보도했습니다
.
오픈AI의 강제 지출 한도는 토큰당 가격을 낮추는 동시에, 기업들에게 예상치 못한 AI 에이전트 비용 폭주를 막을 수 있는 안전장치를 제공합니다. 여기서 전달하는 메시지는 분명합니다. 'AI에 비용을 아끼지 않는다'는 시대는 끝났다는 것입니다.
개발자와 기업 입장에서 이번 가격 인하의 단기적 영향은 분명합니다:
더 넓은 교훈: AI 가격 전쟁은 실제이며 가속화되고 있습니다. 그리고 이 전쟁은 경쟁 압력뿐 아니라, 모델이 스스로 프로덕션 코드를 최적화하는 전례 없는 시나리오를 포함한 엔지니어링 효율성 혁신에 의해 주도되고 있습니다. 기업들은 이러한 자기 최적화 기술이 성숙해지고 오픈 웨이트 모델이 성능 격차를 계속 좁혀감에 따라 업계 전반에 걸친 추가적인 가격 하락을 기대해야 합니다.
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
오픈AI가 2026년 7월 30일 GPT 5.6 루나 API 가격을 80% 인하해 입력 토큰 100만 개당 0.20달러로 책정…모델 스스로 생산용 GPU 커널을 재작성해 서빙 비용 20%, 토큰 생성 효율 15% 이상 개선한 덕분
오픈AI가 2026년 7월 30일 GPT 5.6 루나 API 가격을 80% 인하해 입력 토큰 100만 개당 0.20달러로 책정…모델 스스로 생산용 GPU 커널을 재작성해 서빙 비용 20%, 토큰 생성 효율 15% 이상 개선한 덕분 플래그십 GPT 5.6 솔 가격은 유지했지만 2.5배 빠른 프리미엄 고속 모드 신설…중간 모델 테라는 20% 인하
중국 Moonshot AI의 2.8조 파라미터 공개 모델 'Kimi K3'와 Anthropic의 'Claude Opus 5' 등 경쟁사의 가격 공세, 기업들의 AI 지출 통제 요구가 가격 인하 배경