딥시크 V4 Flash와 V4 Pro API는 모델·토큰 종류·캐시 여부·사용 시간에 따라 기존보다 50%에서 1,100% 이상 비싸졌으며, 피크 요금은 오프피크의 두 배다. 오픈AI는 ChatGPT Free와 Go 이용자의 기본 모델을 GPT 5.6 Luna로 바꾸고 일상적인 텍스트 대화를 사실상 무제한으로 제공하는 한편, 파일·이미지·기타 도구에는 별도 제한을 유지한다.
연구 답변

Create a landscape editorial hero image for this Studio Global article: How did the latest pricing and access decisions by DeepSeek and OpenAI illustrate the intensifying US–China AI competition, and what were th. Article summary: These moves show competition shifting from a simple “cheapest model wins” contest to a two-front battle: Chinese providers are monetizing enormous developer demand while retaining major cost advantages, and OpenAI is def. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
딥시크와 오픈AI의 최근 결정은 미국과 중국의 AI 경쟁이 더 이상 ‘누가 가장 싼 모델을 제공하느냐’만으로 설명되지 않는다는 점을 보여준다. 딥시크는 대규모 API 수요와 제한된 컴퓨팅 용량을 수익화하는 방향으로 움직였고, 오픈AI는 ChatGPT 무료 이용자에게 텍스트 대화를 넓게 개방해 사용자 습관과 유통망을 지키려 했다.
결국 경쟁의 무대는 API 가격, GPU 용량, 개발자 채택, 소비자 접점, 기업용 통제 기능으로 세분화되고 있다.
딥시크는 8월 13일 V4-Flash와 V4-Pro API의 가격 인상을 발표했다. 새 요금제는 8월 16일 16시(UTC)부터 적용됐으며, 베이징 시간으로는 8월 17일이다. 기존의 정액형 과금 대신 피크·오프피크 요금제가 도입됐다.
피크 시간은 01:00~04:00 UTC와 06:00~10:00 UTC다. 나머지 시간은 오프피크로 분류되며, 피크 요금은 새 오프피크 요금의 두 배다. 하루 24시간 중 피크는 7시간, 오프피크는 17시간에 해당한다.
아래 금액은 토큰 100만 개당 미국 달러 기준이다.
| 모델 | 시간대 | 캐시 적중 입력 | 캐시 미적중 입력 | 출력 |
|---|---|---|---|---|
| V4-Flash | 오프피크 | $0.007 | $0.22 | $0.66 |
| V4-Flash | 피크 | $0.014 | $0.44 | $1.32 |
| V4-Pro | 오프피크 | $0.022 | $0.66 | $1.98 |
| V4-Pro | 피크 | $0.044 | $1.32 | $3.96 |
인상 폭은 모델, 토큰 유형, 캐시 상태, 사용 시간에 따라 달라진다. 로이터는 이번 변경이 기존 가격보다 50%에서 1,100% 이상 높은 수준이라고 전했다.
개발자가 체감하는 차이는 출력 토큰을 대량으로 생성할 때 가장 크다. V4-Pro의 출력 요금은 기존 100만 토큰당 $0.87에서 오프피크 $1.98, 피크 $3.96으로 올랐다. 한 달에 출력 토큰 1,000만 개를 생성하는 코딩 에이전트라면 입력 토큰 비용을 제외하고 기존에는 약 $8.70를 냈지만, 모든 작업이 오프피크에 몰리면 약 $19.80, 피크 시간에 집중되면 약 $39.60를 부담하게 된다.
이번 변화로 API 비용 관리는 모델 선택만의 문제가 아니게 됐다. 배치 작업, 코드 생성, 평가용 테스트처럼 즉시 결과가 필요하지 않은 작업은 오프피크 시간대로 옮겨 비용을 줄일 수 있다.
반면 사용자가 기다리는 대화형 서비스는 요청이 들어오는 시간을 자유롭게 조정하기 어렵다. 실시간 코딩 도우미나 에이전트 서비스 운영자는 피크 시간대의 비용 상승을 그대로 감당해야 할 가능성이 크다.
캐싱과 요청 라우팅의 중요성도 커졌다. 캐시 적중률을 높이고, 반복 작업은 상대적으로 저렴한 V4-Flash로 보내며, 일부 요청은 다른 공급업체로 분산하면 가격 인상의 영향을 줄일 수 있다. 기업 입장에서는 모델 선택이 한 번의 벤치마크 비교가 아니라 운영 구조와 직결된 결정이 된 셈이다.
딥시크가 여전히 비용 경쟁력을 갖고 있다는 점도 중요하다. 가격이 올랐지만 고용량 에이전트 작업에서 앤트로픽이나 오픈AI의 일반적인 최첨단 모델 API보다 낮은 가격대라는 매력은 남아 있다. 다만 과거의 ‘압도적으로 저렴한 추론 비용’이 만들어낸 격차는 좁아졌다.
피크 요금제는 수요를 관리하고 제한된 컴퓨팅 용량에서 더 많은 가치를 회수하려는 사업적 움직임으로 해석할 수 있다. 다만 제공된 자료만으로 딥시크가 수익성을 확보했거나 명확한 수익 경로에 들어섰다고 단정할 근거는 충분하지 않다.
오픈AI는 다른 방식으로 대응했다. 8월 6일 GPT-5.6 Luna를 ChatGPT Free와 Go 이용자의 기본 모델로 지정하고, 기존 GPT-5.5를 대체한다고 발표했다. 두 요금제 이용자는 남용 방지 장치가 적용되는 범위에서 일상적인 텍스트 대화를 무제한으로 사용할 수 있으며, 어려운 질문을 위한 Think 옵션도 제공받는다.
다만 ‘무제한’이라는 표현은 ChatGPT 전체 기능에 적용되는 것이 아니다. 파일 업로드, 이미지 생성, 음성 및 기타 도구에는 별도 제한이 남아 있다. Free와 Go 이용자는 GPT-5.6 제품군의 상위 모델인 Sol을 사용할 수 없으며, 해당 등급의 기본 모델과 Think 기능을 담당하는 모델은 Luna다.
Luna는 GPT-5.6 제품군에서 플래그십인 Sol보다 경제성과 대중적 접근성을 중시한 모델로 자리매김하고 있다. 일부 외부 보도는 Luna API 가격을 입력 토큰 100만 개당 $0.20, 출력 토큰 100만 개당 $1.20로 제시하지만, 제공된 자료에서 가장 권위 있는 출처를 통해 해당 수치를 직접 확인할 수는 없다.
확실한 전략적 차이는 따로 있다. Luna는 ChatGPT Free와 Go의 텍스트 대화에서는 사실상 무료로 제공되지만, API 사용은 별도의 유료 상품이다. 소비자용 서비스의 문턱을 낮추면서 개발자용 API 사업의 과금 구조는 유지한 것이다.
두 회사의 결정은 중국계 모델이 개발자 트래픽을 빠르게 끌어들이던 시점에 나왔다. 블룸버그는 중국계 모델이 6월 OpenRouter에서 미국 플랫폼을 처음으로 앞질렀고, 다음 달 토큰 점유율이 60%를 넘었다고 보도했다. OpenRouter는 개발자가 여러 AI 모델에 접근하고 요청을 분산하는 플랫폼이지만, 전 세계 전체 AI 사용량을 측정하는 지표는 아니다.
7월 OpenRouter 토큰 사용량 순위에서는 중국에서 개발된 모델이 상위 5개 자리를 모두 차지했다. 샤오미의 MiMo-V2.5가 1위였고, 딥시크, 미니맥스, 알리바바의 Qwen 계열, 문샷의 Kimi가 뒤를 이었다. 다른 분석에서는 6월 딥시크가 플랫폼 내 개별 공급업체 기준 17.6%의 점유율로 가장 큰 공급업체였다고 집계했다.
이런 흐름은 왜 가격이 여전히 핵심 변수인지 설명해준다. 반복 실행이 많은 코딩 작업과 에이전트 업무에서는 충분히 저렴한 모델이 막대한 토큰을 처리하기에 유리하다. 동시에 오픈AI의 전략은 사용량을 확보하는 방법이 API 가격 인하만은 아니라는 점을 보여준다. 유능한 모델을 무료 이용자 앞에 배치하면 습관적 사용, 제품 피드백, 향후 유료 전환 가능성을 함께 확보할 수 있다.
딥시크와 오픈AI는 같은 시장 압력의 서로 다른 측면에 대응하고 있다.
따라서 일부 가격이 오르고 있어도 AI 가격 전쟁이 끝났다고 보기는 어렵다. 경쟁이 여러 층으로 나뉘고 있기 때문이다. 한쪽에서는 저비용 추론과 오픈 웨이트 모델의 접근성이 경쟁력을 만들고, 다른 쪽에서는 소비자 도달 범위, 제품 통합, 고급 성능, 기업용 통제 기능이 차별화 요소가 된다.
딥시크의 가격 인상은 낮은 API 가격이 대규모 사용량을 끌어올 수는 있어도, 비용이 영원히 낮게 유지된다는 뜻은 아니라는 점을 일깨운다. 오픈AI의 Luna 무료화는 정반대의 베팅이다. 광범위한 소비자 경험을 보조해 유통망과 사용 습관을 강화한 뒤, 모델 등급과 비텍스트 기능으로 차별화하려는 전략이다.
개발자와 기업 구매자에게 실질적인 교훈은 특정 가격표나 벤치마크를 영구적인 기준으로 삼지 말라는 것이다. 비용은 수요, 모델 등급, 캐시 상태, 시간대에 따라 달라질 수 있다. 실제 업무량을 측정하고, 여러 공급업체로 요청을 분산할 수 있는 구조를 유지하며, 각 작업의 위험도와 비용에 맞는 모델과 이용 등급을 선택하는 아키텍처가 가장 유연한 대응이 될 가능성이 크다.
Studio Global AI
이 페이지에는 Studio Global 내에서 계속할 수 있는 소스 기반 답변이 포함되어 있습니다.
딥시크 V4 Flash와 V4 Pro API는 모델·토큰 종류·캐시 여부·사용 시간에 따라 기존보다 50%에서 1,100% 이상 비싸졌으며, 피크 요금은 오프피크의 두 배다.
딥시크 V4 Flash와 V4 Pro API는 모델·토큰 종류·캐시 여부·사용 시간에 따라 기존보다 50%에서 1,100% 이상 비싸졌으며, 피크 요금은 오프피크의 두 배다. 오픈AI는 ChatGPT Free와 Go 이용자의 기본 모델을 GPT 5.6 Luna로 바꾸고 일상적인 텍스트 대화를 사실상 무제한으로 제공하는 한편, 파일·이미지·기타 도구에는 별도 제한을 유지한다.
OpenRouter에서는 중국계 모델이 최근 토큰 사용량의 60%를 넘겼지만, 이는 전체 글로벌 AI 사용량이 아니라 개발자들의 모델 라우팅 시장을 보여주는 지표다.