딥시크의 V4 Flash·V4 Pro API 요금은 모델과 토큰 유형, 사용 시간에 따라 기존보다 50%에서 최대 1,100% 이상 올랐다. 피크 시간대에는 비피크 요금의 2배가 부과된다. V4 Pro 출력 토큰 1,000만 개를 한 달에 생성하면 비용은 기존 8.70달러에서 비피크 기준 19.80달러, 피크 기준 39.60달러로 늘어난다.
연구 답변

Create a landscape editorial hero image for this Studio Global article: How are DeepSeek’s August 2026 API price increases for V4-Flash and V4-Pro—including peak/off-peak rates, increases of 50% to more than 1,10. Article summary: DeepSeek is moving from a land-grab API strategy toward yield management and monetization, while OpenAI is using free consumer access to defend distribution and habit. They are not directly equivalent offers—developer AP. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
딥시크와 오픈AI가 정반대처럼 보이는 카드를 꺼냈다. 딥시크는 2026년 8월 V4 API 가격을 대폭 올리고 사용량이 몰리는 시간대에 더 비싼 요금을 적용하기 시작했다. 반면 오픈AI는 무료 이용자에게 GPT-5.6 Luna를 기본 제공하고 텍스트 채팅을 무제한으로 확대했다.
두 조치는 같은 상품을 놓고 벌이는 직접적인 경쟁은 아니다. 딥시크의 변화는 개발자용 인프라(API) 가격 정책이고, 오픈AI의 변화는 소비자용 챗봇 서비스 전략이다. 하지만 함께 보면 AI 시장의 질문이 달라지고 있다는 점은 분명하다. 이제 경쟁의 핵심은 ‘누가 가장 싼가’에서 ‘누가 사용량과 이용 습관을 확보하고, 막대한 추론 비용을 감당할 수 있는가’로 옮겨가고 있다.
딥시크의 새 요금제는 2026년 8월 16일 16시(UTC)부터 적용됐다. V4-Flash와 V4-Pro 모두 피크 시간과 비피크 시간 요금이 분리됐으며, 비피크 요금은 피크 요금의 절반이다. 피크 시간은 01:0004:00와 06:0010:00(UTC)이고, 나머지 시간은 비피크로 분류된다.
| 모델 | 시간대 | 캐시 적중 입력 | 캐시 미적중 입력 | 출력 |
|---|---|---|---|---|
| V4-Flash | 비피크 | $0.007 | $0.22 | $0.66 |
| V4-Flash | 피크 | $0.014 | $0.44 | $1.32 |
| V4-Pro | 비피크 | $0.022 | $0.66 | $1.98 |
| V4-Pro | 피크 | $0.044 | $1.32 | $3.96 |
단위는 토큰 100만 개당 미국 달러다. 캐시 적중·미적중은 입력 토큰에 적용된다.
여기서 ‘비피크’가 기존보다 저렴하다는 뜻은 아니다. 새 비피크 요금도 대부분 기존 정액 요금보다 높다. V4-Flash의 출력 요금은 기존 0.28달러에서 0.66달러로, V4-Pro의 출력 요금은 프로모션 가격 0.87달러에서 1.98달러로 올랐다.
로이터에 따르면 새 요금은 모델, 토큰 유형, 사용 시간에 따라 기존 가격보다 50%에서 1,100% 이상 높아졌다.
가장 큰 상승률은 캐시 적중 입력 요금처럼 기존 가격이 매우 낮았던 항목에서 나타난다. 따라서 실제 개발자 부담은 단순히 ‘최대 1,100% 인상’이라는 숫자만으로 판단하기 어렵다. 캐시 적중률, 캐시되지 않은 입력량, 생성 출력량, 트래픽이 집중되는 시간대에 따라 청구액이 달라진다.
예를 들어 V4-Pro 출력 요금은 비피크 기준 기존 프로모션 가격 0.87달러보다 약 128% 비싸고, 피크 기준으로는 약 355% 비싸다.
그럼에도 딥시크는 가격 인상 후에도 여러 미국계 폐쇄형 모델보다 여전히 저렴한 편이다. 앞서 보도된 프로모션 가격 기준 V4-Pro 출력 요금은 토큰 100만 개당 약 0.87달러였고, 주요 미국 모델의 과거 가격은 이보다 훨씬 높았다. 이번 인상은 딥시크의 비용 우위를 약화시키지만 완전히 없애지는 않는다.
개발자가 매달 V4-Pro로 출력 토큰 1,000만 개를 생성한다고 가정해 보자. 입력 토큰과 캐시 비용을 제외한 출력 비용만 계산하면 다음과 같다.
따라서 월 부담은 사용 시간에 따라 약 11.10~30.90달러 증가한다. 이 계산에는 입력 토큰, 캐시 적중 요금, 세금 및 기타 플랫폼 수수료가 포함되지 않는다.
실제 서비스에서는 출력량보다 워크로드 구성 자체가 더 큰 변수가 될 수 있다. 긴 프롬프트를 사용하거나 캐시 재사용률이 낮고, 요청이 피크 시간에 몰리는 애플리케이션이라면 체감 인상 폭이 더 커질 수 있다. 새 요금제 아래에서는 배치 작업을 비피크 시간으로 옮기고 캐시 적중률을 지속적으로 확인하는 일이 중요해진다.
오픈AI는 소비자용 챗GPT에서 다른 방향을 택했다. GPT-5.6 Luna를 무료 및 Go 이용자의 기본 모델로 지정하고, 텍스트 채팅을 무제한으로 제공한다고 발표했다. 어려운 질문에 더 많은 추론을 사용하도록 하는 ‘Think’ 버튼도 추가된다.
다만 ‘무제한’이라는 표현에는 조건이 붙는다. 무제한 대상은 텍스트 채팅이며, 파일 업로드·이미지·음성·이미지 생성 등 다른 기능에는 제한이 남는다. 오남용 방지 장치도 적용된다.
이는 API 단가를 최저 수준으로 낮추는 전략이 아니라 소비자 유통망을 넓히는 전략이다. 오픈AI는 일상적인 질문과 대화를 위해 챗GPT에 접근하는 장벽을 낮추고, 더 유능한 모델을 기본 화면 안에 배치하려 한다. 테크크런치는 이번 발표 당시 챗GPT의 주간 이용자가 10억 명을 넘어섰다고 보도했다.
저렴한 토큰 가격은 중국계 모델이 개발자 사용량을 빠르게 확보하는 데 중요한 역할을 했다. Vercel AI Gateway의 한 지표에 따르면 중국산 오픈 웨이트 모델은 2026년 6월 해당 게이트웨이를 통과한 프로덕션 토큰의 29%를 처리했다. 4월의 약 9분의 1 수준에서 크게 늘어난 수치다. 반면 지출 비중은 4% 미만이었다.
다만 이 수치는 Vercel의 특정 게이트웨이 트래픽을 보여줄 뿐, 전 세계 AI 시장 전체를 측정한 것은 아니다. 토큰 점유율은 얼마나 많은 작업이 특정 시스템으로 흘러가는지를 나타내지만, 매출·이익·고객 충성도·지속적인 시장 지배력을 직접 증명하지는 않는다. 개발자는 여러 공급업체 사이에서 작업을 유동적으로 배분할 수 있고, 가격에 민감한 트래픽은 요금이 바뀌면 빠르게 이동할 수 있다.
딥시크의 새 시간대별 요금제는 사용량을 확보하는 것만으로는 충분하지 않다는 판단을 보여준다. 수요가 몰리는 시간에 더 높은 가격을 부과하면 용량을 배분하고 수익을 높일 수 있다. 딥시크 공식 문서도 이번 변경을 자원 배분을 위한 조치로 설명하며, 실제 사용 패턴에 맞춰 작업 시간을 조정할 것을 권고한다.
중국 AI 업계 전반에서도 비슷한 움직임이 나타나고 있다. 문샷AI와 바이트댄스가 유료 요금제를 도입하고, 알리바바도 뒤따를 준비를 하고 있다는 보도가 나왔다. 이는 중국 AI 기업들의 경쟁 축이 공격적인 보조금과 초저가에서 수익화로 이동하고 있음을 시사한다.
물론 이것만으로 딥시크나 경쟁사들이 수익을 내고 있다고 단정할 수는 없다. 다만 낮은 가격으로 확보한 시장 점유율을 토큰당 매출, 반복 계약 또는 다른 지속 가능한 사업 모델로 전환해야 하는 시점이 다가왔다는 점은 분명하다.
오픈AI의 Luna 무료 제공은 API 최저가 경쟁보다 유통과 습관 형성에 초점을 맞춘다. 무료 이용자가 텍스트 채팅을 폭넓게 사용하도록 하고, ‘Think’ 버튼을 통해 필요할 때만 더 많은 추론을 사용하게 함으로써 기본 서비스의 이용 빈도를 높이려는 전략이다. 동시에 비용이 더 많이 드는 기능에는 제한을 둔다.
두 회사의 전략을 단순화하면 다음과 같다.
두 전략은 동시에 존재할 수 있다. 개발자는 대규모 작업에 딥시크를 선택하면서도, 개인적인 일반 업무에는 챗GPT를 사용할 수 있다. 그러나 두 회사 모두 자사 생태계의 교체 비용을 높이려 한다는 점은 같다. 딥시크는 가격 대비 성능과 개발자 라우팅으로, 오픈AI는 제품 친숙도와 소비자 도달 범위로 이용자를 붙잡으려 한다.
딥시크는 가격을 올린 뒤에도 저비용 선택지로 남아 있지만, 이제 ‘가장 싼 모델’이라는 설명만으로는 부족하다. 개발자는 캐시 적중 입력, 캐시 미적중 입력, 출력량, 피크 시간대 사용 비중을 모두 반영해 실제 청구액을 비교해야 한다.
실무적으로는 다음 질문이 중요하다.
결국 미·중 AI 경쟁은 누가 가장 낮은 가격을 제시하느냐의 싸움에서 한 단계 더 복잡해지고 있다. 딥시크는 비용 대비 성능 우위를 지속 가능한 단위경제로 바꿀 수 있는지 시험하고 있다. 오픈AI는 무료이면서 습관적인 소비자 접근성이 장기적인 생태계 지배력으로 이어질 수 있는지 시험한다.
두 회사가 풀어야 할 문제는 다르지만 근본적으로 같다. 폭발적으로 늘어나는 사용량을, 최첨단 모델의 막대한 컴퓨팅 비용을 계속 감당할 수 있는 사업으로 전환해야 한다는 점이다.
Studio Global AI
이 페이지에는 Studio Global 내에서 계속할 수 있는 소스 기반 답변이 포함되어 있습니다.
딥시크의 V4 Flash·V4 Pro API 요금은 모델과 토큰 유형, 사용 시간에 따라 기존보다 50%에서 최대 1,100% 이상 올랐다.
딥시크의 V4 Flash·V4 Pro API 요금은 모델과 토큰 유형, 사용 시간에 따라 기존보다 50%에서 최대 1,100% 이상 올랐다. 피크 시간대에는 비피크 요금의 2배가 부과된다. V4 Pro 출력 토큰 1,000만 개를 한 달에 생성하면 비용은 기존 8.70달러에서 비피크 기준 19.80달러, 피크 기준 39.60달러로 늘어난다.
오픈AI는 GPT 5.6 Luna를 무료·Go 요금제의 기본 모델로 지정하고 텍스트 채팅을 무제한으로 확대했다. 다만 파일·이미지·음성 등에는 별도 제한이 남는다.