딥시크가 2026년 8월 13일 V4 Pro 및 V4 Flash 모델의 API 가격을 50% 1,100% 인상한다고 발표했으며, 새로운 피크/오프피크 시간대별 과금은 8월 16일 16:00 UTC부터 적용됩니다 [17][19]. 두 V4 모델 모두 100만 토큰 컨텍스트 윈도우, MIT 라이선스, 최대 384K 출력 토큰을 지원합니다.
연구 답변

Create a landscape editorial hero image for this Studio Global article: What new API pricing did DeepSeek announce for its V4 models, when does it take effect, and what are the key details about the models' conte. Article summary: On August 13, 2026, DeepSeek announced major API price increases for its V4-Pro and V4-Flash models, with new peak/off-peak billing tiers taking effect at **16:00 UTC on August 16, 2026** [1][4]. The increases range from. Topic tags: general, academic, documentation, general web, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
2026년 8월 13일, 딥시크(DeepSeek)가 V4-Pro 및 V4-Flash 모델에 대한 주요 API 가격 인상을 발표하고 피크/오프피크 시간대별 과금 체계를 도입했습니다. 새로운 요금은 2026년 8월 16일 16:00 UTC부터 적용됩니다 . 인상 폭은 모델, 토큰 유형, 시간대에 따라 현재 요금 대비 50%에서 최대 1,100% 에 달합니다
. 이는 공격적인 저가 전략으로名声을 쌓아온 회사에 있어 큰 변화입니다.
딥시크는 주요 AI API 제공업체 중 최초로 전력 피크/오프피크 요금제를 모델로 한 구조적 시간대별 차등 가격제를 도입했습니다 . 오프피크 요금은 피크 요금의 50% 수준으로, 피크 시간대 API 호출 비용이 두 배가 됩니다
. 피크 시간대(UTC)는 01:00–04:00 및 06:00–10:00로 알려져 있습니다
.
| 토큰 유형 | 현재 가격 | 신규 오프피크 | 신규 피크 |
|---|---|---|---|
| 입력(캐시 미스) | $0.435 | ~$0.44–$0.49 (추정) | ~$0.87–$0.98 (추정) |
| 출력 | $0.87 | $1.98 | $3.96 |
| 토큰 유형 | 현재 가격 | 신규 오프피크 | 신규 피크 |
|---|---|---|---|
| 입력(캐시 미스) | $0.14 | ~$0.21 (추정) | ~$0.42 (추정) |
| 출력 | $0.28 | $0.63 | $1.26 |
(신규 등급의 입력 캐시 미스 가격은 확인된 출력 배율로 추정한 것입니다. 출력 가격 인상은 여러 출처에서 확인되었습니다 .)
캐시된 입력 토큰은 여전히 매우 저렴합니다. V4-Pro의 경우 캐시 히트 입력은 100만 토큰당 약 $0.004로 유지되어, 캐싱 전략을 최적화하는 개발자에게 100배의 할인 혜택을 제공합니다 .
두 V4 모델 모두 텍스트 전용, Mixture-of-Experts(MoE) 아키텍처이며 MIT 라이선스로 출시되어 완전히 오픈 웨이트이며 자체 호스팅이 가능합니다 .
| 사양 | DeepSeek V4-Pro | DeepSeek V4-Flash |
|---|---|---|
| 총 파라미터 | 1.6조 | 2840억 |
| 토큰당 활성 파라미터 | ~490억 | ~130억 |
| 컨텍스트 윈도우 | 1,000,000 토큰 | 1,000,000 토큰 |
| 최대 출력 길이 | 384,000 토큰 | 384,000 토큰 |
| 라이선스 | MIT | MIT |
두 모델 모두 세 가지 추론 모드를 지원합니다: 논-띵크(Non-think, 빠르고 직관적), 띵크 하이(Think High, 체인 오브 소트를 통한 논리적 분석), 띵크 맥스(Think Max, 심층 추론) .
새로운 가격은 딥시크의 경쟁 구도를 재편합니다. 아래 비교는 모든 제공업체의 표준 단문맥 API 요금(100만 토큰당)을 기준으로 합니다.
| 모델 | 입력(100만 토큰당) | 출력(100만 토큰당) |
|---|---|---|
| DeepSeek V4-Pro (피크) | ~$0.87–$0.98 | $3.96 |
| DeepSeek V4-Flash (피크) | ~$0.42 | $1.26 |
| OpenAI GPT-5.6 Luna | $0.20 | $1.20 |
| Anthropic Claude Fable 5 | $10.00 | $50.00 |
(출처: DeepSeek , OpenAI
, Anthropic
)
OpenAI는 2026년 7월 30일 GPT-5.6 Luna 가격을 80% 인하하여 100만 토큰당 입력 $0.20, 출력 $1.20으로 조정했습니다 . 경쟁 구도가 극적으로 바뀌었습니다:
딥시크가 한때 확실한 저가 옵션이었다면, 이제는 OpenAI의 가장 저렴한 등급이 가격 리더로 부상했습니다 .
앤스로픽의 플래그십 추론 모델은 100만 토큰당 입력 $10, 출력 $50입니다 . 이 수준에서 딥시크는 여전히 가성비 좋은 선택입니다:
인상된 요금에도 불구하고 두 딥시크 모델 모두 앤스로픽의 최상위 제품보다 훨씬 저렴합니다 .
xAI의 Grok 4.6 가격은 제공된 출처에서 확인할 수 없어 직접 비교가 불가능합니다.
딥시크는 가격 인상의 주된 이유로 추론 용량을 압도하는 폭발적인 수요를 꼽았습니다 . V4 모델은 2026년 4월 프리뷰 출시 이후 막대한 채택을 얻었고, 이로 인해 GPU 용량 병목 현상이 발생하여 회사가 기존의 초저가로는 더 이상 감당할 수 없게 되었습니다
.
여러 시장 요인이 복합적으로 작용했습니다:
딥시크의 가격 인상은 압도적으로 가장 저렴한 프론티어 API 제공업체로서의 시대가 끝났음을 의미합니다. 이제 딥시크는 일부 측면에서 OpenAI의 가장 저렴한 모델과 비슷한 수준이 되었으며, 앤스로픽의 프리미엄 등급보다는 훨씬 저렴합니다. 개발자에게 있어 피크/오프피크 가격, 깊은 캐싱 할인, MIT 라이선스 오픈 웨이트의 조합은 최종 API 비용을 결정하는 데 있어 모델 선택 자체보다 워크로드 아키텍처가 점점 더 중요해지고 있음을 시사합니다.
Studio Global AI
이 페이지에는 Studio Global 내에서 계속할 수 있는 소스 기반 답변이 포함되어 있습니다.
딥시크가 2026년 8월 13일 V4 Pro 및 V4 Flash 모델의 API 가격을 50% 1,100% 인상한다고 발표했으며, 새로운 피크/오프피크 시간대별 과금은 8월 16일 16:00 UTC부터 적용됩니다 [17][19].
딥시크가 2026년 8월 13일 V4 Pro 및 V4 Flash 모델의 API 가격을 50% 1,100% 인상한다고 발표했으며, 새로운 피크/오프피크 시간대별 과금은 8월 16일 16:00 UTC부터 적용됩니다 [17][19]. 두 V4 모델 모두 100만 토큰 컨텍스트 윈도우, MIT 라이선스, 최대 384K 출력 토큰을 지원합니다.
딥시크는 폭발적인 수요와 GPU 용량 병목 현상을 인상의 주된 이유로 꼽았으며, AI API 제공업체 중 최초로 구조적인 시간대별 서지 프라이싱(수요 급증 가격제)을 도입했습니다 [1][22].