딥시크, 2026년 8월 16일부터 V4 Flash 및 V4 Pro API에 피크/오프피크 요금제 도입... V4 Pro 출력 토큰 피크 시 최대 355% 인상 독립 테스트 기관 컴포지오(Composio) 결과, V4 Flash의 실제 다단계 에이전트 과제 완료율 53.8%...
연구 답변

Create a landscape editorial hero image for this Studio Global article: What pricing changes did DeepSeek implement for its V4 API models on August 16, 2026, how does the new peak and off-peak tiered structure co. Article summary: **Pi Agent** led in both success rate (20/30) and cost efficiency ($0.028/task).. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence
2026년 8월, 인공지능(AI) 업계에 충격파가 두 차례 전해졌습니다. 중국의 AI 스타트업 딥시크(DeepSeek)는 자사 최신 모델 제품군인 V4의 API 가격 구조를 전면 개편하며 최대 1,555%의 인상률을 단행했습니다. 같은 시각, 독립 테스트 기관 컴포지오(Composio)가 공개한 결과에 따르면, 딥시크의 최상위 모델인 V4 Flash는 실제 비즈니스 환경을 모사한 30가지 복잡한 에이전트 과제 중 단 53.8%만을 성공적으로 완료했습니다
. 이 두 가지 사건은 기업들이 딥시크 V4를 실제 업무에 대규모로 도입할 때 고려해야 할 총소유비용(TCO)과 운용 안정성에 대한 근본적인 의문을 제기합니다.
2026년 8월 16일 16:00 UTC부터 딥시크는 V4-Flash와 V4-Pro 모델 모두에 대해 기존의 단일 정액제에서 시간대별 요금제(Peak/Off-Peak Pricing)로 전환했습니다. 피크 시간대는 01:00–04:00 UTC와 06:00–10:00 UTC로, 하루 총 7시간입니다. 그 외 모든 시간은 오프피크(비수기)로 적용됩니다
. 오프피크 요금은 피크 요금의 정확히 절반이지만, 기존의 정액제와 비교하면 모든 토큰 유형에서 가격이 인상되었습니다
.
| 모델 | 토큰 유형 | 기존 정액제 (USD/1M 토큰) | 오프피크 (신규) | 피크 (신규) | 유효 변화율 |
|---|---|---|---|---|---|
| V4-Flash | 입력 (캐시 미스) | $0.14 | $0.21 | $0.42 | 오프피크 +50%, 피크 +200% |
| V4-Flash | 입력 (캐시 히트) | $0.0028 | $0.007 | $0.014 | 오프피크 +150%, 피크 +400% |
| V4-Flash | 출력 | $0.28 | $0.42 | $0.84 | 오프피크 +50%, 피크 +200% |
| V4-Pro | 입력 (캐시 미스) | $0.435 | $0.99 | $1.98 | 오프피크 +128%, 피크 +355% |
| V4-Pro | 입력 (캐시 히트) | $0.003625 | $0.03 | $0.06 | 오프피크 +728%, 피크 +1,555% |
| V4-Pro | 출력 | $0.87 | $1.98 | $3.96 | 오프피크 +128%, 피크 +355% |
가격 데이터 출처: 딥시크 공개 요금표 및 독립 트래커
가장 극적인 인상은 V4-Pro의 캐시 히트 입력 토큰으로, 기존 $0.003625에서 피크 시간대 $0.06로 무려 1,555% 가까이 급등했습니다. 딥시크 측은 이러한 변경이 리소스를 보다 효율적으로 할당하고, 긴급하지 않은 작업을 오프피크 시간대로 유도하기 위한 것이라고 설명했습니다
.
2026년 8월, 독립 테스트 기관 컴포지오는 딥시크 V4 Flash의 실전 성능을 평가하는 독특한 실험을 진행했습니다. Gmail, GitHub, Slack, Google Sheets 등 실제 SaaS 도구를 연동한 30가지의 까다로운 다단계 워크플로우를 8개의 서로 다른 에이전트 오케스트레이션 하네스(Agent Harness)를 통해 동일한 모델로 실행한 것입니다. 각 과제에는 900초의 제한 시간이 주어졌고, 모든 하네스는 동일한 컴포지오 MCP 도구를 사용했습니다
.
전체 결과: 총 240번의 실행 중 성공한 경우는 단 129번으로, 전체 통과율(Pass Rate)은 53.8%에 불과했습니다. 심지어 30개의 과제 중 모든 하네스가 성공적으로 완료한 것은 단 6개에 그쳤습니다.
| 하네스 | 통과율 (30개 과제 중) | 성공 과제당 비용 (USD) |
|---|---|---|
| Pi Agent | 20/30 (66.7%) | $0.028 |
| Prime Agent | ~15/24 (62.5% 유효 실행 기준) | $0.131 |
| OMP (Oh My Pi) | 17/30 (56.7%) | $0.103 |
| Claude Code | 16/30 (53.3%) | $0.195 |
| Codex | 16/30 (53.3%) | $0.081 |
| Deep Agents (LangChain) | 16/30 (53.3%) | $0.045 |
| Hermes Agent | 15/30 (50.0%) | $0.056 |
| OpenCode | 14/30 (46.7%) | $0.067 |
Pi Agent는 성공률(20/30)과 비용 효율성(과제당 $0.028) 모두에서 가장 좋은 성적을 기록했습니다. 주목할 점은 성공률, 비용, 속도 등 각 지표에서 우승한 하네스가 모두 달랐다는 사실입니다. 이는 모델의 성능만큼이나 어떤 오케스트레이션 방식을 선택하느냐가 중요하다는 것을 의미합니다
. 최고 하네스와 최저 하네스 간의 20%p 격차는 에이전트 프레임워크, 도구 구성, 캐싱 전략, 재시도 로직 등 외부 요소에 모델 성능이 극도로 민감하다는 것을 보여줍니다
.
가격 인상과 불안정한 실제 성능이라는 두 가지 압박은 딥시크 V4의 기업 환경 적용에 대한 분석가들의 시각을 크게 바꿔놓았습니다.
벤처비트(VentureBeat)는 동일한 V4 Flash 모델이 하네스, 도구 및 캐싱 스택에 따라 완전히 다른 결과를 보여준 점을 강조하며, 기업들이 모델 선택과 함께 오케스트레이션 역량 성숙도에 투자해야 한다고 지적했습니다. 컴포지오의 분석에 따르면 하네스 선택만으로도 성공 과제 수는 3개, 비용은 약 3배, 속도는 2.2배까지 차이가 났습니다
.
오프피크 시간대에도 모든 토큰 유형의 가격이 인상되었습니다. 분석가들은 특히 딥시크의 공격적인 저가 전략에 의존해 온 고객 지원 에이전트나 코드 생성 파이프라인과 같은 대규모 에이전트 워크로드의 투자수익률(ROI) 계산이 근본적으로 달라져야 한다고 분석합니다.
딥시크가 공식 발표한 에이전트 벤치마크 점수(Terminal-Bench 2.1에서 82.7, Toolathlon-Verified에서 70.3)는 매우 인상적입니다. 그러나 53.8%에 불과한 실제 과제 완료율은 리더보드의 높은 점수가 실제 프로덕션 환경의 안정성을 보장하지 않는다는 사실을 다시 한번 일깨워줍니다.
딥시크의 API 트래픽은 중국에 있는 서버를 경유합니다. 이는 규제를 받는 기업들에게 심각한 컴플라이언스(Compliance) 문제를 야기합니다. 분석가들은 데이터 관리, 감사 추적, 도구 권한 제어 등 세심한 아키텍처 계획이 필수적이라고 조언합니다. 규제 산업의 경우, 오픈 웨이트를 자체 호스팅(Self-hosting)하는 것이 프로덕션 환경으로 가는 유일한 현실적인 경로로 꼽힙니다
.
베이테크 컨설팅(BayTech Consulting)의 기업 프레임워크는 딥시크 V4를 민감하지 않은 문서 요약, 공개 저장소 코드 생성, 대량 콘텐츠 초안 작성과 같은 특정 작업에 한해 도입할 것을 권장합니다. 그러나 본격적인 도입에 앞서 워크로드 하나하나에 대한 엄격한 평가가 선행되어야 한다고 강조합니다.
Studio Global AI
이 페이지에는 Studio Global 내에서 계속할 수 있는 소스 기반 답변이 포함되어 있습니다.
딥시크, 2026년 8월 16일부터 V4 Flash 및 V4 Pro API에 피크/오프피크 요금제 도입... V4 Pro 출력 토큰 피크 시 최대 355% 인상
딥시크, 2026년 8월 16일부터 V4 Flash 및 V4 Pro API에 피크/오프피크 요금제 도입... V4 Pro 출력 토큰 피크 시 최대 355% 인상 독립 테스트 기관 컴포지오(Composio) 결과, V4 Flash의 실제 다단계 에이전트 과제 완료율 53.8%... 리더보드 점수와 큰 괴리
최고 성능 하네스(Pi Agent)와 최저 성능 하네스(OpenCode) 간 성공률 격차 무려 20%p... '오케스트레이션' 역량이 핵심 변수로 부상