하네스는 Node.js 환경에서 npx @deepseek-ai/dsh web. 4가지 실행 모드와 추가 전용 세션 로그(Append-only Session Log) 기능을 제공합니다
.
DeepSeek-V4-Pro-0813은 2026년 8월 12일부터 13일 사이에 정식 버전(GA, General Availability) 으로 전환되어, 기존 프리뷰 빌드를 대체했습니다 . 이 모델은 총 1.6조(1.6 trillion) 파라미터를 가진 혼합 전문가(Mixture-of-Experts, MoE) 모델로, 토큰당 활성화되는 파라미터는 490억 개(49B)이며, 100만(1-million) 토큰의 컨텍스트 윈도우와 최대 38만 4천(384K) 출력 토큰을 지원합니다
. 0813 빌드는 향상된 에이전트 기능과 네이티브 오픈AI 리스폰시스 API(Responses API) 호환성을 갖췄습니다
. V4 Pro의 오픈 웨이트(Open Weights) 또한 MIT 라이선스로 제공됩니다
.
딥시크는 2026년 5월부터 하네스 전담 팀을 꾸리기 시작했으며, 내부적으로 클로드 코드와 코덱스를 대상으로 삼았습니다 . 베이징(北京) 현지 기반으로 하네스 제품 매니저와 하네스 R&D 엔지니어 두 포지션이 공개 채용되었습니다
. 이 팀의 임무는 딥시크의 모델 역량을 본격적인 에이전트 경험으로 연결하는 데스크톱 에이전트 제품인 '코드 하네스(Code Harness)' (내부적으로는 'DeepSeek Code'로도 불림)를 구축하는 것이었습니다
.
2026년 8월 16일부터 딥시크는 V4 Pro API에 피크/오프피크 요금제를 도입했습니다 . 출력 토큰 가격은 프리뷰 시기의 100만 토큰당 0.87달러에서 오프피크 1.98달러, 피크 시간대 3.96달러로 인상되었습니다. 이는 최대 2.3배에서 4.6배에 달하는 인상 폭입니다
. 이전의 가격 인하 기조를 뒤집는 결정으로, 에이전트 스택(하네스)은 더 개방적(MIT 라이선스, 완전 모듈형, 자체 호스팅 가능)으로 변모하는 반면, 호스팅 API는 특히 피크 시간대에 상당히 비싸지는 전략적 긴장 관계를 만들어 냈습니다
.
경쟁사들(앤스로픽의 클로드 코드, 오픈AI의 코덱스 CLI)은 모델, 도구, 샌드박스, 런타임이 긴밀하게 결합된 독점적인 호스팅, 수직 통합형 에이전트 경험을 제공합니다 . 반면 딥시크의 선택은 정반대입니다. 전체 에이전트 하네스를 MIT 라이선스로 오픈소스화하고, 개발자가 어떤 모델 어댑터, 샌드박스, UI든 자유롭게 교체할 수 있도록 하는 대신, 호스팅 추론(Inference) 티어를 프리미엄 요금으로 수익화하는 것입니다
. API가 너무 비싸다고 느끼는 개발자는 오픈 웨이트 V4 Pro 모델을 자체 호스팅하여 하네스와 함께 로컬에서 실행할 수 있습니다
.
요약하면: 2026년 8월 13일은 딥시크에게 가장 중요한 단일 릴리스 날이었습니다. 에이전트 인프라를 오픈소스화하여 클로드 코드/코덱스에 도전하고, 1.6조 파라미터 플래그십 모델을 정식 출시하는 동시에, 호스팅 API 가격을 2~4배 인상함으로써 "스택을 열고, 통행료를 올린다(open the stack, raise the toll)"는 명확한 전략을 보여주었습니다.