딥시크는 2026년 9월 10일 네이티브 멀티모달 모델 V4.1 Flash를 출시했으며, API 모델명은 deepseek flash다. [10][16] V4 Pro API 요청은 9월 14일 04:00 UTC(베이징 시간 정오)부터 V4.1 Flash로 자동 라우팅되고, V4.1 Pro가 나올 때까지 Flash 요금이 적용된다.
게시자GPT-5.6 Terra로 편집GPT Image 2로 이미지 생성
연구 답변

Create a landscape editorial hero image for this Studio Global article: What did Chinese AI startup DeepSeek announce with the launch of its V4.1 Flash model on September 11, 2026, including how the slimmed-down. Article summary: DeepSeek launched V4.1-Flash on September 10, not September 11. It positioned the smaller, open-weight model as a new-architecture successor that combines native visual understanding with lower-cost, faster inference—and. Topic tags: general, news, general web, user generated, government. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermark
딥시크(DeepSeek)는 2026년 9월 10일 DeepSeek-V4.1-Flash를 공개했다. 핵심은 단순한 신모델 추가가 아니다. 비용을 낮춘 네이티브 멀티모달 모델을 내놓는 동시에, 기존 V4-Pro API 트래픽을 V4.1-Flash로 전환하겠다고 예고했다. 1
3
10
V4-Pro를 운영 중인 개발팀이라면 이번 업데이트는 모델명 변경 이상의 사안이다. 기존 엔드포인트를 유지해도 실제 응답 모델과 출력 특성, 지연시간, 도구 호출 동작이 달라질 수 있기 때문이다.
딥시크는 9월 14일 04:00 UTC, 베이징 시간으로 12:00부터 V4-Pro 요청을 자동으로 V4.1-Flash에 라우팅할 계획이다. 이 상태는 후속 모델인 V4.1-Pro가 출시될 때까지 유지되며, 전환된 요청에는 더 저렴한 Flash 요금이 청구된다. 3
따라서 deepseek-v4-pro를 쓰는 팀은 별도의 즉각적 API 마이그레이션 없이도 모델 전환을 겪게 된다. 프로덕션 환경에서는 전환 전에 다음을 확인하는 편이 안전하다.
딥시크는 기존 V4-Flash와 V4-Flash-Vision-Exp도 이번 출시와 함께 종료했다. 최신 Flash 모델은 API에서 **deepseek-flash**라는 이름으로 호출한다. 10
16
딥시크는 V4.1-Flash를 자사의 새 아키텍처 계열 중 가장 작은 모델이라고 소개했다. 회사 설명에 따르면 이 아키텍처는 더 높은 성능 확장성, 빠른 추론, 높은 처리량, 더 큰 모델로의 확장을 목표로 설계됐다. 또한 이미지 이해가 별도 비전 모듈이 아닌 모델의 기본 기능으로 포함된 네이티브 멀티모달 구조다. 10
16
공개 자료와 출시 보도에 따르면 V4.1-Flash는 총 5,520억 파라미터의 전문가 혼합(MoE) 모델이며, 인과적 인코더-디코더 구조를 사용한다. 입력 처리 때는 80억 개, 출력 생성 때는 160억 개의 파라미터가 활성화된다고 알려졌다. 출시 보도는 모델 가중치가 MIT 라이선스로 공개됐다고 전했다. 16
딥시크는 새 구조가 성능, 추론 속도, 처리량을 개선한다고 밝혔다. 출시 관련 보도도 V4.1-Flash가 코딩 및 에이전트 작업에서 V4-Pro보다 낫고 운영비는 더 낮다고 전했다. 1
다만 이는 현재 확보된 자료상 딥시크 및 관련 보도의 주장이다. V4.1-Flash가 모든 유형의 업무에서 V4-Pro나 다른 최상위 모델보다 빠르거나 우수하다는 점을 입증하는 독립 검증 결과는 제시되지 않았다. 실제 성능은 프롬프트 구성, 작업 유형, 하드웨어, 동시성, 도구 사용 방식에 따라 달라질 수 있다.
개발자 관점에서는 이미지와 텍스트를 함께 처리하는 서비스, 코드 생성, 에이전트형 자동화처럼 처리량과 추론비가 중요한 업무에서 V4.1-Flash를 직접 평가해볼 만하다는 의미다.
딥시크는 9월 10일부터 Flash 계열 API 가격을 조정했다. 비혼잡 시간 기준 공개 요금은 다음과 같다.
혼잡 시간 요금은 비혼잡 시간의 두 배다. 15
이 가격 정책은 긴 컨텍스트 대화, 대량 에이전트 호출, 멀티모달 요청을 서비스에 적용하려는 기업의 비용 장벽을 낮출 수 있다. 반면 AI 제공자 입장에서는 이용량 확대와 시장점유율 확보에 도움이 될 수 있는 대신, 토큰당 매출과 수익성에는 압박이 될 수 있다.
제공된 자료만으로는 MiniMax, Z.AI, 알리바바 등 특정 기업의 당시 주가 변동이나 직접적 시장 영향을 확정할 수 없다. 가격 인하가 경쟁사 가치나 주가에 미친 영향을 단정하는 해석에는 주의가 필요하다.
로이터는 딥시크가 상하이 증시의 기술기업 중심 시장인 STAR 마켓 상장을 위한 준비 과정에서 중신증권(CITIC Securities)을 선정했다고 보도했다. 소식통들은 회사가 2026년 중 상장 절차를 시작하는 방안을 목표로 하고 있다고 했지만, 공모 규모와 구체적 시점은 정해지지 않았다.
오픈 웨이트, 멀티모달 지원, 낮은 API 비용을 결합한 신모델은 잠재적 상장에 앞서 딥시크의 제품 경쟁력 서사를 강화할 수 있다. 그러나 이것이 출시의 공식 이유라는 뜻은 아니다. 낮은 가격으로 늘어난 수요가 토큰당 수익 감소를 상쇄할 수 있는지는 별개의 사업 과제로 남는다.
V4.1-Flash 출시 직전 미국 정부 기관들은 딥시크, 문샷 AI, 알리바바, MiniMax, StepFun, Z.AI가 지식 증류(knowledge distillation)를 통해 미국 최전선 AI 모델의 기능을 조직적·산업적 규모로 추출했다고 주장하는 공동 권고문을 냈다. 이 문서는 이들 기업이 2024년 말 이후 Claude, GPT, Gemini, Grok 계열 모델을 상대로 수백만 건의 요청을 보내 수십억 토큰을 추출했으며, 중국 정부가 이를 인지했을 가능성이 있다고 주장했다. 17
이는 미국 정부의 주장이며 법원의 확정 판단은 아니다. 중국은 해당 비난을 근거 없다고 반박했고, 미국이 AI 산업 독점을 유지하기 위한 행동이라고 비판했다. 중국 측은 기술 자립을 강조하면서도 대화 가능성은 열어뒀다.
V4.1-Flash는 딥시크가 새 모델 계열의 소형 모델을 더 폭넓은 API 사용자의 기본 선택지로 만들려는 시도다. 네이티브 멀티모달 기능, 공개 가중치, 속도·처리량 개선 주장, 낮은 API 요금이 핵심 메시지다. 10
15
16
가장 구체적이고 즉각적인 변화는 9월 14일 V4-Pro 요청의 자동 전환이다. V4-Pro 사용자라면 비용 절감 효과를 기대할 수 있지만, 중요 서비스는 전환 전후로 품질·지연시간·에이전트 동작을 자체 테스트해야 한다. 모델 성능 주장의 보편성은 독립 평가를 통해 확인될 필요가 있으며, 공격적인 가격 경쟁과 미·중 기술 갈등은 이번 출시의 파급력을 좌우할 변수다. 3
17
Studio Global AI
이 페이지에는 Studio Global 내에서 계속할 수 있는 소스 기반 답변이 포함되어 있습니다.
딥시크는 2026년 9월 10일 네이티브 멀티모달 모델 V4.1 Flash를 출시했으며, API 모델명은 deepseek flash다. [10][16]
딥시크는 2026년 9월 10일 네이티브 멀티모달 모델 V4.1 Flash를 출시했으며, API 모델명은 deepseek flash다. [10][16] V4 Pro API 요청은 9월 14일 04:00 UTC(베이징 시간 정오)부터 V4.1 Flash로 자동 라우팅되고, V4.1 Pro가 나올 때까지 Flash 요금이 적용된다.
비혼잡 시간 기준 요금은 캐시 적중 입력 100만 토큰당 0.003달러, 캐시 미적중 입력 0.15달러, 출력 0.60달러이며 혼잡 시간에는 두 배다.