DeepSeek V4.1 Flash는 2026년 9월 8일 시작된 약 이틀간의 API 베타를 거쳐 9월 10일 정식 출시됐으며, 현재 API 모델명은 deepseek flash다. 베타는 기존 API 기본 URL을 그대로 쓰면서 임시 모델 ID만 바꾸는 방식이었다.
게시자GPT-5.6 Terra로 편집GPT Image 2로 이미지 생성
연구 답변

Create a landscape editorial hero image for this Studio Global article: What is DeepSeek V4.1 Flash, and what are the key details of its September 2026 time-limited internal beta—including its new native multimod. Article summary: DeepSeek V4.1 Flash was initially a short, evaluation-oriented API beta of an intermediate Flash-tier model. It launched on September 8, 2026 with a new architecture and native visual understanding, unlike the earlier V4. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
DeepSeek V4.1 Flash는 짧은 API 시험 운영을 거쳐 빠르게 정식 모델로 전환된 Flash급 AI 모델이다. 2026년 9월 8일 시작된 베타의 핵심은 별도 비전 확장 기능이 아니라 모델 자체에 시각 이해 기능을 포함한 네이티브 멀티모달 지원이었다. 이후 9월 10일 정식 출시되면서 영구 API 모델명 deepseek-flash로 제공되고 있다. 5
9
9월 8~10일경 제공된 제한 베타는 중간 빌드였다. 개발자는 API 기본 URL을 바꾸지 않고 모델 필드만 변경해 시험할 수 있었지만, 임시 모델 ID인 deepseek-v4.1-flash-expires-on-0910에는 종료 예정일이 그대로 들어가 있었다. 즉, 장기 운영을 위한 경로가 아니었다. 7
20
9월 10일 DeepSeek이 V4.1 Flash를 정식 출시하면서 현재 문서상 API 선택값은 다음과 같이 바뀌었다.
deepseek-flash
DeepSeek API 변경 로그는 이 모델명이 네이티브 멀티모달 지원 V4.1 Flash를 호출한다고 명시한다. 9
V4.1 Flash의 가장 큰 차이는 새 아키텍처에서 구현한 네이티브 시각 이해다. 이는 기존 V4 Flash에 병렬로 있던 실험적 비전 변형 모델 deepseek-v4-flash-vision-exp와 구분된다. 정식 출시 후 DeepSeek은 호환성을 위해 기존 deepseek-v4-flash와 deepseek-v4-flash-vision-exp 요청을 한시적으로 V4.1 Flash로 라우팅한다고 밝혔다. 5
DeepSeek의 설명에 따르면 정식 모델은 총 5,520억 파라미터의 MoE(전문가 혼합) 모델이며, Causal Encoder–Decoder 아키텍처를 사용한다. 입력 처리에는 80억 개, 출력 생성에는 160억 개의 활성 파라미터를 사용한다고 회사는 설명한다. 5
API 사용자 관점에서는 텍스트와 이미지를 함께 다루기 위해 별도의 과거 비전 확장 모델을 선택할 필요가 없어졌다는 점이 중요하다. 멀티모달 기능이 V4.1 Flash 모델 자체에 포함됐기 때문이다.
짧은 평가 기간에는 기존 DeepSeek API 사용자가 기본 URL을 유지한 채 모델 이름만 아래처럼 바꿨다.
deepseek-v4.1-flash-expires-on-0910
당시 알려진 베타 조건은 다음과 같다.
이런 조건은 비교 테스트, 연동 점검, 초기 멀티모달 평가에는 적합했지만 운영 환경의 의존성을 두기에는 부적절했다. 임시 ID였고, 동시성 제한도 지속적인 트래픽 검증에는 낮은 수준이었다.
초기 테스트 참여자들 사이에서는 초당 약 300~500개의 출력 토큰, 일부 환경에서는 초당 500개를 넘겼다는 보고도 나왔다. 그러나 이는 DeepSeek의 공식 서비스 수준 약정(SLA)이나 표준화된 벤치마크 결과가 아니라 이용자들이 공유한 관측치다. 15
처리량은 프롬프트와 출력 길이, 접속 지역, 동시 요청 수, 구현 방식, 모델 설정에 따라 달라질 수 있다. 따라서 코딩 보조나 UI 프로토타이핑에서 매우 빠르게 동작했다는 신호로는 볼 수 있어도, 특정 처리량을 보장하는 수치로 받아들여서는 안 된다.
출시 초기 DeepSeek은 9월 14일부터 deepseek-v4-pro 요청을 V4.1 Flash로 라우팅하고 V4.1 Flash 요금을 적용할 계획을 공개했다. 이는 향후 V4.1 Pro가 나올 때까지의 조치로 제시됐다. DeepSeek은 또 자사가 공개한 벤치마크에서 V4.1 Flash가 플래그십 모델들을 앞섰다고 주장했다. 5
다만 이후 API 변경 로그에는 9월 14일 이후에도 V4 Pro API 서비스를 계속 제공하고, 과금 방식도 바꾸지 않기로 했다는 업데이트가 올라왔다. 현재 연동 판단에서는 이 후속 공식 공지를 우선하는 편이 타당하다. 9
이 사례는 제품 전환기에는 API 라우팅과 모델 제공 정책이 빠르게 바뀔 수 있음을 보여준다. 두 모델 중 어느 쪽을 쓰든 문서화된 모델명을 기준으로 테스트를 고정하고, API 변경 로그를 확인하며, 별칭이나 자동 라우팅 엔드포인트에서 동일한 동작을 당연시하기 전에 회귀 테스트를 수행하는 것이 안전하다.
과거 베타 관련 글을 읽고 있다면, 임시 프리뷰와 정식 제품을 구분해야 한다.
| 9월 8~10일 베타 | 정식 출시 후 |
|---|---|
deepseek-v4.1-flash-expires-on-0910 |
deepseek-flash |
| 기간 한정 평가용 경로 | 문서화된 API 모델 |
| V4 Flash와 같은 베타 요금 | 정식 요금 및 서비스 조건 적용 |
| 계정당 동시 요청 20건 | 현재 운영 한도는 최신 API 문서 확인 필요 |
V4.1 Flash의 핵심은 이틀짜리 엔드포인트 자체가 아니다. 새 아키텍처를 바탕으로 네이티브 멀티모달 기능을 제공하고, 영구 API 식별자와 고수준 아키텍처 정보를 갖춘 Flash 모델로 정식 출시됐다는 점이다. 5
9
Studio Global AI
이 페이지에는 Studio Global 내에서 계속할 수 있는 소스 기반 답변이 포함되어 있습니다.
DeepSeek V4.1 Flash는 2026년 9월 8일 시작된 약 이틀간의 API 베타를 거쳐 9월 10일 정식 출시됐으며, 현재 API 모델명은 deepseek flash다.
DeepSeek V4.1 Flash는 2026년 9월 8일 시작된 약 이틀간의 API 베타를 거쳐 9월 10일 정식 출시됐으며, 현재 API 모델명은 deepseek flash다. 베타는 기존 API 기본 URL을 그대로 쓰면서 임시 모델 ID만 바꾸는 방식이었다. 요금은 V4 Flash와 같았고 계정당 동시 요청은 20건으로 제한됐다.
초기 300 500 출력 토큰/초 속도 보고는 이용자 관측치일 뿐 공식 성능 보장은 아니다. 실제 운영 전에는 최신 API 문서와 변경 로그를 확인하고 자체 회귀 테스트를 해야 한다.