O beta do DeepSeek V4.1 Flash começou em 8 de setembro de 2026 e foi substituído pelo lançamento oficial em 10 de setembro, sob o nome deepseek flash. A prévia usava multimodalidade nativa, mantinha a mesma URL base da API, cobrava como o V4 Flash e limitava cada conta a 20 requisições simultâneas.
Publicado porEditado com GPT-5.6 TerraImagens geradas com GPT Image 2
Resposta de pesquisa

Create a landscape editorial hero image for this Studio Global article: What is DeepSeek V4.1 Flash, and what are the key details of its September 2026 time-limited internal beta—including its new native multimod. Article summary: DeepSeek V4.1 Flash was initially a short, evaluation-oriented API beta of an intermediate Flash-tier model. It launched on September 8, 2026 with a new architecture and native visual understanding, unlike the earlier V4. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
O DeepSeek V4.1 Flash deixou de ser apenas um teste curto de API e se tornou um modelo oficial. A prévia, iniciada em 8 de setembro de 2026, chamou atenção por trazer capacidade multimodal nativa — isto é, compreensão de texto e imagens no próprio modelo, sem depender de uma extensão visual separada. Em 10 de setembro, a DeepSeek formalizou o lançamento e disponibilizou o modelo pelo identificador permanente deepseek-flash. 5
9
A versão beta foi uma rota temporária, disponível aproximadamente entre 8 e 10 de setembro de 2026. Quem já usava a API da DeepSeek não precisava alterar o endpoint: bastava trocar o campo do modelo. Mas o próprio nome temporário deixava claro que não era uma integração duradoura:
deepseek-v4.1-flash-expires-on-0910
Em 10 de setembro, a situação mudou com o lançamento oficial do V4.1 Flash. Hoje, o nome documentado para selecionar o modelo na API é:
deepseek-flash
O changelog da API da DeepSeek informa que o V4.1 Flash está disponível com suporte multimodal nativo por esse identificador. 9
O principal avanço anunciado é o entendimento visual nativo em uma nova arquitetura. Isso o distingue da rota experimental anterior, deepseek-v4-flash-vision-exp, que funcionava como uma variante de visão ao lado do V4 Flash.
Após o lançamento, a DeepSeek informou que as requisições enviadas aos antigos nomes experimentais V4 Flash e V4 Flash Vision seriam encaminhadas temporariamente ao V4.1 Flash por compatibilidade. 5
Segundo a empresa, o modelo lançado é um mixture of experts (MoE) de 552 bilhões de parâmetros, baseado em uma arquitetura Causal Encoder–Decoder. Desse total, 8 bilhões de parâmetros ficam ativos no processamento de entrada e 16 bilhões na geração de saída. 5
Na prática, para quem desenvolve com a API, texto e imagem passam a fazer parte do mesmo V4.1 Flash — sem exigir a seleção da antiga extensão experimental de visão.
Durante a curta janela de avaliação, usuários da API mantinham a URL-base e mudavam somente o nome do modelo:
deepseek-v4.1-flash-expires-on-0910
As condições reportadas para o beta incluíam:
Essas restrições tornavam a rota adequada para comparações, checagens de integração e avaliação inicial de recursos multimodais — não para depender dela em produção. O identificador era temporário, e o teto de concorrência restringia testes de tráfego contínuo.
Testadores divulgaram observações de cerca de 300 a 500 tokens de saída por segundo, inclusive relatos acima de 500 tokens por segundo. Esses números, porém, vieram de usuários e não eram um compromisso de nível de serviço da DeepSeek nem um benchmark padronizado. 15
A vazão pode variar conforme tamanho do prompt, extensão da resposta, região, concorrência, implementação e configurações do modelo. Portanto, esses relatos indicavam que o beta pareceu rápido em alguns cenários, mas não devem ser tratados como garantia de capacidade para programação, prototipagem de interfaces ou qualquer outra carga de trabalho.
No anúncio inicial, a DeepSeek planejava encaminhar as requisições de deepseek-v4-pro para o V4.1 Flash a partir de 14 de setembro, com cobrança nas tarifas do V4.1 Flash, até a chegada de um futuro V4.1 Pro. A empresa também posicionou o V4.1 Flash como superior a modelos de ponta nos benchmarks que divulgou. 5
No entanto, o changelog posterior da API diz que a DeepSeek decidiu manter o serviço de API do V4 Pro após 14 de setembro, sem alterar a cobrança. Para integrações atuais, essa atualização oficial mais recente é a referência mais importante. 9
A lição para equipes de desenvolvimento é que roteamento e disponibilidade de modelos podem mudar rapidamente durante transições de produto. Vale fixar os testes no nome de modelo documentado, acompanhar o changelog da API e executar testes de regressão antes de presumir comportamento idêntico entre um alias e um endpoint redirecionado.
Ao ler coberturas antigas, é importante separar a prévia histórica do produto lançado:
| Beta de 8 a 10 de setembro | Lançamento oficial |
|---|---|
deepseek-v4.1-flash-expires-on-0910 |
deepseek-flash |
| Rota temporária de avaliação | Modelo documentado da API |
| Cobrança do beta equivalente ao V4 Flash | Aplicam-se preços e termos do serviço lançado |
| 20 requisições simultâneas por conta | Consulte a documentação atual para os limites operacionais |
A história duradoura do V4.1 Flash não é o endpoint que existiu por dois dias. É o lançamento de um modelo Flash multimodal nativo, com nova arquitetura, identificador permanente na API e detalhes técnicos de alto nível publicados pela DeepSeek. 5
9
Studio Global AI
Esta página inclui uma resposta baseada na fonte que você pode continuar em Studio Global.
O beta do DeepSeek V4.1 Flash começou em 8 de setembro de 2026 e foi substituído pelo lançamento oficial em 10 de setembro, sob o nome deepseek flash.
O beta do DeepSeek V4.1 Flash começou em 8 de setembro de 2026 e foi substituído pelo lançamento oficial em 10 de setembro, sob o nome deepseek flash. A prévia usava multimodalidade nativa, mantinha a mesma URL base da API, cobrava como o V4 Flash e limitava cada conta a 20 requisições simultâneas.
Relatos iniciais de 300 a 500 tokens de saída por segundo não eram uma garantia oficial; para produção, vale consultar a documentação e testar o próprio fluxo.