A DeepSeek lançou o V4.1 Flash em 10 de setembro de 2026 como o menor modelo de sua nova família de arquitetura, com compreensão visual multimodal nativa. A companhia afirma que o modelo oferece inferência mais rápida, maior throughput e melhor desempenho em programação e agentes, mas essas comparações ainda não for...
Publicado porEditado com GPT-5.6 TerraImagens geradas com GPT Image 2
Resposta de pesquisa

Create a landscape editorial hero image for this Studio Global article: What did Chinese AI startup DeepSeek announce with the launch of its V4.1 Flash model on September 11, 2026, including how the slimmed-down. Article summary: DeepSeek launched V4.1-Flash on September 10, not September 11. It positioned the smaller, open-weight model as a new-architecture successor that combines native visual understanding with lower-cost, faster inference—and. Topic tags: general, news, general web, user generated, government. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermark
A DeepSeek lançou o DeepSeek-V4.1-Flash em 10 de setembro de 2026. A empresa o apresenta como um modelo multimodal nativo, de menor custo e preparado para substituir o V4-Pro para usuários de API — uma mudança que combina transição de produto e preços de tokens muito baixos em meio à forte disputa por IA na China. 1
3
10
Segundo a DeepSeek, o V4.1-Flash é o menor modelo de sua nova família de arquitetura. A empresa diz que o projeto foi desenvolvido para elevar o teto de capacidade, acelerar a inferência, ampliar o throughput — o volume de processamento — e escalar para modelos maiores. Ele também traz compreensão visual multimodal nativa: texto e imagens são processados no próprio modelo, sem depender de um componente de visão separado. 10
16
Na API da companhia, o modelo deve ser chamado como deepseek-flash. Com a chegada da versão, os modelos anteriores V4-Flash e V4-Flash-Vision-Exp foram aposentados. 10
16
De acordo com o anúncio da DeepSeek e reportagens sobre o lançamento, o V4.1-Flash é um modelo mixture-of-experts (MoE) de 552 bilhões de parâmetros, com arquitetura causal de codificador-decodificador. Desse total, 8 bilhões de parâmetros ficam ativos no processamento de entrada e 16 bilhões na geração de saída. Reportagens também afirmam que os pesos foram disponibilizados sob licença MIT. 16
A DeepSeek afirma que a nova arquitetura melhora capacidade, velocidade de inferência e throughput. A cobertura do lançamento também descreveu o V4.1-Flash como superior ao V4-Pro em tarefas de programação e agentes, com custo operacional menor. 1
Essas comparações, porém, devem ser interpretadas com cautela. O material disponível registra alegações da própria DeepSeek, não testes independentes capazes de demonstrar que o V4.1-Flash seja sempre mais rápido ou melhor que o V4-Pro — ou que modelos concorrentes — em todos os cenários. Os resultados podem mudar conforme os prompts, o tipo de tarefa, o hardware, a concorrência de requisições e a configuração de ferramentas.
Para desenvolvedores, a consequência prática é clara: o V4.1-Flash é um candidato a testes em aplicações multimodais, fluxos de programação e sistemas de agentes nos quais custo de inferência e capacidade de atendimento em escala importam tanto quanto a qualidade da resposta.
A DeepSeek reduziu os preços da linha Flash a partir de 10 de setembro. No período fora de pico, os valores divulgados são:
Nos horários de pico, o preço é o dobro da tabela fora de pico. 15
A empresa também usará o lançamento para simplificar sua linha de produtos. A partir de 14 de setembro, às 04h UTC — 12h no horário de Pequim —, as requisições ao V4-Pro deverão ser redirecionadas automaticamente para o V4.1-Flash. Elas serão cobradas pelas tarifas Flash até que o V4.1-Pro seja lançado. 3
Isso torna a novidade mais relevante do que um lançamento convencional. Usuários atuais da API V4-Pro devem se preparar para uma mudança de modelo mesmo se continuarem usando o endpoint anterior. Equipes com aplicações críticas devem comparar respostas, latência e comportamento no uso de ferramentas antes de depender da migração em produção.
A tabela de preços reforça a estratégia da DeepSeek de competir não apenas em capacidade dos modelos, mas também no custo de implantação. Inferência mais barata pode viabilizar mais chamadas de agentes, interações de contexto longo e solicitações multimodais.
Ao mesmo tempo, preços agressivos trazem um dilema para fornecedores de IA: APIs mais baratas podem ampliar uso e participação de mercado, mas pressionam a receita por token e as margens. As fontes fornecidas não comprovam efeitos específicos e contemporâneos nas ações de empresas como MiniMax, Z.AI ou Alibaba; portanto, afirmações sobre impactos diretos de mercado exigem cautela.
O lançamento ocorreu logo após a Reuters informar que a DeepSeek contratou a CITIC Securities para preparar uma possível oferta pública inicial de ações no STAR Market de Xangai, segmento voltado a empresas de tecnologia. Segundo fontes ouvidas pela agência, a empresa pretendia iniciar o processo de listagem em 2026, mas o tamanho e o cronograma da operação ainda não estavam definidos.
Um modelo que reúne pesos abertos, suporte multimodal e API mais barata pode fortalecer a narrativa de produto da DeepSeek antes de uma eventual abertura de capital. Essa é uma inferência, não uma justificativa declarada para o lançamento. A estratégia de preços baixos também mantém uma pergunta central sobre o negócio: uma demanda maior conseguirá compensar a menor receita por unidade de inferência?
Dias antes da estreia do V4.1-Flash, um alerta conjunto do governo dos Estados Unidos alegou que DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun e Z.AI realizaram extração sistemática, em escala industrial, de capacidades de modelos de fronteira americanos por meio de destilação de conhecimento. O documento alegou que bilhões de tokens foram extraídos em milhões de requisições a modelos como Claude, GPT, Gemini e Grok, possivelmente com conhecimento do governo chinês. 17
São acusações do governo dos EUA, e não decisões judiciais. A China rejeitou as alegações como infundadas e afirmou que as ações americanas buscariam preservar um monopólio no setor de IA. Autoridades chinesas também defenderam a autossuficiência tecnológica, mantendo aberta a possibilidade de diálogo.
A coincidência entre um grande lançamento de modelo chinês e essa disputa expõe duas forças que moldam o mercado de IA: de um lado, a competição acelerada por avanços técnicos e preços; de outro, o escrutínio crescente sobre acesso a modelos, dados de treinamento e fluxos tecnológicos entre países.
O V4.1-Flash é a tentativa da DeepSeek de tornar o menor membro de sua nova família de modelos o padrão para um grupo mais amplo de usuários de API. Suporte multimodal nativo, pesos abertos, ganhos de eficiência alegados e preços baixos são os pilares da proposta. 10
15
16
No curto prazo, a mudança mais concreta é a migração do V4-Pro prevista para 14 de setembro. Já as alegações de liderança técnica exigirão avaliações independentes, enquanto a estratégia de preços e a escalada das tensões entre Estados Unidos e China devem definir o alcance do lançamento. 3
17
Studio Global AI
Esta página inclui uma resposta baseada na fonte que você pode continuar em Studio Global.
A DeepSeek lançou o V4.1 Flash em 10 de setembro de 2026 como o menor modelo de sua nova família de arquitetura, com compreensão visual multimodal nativa.
A DeepSeek lançou o V4.1 Flash em 10 de setembro de 2026 como o menor modelo de sua nova família de arquitetura, com compreensão visual multimodal nativa. A companhia afirma que o modelo oferece inferência mais rápida, maior throughput e melhor desempenho em programação e agentes, mas essas comparações ainda não foram confirmadas por avaliações independentes.
Em 14 de setembro, às 04h UTC, requisições ao V4 Pro serão redirecionadas automaticamente para o V4.1 Flash e cobradas pela tabela Flash, até a chegada do V4.1 Pro.