DeepSeek a lancé V4.1 Flash le 10 septembre 2026. Le modèle, accessible dans l’API sous le nom deepseek flash, comprend nativement les images et le texte.
Publié parModifié avec GPT-5.6 TerraImages générées avec GPT Image 2
Réponse de recherche

Create a landscape editorial hero image for this Studio Global article: What did Chinese AI startup DeepSeek announce with the launch of its V4.1 Flash model on September 11, 2026, including how the slimmed-down. Article summary: DeepSeek launched V4.1-Flash on September 10, not September 11. It positioned the smaller, open-weight model as a new-architecture successor that combines native visual understanding with lower-cost, faster inference—and. Topic tags: general, news, general web, user generated, government. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermark
DeepSeek a lancé DeepSeek-V4.1-Flash le 10 septembre 2026. Pour les utilisateurs de son API, ce n’est pas seulement l’arrivée d’un nouveau modèle : il doit devenir le remplaçant effectif de V4-Pro, tout en étant facturé selon la grille tarifaire Flash, beaucoup moins chère. 1
3
10
À partir du 14 septembre à 04 h 00 UTC — soit midi à Pékin — les requêtes envoyées à V4-Pro doivent être automatiquement redirigées vers V4.1-Flash. Elles seront alors facturées aux tarifs Flash, jusqu’à la disponibilité d’un futur V4.1-Pro. 3
Autrement dit, conserver l’ancien endpoint ne garantit pas de conserver le même modèle. Les équipes qui utilisent V4-Pro en production ont intérêt à tester, avant cette bascule, la qualité des réponses, la latence, l’usage des outils et les comportements propres à leurs scénarios critiques.
DeepSeek a par ailleurs retiré les anciens modèles V4-Flash et V4-Flash-Vision-Exp. V4.1-Flash s’appelle désormais deepseek-flash dans l’API. 10
16
DeepSeek présente V4.1-Flash comme le plus petit modèle de sa nouvelle famille d’architecture. Selon l’entreprise, celle-ci vise un plafond de capacités plus élevé, une inférence plus rapide, un meilleur débit et une montée en échelle vers des modèles plus grands. 1
10
Le modèle comprend une compréhension visuelle native : les images et le texte sont pris en charge au cœur du modèle, plutôt que via un module de vision ajouté séparément. 10
16
D’après DeepSeek et des informations publiées lors du lancement, V4.1-Flash est un modèle « mixture of experts » de 552 milliards de paramètres, fondé sur une architecture d’encodeur-décodeur causal. Huit milliards de paramètres seraient actifs pour le traitement des entrées et 16 milliards pour la génération des sorties. Ses poids ont été publiés sous licence MIT, selon des articles consacrés au lancement. 16
DeepSeek affirme que cette architecture améliore les capacités, la vitesse d’inférence et le débit. Des articles sur le lancement indiquent également que V4.1-Flash surpasserait V4-Pro pour le code et les tâches d’agents, à un coût d’exécution inférieur. 1
Ces résultats restent toutefois des affirmations du fournisseur. Les éléments disponibles ne constituent pas une validation indépendante établissant que V4.1-Flash est systématiquement plus rapide ou meilleur que V4-Pro — ou que les modèles concurrents — pour tous les usages. Les performances réelles dépendent notamment des instructions, du type de tâche, du matériel, du niveau de concurrence et de l’intégration d’outils.
Pour les développeurs, le positionnement est clair : V4.1-Flash est un candidat à évaluer pour les applications multimodales, les flux de développement logiciel et les agents, lorsque le coût d’inférence et le débit comptent autant que la qualité des réponses.
DeepSeek a modifié sa tarification Flash à compter du 10 septembre. Hors heures de pointe, les prix annoncés sont les suivants :
Les tarifs en heures de pointe sont deux fois plus élevés. 15
Cette grille illustre une stratégie axée autant sur l’économie du déploiement que sur les capacités du modèle. Des prix d’inférence plus faibles peuvent rendre plus accessibles les appels d’agents à grande échelle, les interactions à long contexte et les usages combinant images et texte.
En contrepartie, une telle pression sur les prix pose une question classique pour les fournisseurs d’IA : davantage d’usage et de parts de marché peuvent-ils compenser une baisse du revenu par jeton ? Les sources fournies ne permettent pas d’établir un effet précis et contemporain sur les cours d’entreprises comme MiniMax, Z.AI ou Alibaba ; toute affirmation directe sur cet impact doit donc être traitée avec prudence.
La sortie intervient peu après une information de Reuters selon laquelle DeepSeek a mandaté CITIC Securities pour préparer une possible introduction en Bourse sur le STAR Market de Shanghai, un marché chinois tourné vers les entreprises technologiques. Selon les sources de Reuters, l’entreprise viserait le lancement du processus en 2026, mais ni le calendrier ni le montant de l’opération ne sont arrêtés.
Un modèle combinant poids ouverts, prise en charge multimodale et API à faible coût peut renforcer le récit produit de DeepSeek avant une éventuelle cotation. C’est une interprétation, et non un motif de lancement déclaré par l’entreprise. La même politique tarifaire soulève aussi la question de la rentabilité : une demande accrue suffira-t-elle à compenser la baisse des revenus unitaires d’inférence ?
Quelques jours avant le lancement, un avis conjoint du gouvernement américain a accusé DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun et Z.AI d’avoir mené une extraction systématique de capacités de modèles américains de pointe, via des campagnes de distillation des connaissances à l’échelle industrielle. L’avis allègue l’extraction de milliards de jetons au moyen de millions de requêtes adressées notamment à des modèles Claude, GPT, Gemini et Grok, vraisemblablement avec la connaissance des autorités chinoises. 17
Il s’agit d’allégations des autorités américaines, et non de conclusions judiciaires. La Chine les a qualifiées d’infondées, estimant que Washington cherchait à préserver un monopole dans l’industrie de l’IA. Des responsables chinois ont aussi mis en avant l’autonomie technologique, tout en laissant ouverte la possibilité d’un dialogue.
La coïncidence entre cette sortie de produit majeure et ce différend résume deux forces qui façonnent le marché : une compétition technologique et tarifaire très rapide, d’un côté ; une surveillance accrue de l’accès aux modèles, des données d’entraînement et des flux technologiques transfrontaliers, de l’autre.
V4.1-Flash est la tentative de DeepSeek de faire d’un modèle plus compact de sa nouvelle famille le choix par défaut pour une part plus large de ses utilisateurs d’API : multimodalité native, poids ouverts, gains d’efficacité revendiqués et prix bas sont au cœur de l’offre. 10
15
16
Le changement le plus immédiat reste la redirection prévue des requêtes V4-Pro le 14 septembre. Les ambitions de performance devront être confirmées par des tests indépendants ; la stratégie de prix de DeepSeek et le durcissement du contexte technologique entre les États-Unis et la Chine détermineront ensuite l’ampleur réelle de ce lancement. 3
17
Studio Global AI
Cette page comprend une réponse basée sur la source que vous pouvez continuer dans Studio Global.
DeepSeek a lancé V4.1 Flash le 10 septembre 2026. Le modèle, accessible dans l’API sous le nom deepseek flash, comprend nativement les images et le texte.
DeepSeek a lancé V4.1 Flash le 10 septembre 2026. Le modèle, accessible dans l’API sous le nom deepseek flash, comprend nativement les images et le texte. À compter du 14 septembre à 04 h 00 UTC, les requêtes envoyées à V4 Pro seront automatiquement traitées par V4.1 Flash et facturées aux tarifs Flash, en attendant V4.1 Pro.
DeepSeek revendique de meilleurs résultats, une inférence plus rapide et un débit supérieur, mais ces comparaisons nécessitent encore des évaluations indépendantes.