Le bêta temporaire de DeepSeek V4.1 Flash, lancé le 8 septembre 2026, a laissé place à une version officielle le 10 septembre, accessible avec deepseek flash. Le modèle intègre nativement la compréhension d’images, contrairement à l’ancienne extension expérimentale V4 Flash Vision, et repose sur une architecture Cau...
Publié parModifié avec GPT-5.6 TerraImages générées avec GPT Image 2
Réponse de recherche

Create a landscape editorial hero image for this Studio Global article: What is DeepSeek V4.1 Flash, and what are the key details of its September 2026 time-limited internal beta—including its new native multimod. Article summary: DeepSeek V4.1 Flash was initially a short, evaluation-oriented API beta of an intermediate Flash-tier model. It launched on September 8, 2026 with a new architecture and native visual understanding, unlike the earlier V4. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
DeepSeek V4.1 Flash est un modèle d’IA de la gamme Flash qui a connu une transition particulièrement rapide : un bêta API très limité, lancé le 8 septembre 2026, puis une sortie officielle le 10 septembre. Sa particularité majeure est la prise en charge multimodale native : la compréhension des images fait partie du modèle lui-même, au lieu de passer par une déclinaison vision distincte. 5
9
Le bêta, disponible autour des 8 et 10 septembre 2026, n’était qu’une étape intermédiaire. Les développeurs pouvaient le tester sans modifier l’URL de base de leur API, mais son identifiant temporaire annonçait clairement son caractère éphémère :
deepseek-v4.1-flash-expires-on-0910
Le 10 septembre, DeepSeek a officiellement lancé V4.1 Flash. Pour l’intégrer aujourd’hui via l’API, le nom de modèle documenté est :
deepseek-flash
Le journal des modifications de l’API confirme que V4.1 Flash est proposé sous cette référence, avec prise en charge multimodale native. 9
La grande différence par rapport à V4 Flash tient à l’architecture. Là où deepseek-v4-flash-vision-exp était une variante expérimentale dédiée à la vision, V4.1 Flash comprend nativement la compréhension visuelle. Après le lancement, DeepSeek a précisé que les requêtes adressées aux anciens noms expérimentaux V4 Flash et V4 Flash Vision seraient temporairement redirigées vers V4.1 Flash, pour préserver la compatibilité. 5
DeepSeek décrit V4.1 Flash comme un modèle mixture-of-experts (MoE) de 552 milliards de paramètres, fondé sur une architecture Causal Encoder–Decoder. Selon l’entreprise, 8 milliards de paramètres sont actifs pour le traitement des entrées et 16 milliards pour la génération des sorties. 5
Concrètement, une application qui doit analyser du texte et des images n’a plus à sélectionner l’ancienne extension expérimentale de vision : cette capacité est intégrée à V4.1 Flash.
Pendant cette fenêtre de test, les utilisateurs de l’API DeepSeek conservaient leur base_url habituel et ne modifiaient que le champ du modèle :
deepseek-v4.1-flash-expires-on-0910
Les conditions rapportées pour ce bêta étaient les suivantes :
Ces limites en faisaient un outil de comparaison, de vérification d’intégration ou d’évaluation précoce du multimodal, et non une dépendance adaptée à une mise en production. L’identifiant était temporaire et le plafond de concurrence ne permettait pas de valider un trafic soutenu.
Des testeurs ont fait état de vitesses d’environ 300 à 500 jetons générés par seconde, avec certains relevés dépassant 500 jetons par seconde. Ces chiffres provenaient toutefois d’observations d’utilisateurs : ils ne constituaient ni un engagement de niveau de service de DeepSeek ni un benchmark standardisé. 15
Le débit réel dépend notamment de la longueur du prompt, de la taille de la réponse, de la région, de la concurrence, de l’implémentation et des réglages du modèle. Ces retours suggéraient une bonne rapidité dans certaines conditions, mais ne doivent pas être interprétés comme une capacité garantie pour le développement, le prototypage d’interfaces ou toute autre charge de travail.
Lors de l’annonce, DeepSeek avait prévu de rediriger, à partir du 14 septembre, les requêtes API envoyées à deepseek-v4-pro vers V4.1 Flash, avec une facturation au tarif de V4.1 Flash, dans l’attente d’un futur V4.1 Pro. L’entreprise affirmait également que V4.1 Flash dépassait des modèles phares dans les évaluations qu’elle publiait. 5
Mais le journal des modifications de l’API, publié ultérieurement, indique que DeepSeek a finalement décidé de maintenir le service API V4 Pro après le 14 septembre, sans changement de facturation. Pour les intégrations actuelles, cette mise à jour officielle plus récente doit primer. 9
La leçon pour les équipes techniques est simple : pendant une transition de gamme, le routage et la disponibilité des modèles peuvent évoluer vite. Il est préférable de tester le nom de modèle documenté, de suivre le journal des modifications de l’API et d’effectuer des tests de non-régression avant de supposer qu’un alias ou une route redirigée produira un comportement identique.
Si vous consultez des articles sur le bêta, distinguez bien l’aperçu historique du produit désormais disponible :
| Bêta des 8–10 septembre | Version officielle |
|---|---|
deepseek-v4.1-flash-expires-on-0910 |
deepseek-flash |
| Route d’évaluation limitée dans le temps | Modèle API documenté |
| Facturation de bêta alignée sur V4 Flash | Tarifs et conditions du service publié |
| 20 requêtes simultanées par compte | Consulter la documentation API actuelle pour les limites opérationnelles |
L’essentiel de V4.1 Flash n’est donc pas son endpoint de deux jours. C’est l’arrivée, chez DeepSeek, d’un modèle Flash multimodal natif, reposant sur une nouvelle architecture, avec un identifiant API permanent et des détails d’architecture publiés. 5
9
Studio Global AI
Cette page comprend une réponse basée sur la source que vous pouvez continuer dans Studio Global.
Le bêta temporaire de DeepSeek V4.1 Flash, lancé le 8 septembre 2026, a laissé place à une version officielle le 10 septembre, accessible avec deepseek flash.
Le bêta temporaire de DeepSeek V4.1 Flash, lancé le 8 septembre 2026, a laissé place à une version officielle le 10 septembre, accessible avec deepseek flash. Le modèle intègre nativement la compréhension d’images, contrairement à l’ancienne extension expérimentale V4 Flash Vision, et repose sur une architecture Causal Encoder–Decoder.
Durant le bêta, le tarif était aligné sur V4 Flash et chaque compte était limité à 20 requêtes simultanées ; les vitesses de 300 à 500 jetons par seconde rapportées par des utilisateurs n’étaient pas des garanties off...