De tijdelijke bèta van DeepSeek V4.1 Flash startte op 8 september 2026 en werd op 10 september officieel uitgebracht als deepseek flash. De bèta gebruikte een nieuwe architectuur met native beeldbegrip, behield dezelfde API basis URL, kostte evenveel als V4 Flash en had een limiet van 20 gelijktijdige verzoeken per...
Gepubliceerd doorBewerkt met GPT-5.6 TerraAfbeeldingen gegenereerd met GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What is DeepSeek V4.1 Flash, and what are the key details of its September 2026 time-limited internal beta—including its new native multimod. Article summary: DeepSeek V4.1 Flash was initially a short, evaluation-oriented API beta of an intermediate Flash-tier model. It launched on September 8, 2026 with a new architecture and native visual understanding, unlike the earlier V4. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
DeepSeek V4.1 Flash maakte in september 2026 een opvallend korte overgang door: van een tijdelijke API-test naar een officieel model. De bèta van 8 september viel op door native multimodaliteit: beeldbegrip zat in het model zelf, in plaats van in een aparte vision-uitbreiding. Op 10 september bracht DeepSeek de definitieve versie uit onder de vaste API-modelnaam deepseek-flash. 5
9
De beperkte bèta was beschikbaar rond 8 tot en met 10 september 2026. Ontwikkelaars hoefden hun API-endpoint niet te wijzigen, maar gebruikten tijdelijk deze model-ID:
deepseek-v4.1-flash-expires-on-0910
De naam maakte meteen duidelijk dat het geen blijvende route was. 7
20
Dat veranderde op 10 september, toen DeepSeek V4.1 Flash officieel uitbracht. De momenteel gedocumenteerde modelkeuze voor de API is:
deepseek-flash
Volgens de API-wijzigingslog van DeepSeek biedt dat model native multimodale ondersteuning. 9
Het belangrijkste technische verschil is native visueel begrip in een nieuwe modelarchitectuur. Dat wijkt af van deepseek-v4-flash-vision-exp, de eerdere experimentele vision-variant naast V4 Flash.
Na de release meldde DeepSeek dat verzoeken aan zowel de eerdere V4 Flash als de experimentele V4 Flash Vision-naam tijdelijk worden doorgestuurd naar V4.1 Flash, om compatibiliteit te behouden. 5
DeepSeek omschrijft de nieuwe versie als een mixture-of-experts-model met 552 miljard parameters en een Causal Encoder–Decoder-architectuur. Bij het verwerken van invoer zijn volgens het bedrijf 8 miljard parameters actief; voor het genereren van uitvoer zijn dat er 16 miljard. 5
Voor API-gebruikers is de praktische consequentie helder: tekst en afbeeldingen worden door hetzelfde V4.1 Flash-model verwerkt. De vroegere experimentele vision-extensie hoeft dus niet apart te worden gekozen.
Tijdens het testvenster konden bestaande DeepSeek-gebruikers hun basis-URL behouden. Alleen het veld voor de modelnaam moest worden aangepast:
deepseek-v4.1-flash-expires-on-0910
De gemelde voorwaarden van de bèta waren:
Daarmee was deze route geschikt voor vergelijkende tests, integratiecontroles en een eerste beoordeling van multimodale mogelijkheden, maar niet als fundament voor een productieomgeving. De model-ID was tijdelijk en de lage gelijktijdigheidslimiet beperkte testen met aanhoudend verkeer.
Vroege testers noemden snelheden van ongeveer 300 tot 500 outputtokens per seconde, met sommige meldingen boven de 500 tokens per seconde. Dit waren waarnemingen van gebruikers, geen officiële servicebelofte of gestandaardiseerde benchmark van DeepSeek. 15
De doorvoer kan verschillen door onder meer de lengte van prompt en antwoord, regio, gelijktijdige belasting, implementatie en modelinstellingen. Die berichten zijn hooguit een aanwijzing dat de bèta onder sommige omstandigheden snel leek — geen capaciteitsgarantie voor bijvoorbeeld programmeerwerk of UI-prototypes.
Bij de release kondigde DeepSeek aanvankelijk aan dat verzoeken aan deepseek-v4-pro vanaf 14 september naar V4.1 Flash zouden worden doorgestuurd, tegen de tarieven van V4.1 Flash, in afwachting van een toekomstige V4.1 Pro. In dezelfde aankondiging stelde DeepSeek dat V4.1 Flash op de door het bedrijf gerapporteerde benchmarks beter presteerde dan vlaggenschipmodellen. 5
Een latere update in de officiële API-wijzigingslog is echter leidend voor de actuele situatie: DeepSeek besloot V4 Pro na 14 september toch als API-dienst beschikbaar te houden, met ongewijzigde facturering. 9
De bredere les: API-routing en modelbeschikbaarheid kunnen tijdens productovergangen snel veranderen. Teams die een van beide modellen gebruiken, doen er goed aan hun tests te koppelen aan de gedocumenteerde modelnaam, de API-wijzigingslog te volgen en regressietests uit te voeren voordat zij ervan uitgaan dat een alias of doorgestuurde endpoint zich identiek gedraagt.
Wie oude berichtgeving over de bèta leest, moet onderscheid maken tussen de historische test en het uitgebrachte product:
| Bèta, 8–10 september | Officiële release |
|---|---|
deepseek-v4.1-flash-expires-on-0910 |
deepseek-flash |
| Tijdelijke route voor evaluatie | Gedocumenteerd API-model |
| Bètaprijzen gelijk aan V4 Flash | Prijzen en voorwaarden van de release gelden |
| 20 gelijktijdige verzoeken per account | Raadpleeg de actuele API-documentatie voor operationele limieten |
Het blijvende nieuws rond V4.1 Flash is dus niet de tweedaagse endpoint, maar de introductie van een Flash-model met native multimodaliteit, een nieuwe architectuur, een permanente API-identificatie en gepubliceerde hoofdlijnen over de architectuur. 5
9
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
De tijdelijke bèta van DeepSeek V4.1 Flash startte op 8 september 2026 en werd op 10 september officieel uitgebracht als deepseek flash.
De tijdelijke bèta van DeepSeek V4.1 Flash startte op 8 september 2026 en werd op 10 september officieel uitgebracht als deepseek flash. De bèta gebruikte een nieuwe architectuur met native beeldbegrip, behield dezelfde API basis URL, kostte evenveel als V4 Flash en had een limiet van 20 gelijktijdige verzoeken per account.
Vroege snelheidsmeldingen van circa 300 tot 500 outputtokens per seconde waren niet officieel bevestigd.