
Create a landscape editorial hero image for this Studio Global article: What is DeepSeek’s experimental DeepSeek-V4-Flash-Vision-Exp model, released on August 21, 2026, how does it extend the existing V4-Flash te. Article summary: DeepSeek-V4-Flash-Vision-Exp is an experimental, API-only multimodal extension of DeepSeek’s V4-Flash model: it retains the base model’s text, reasoning, agent, and world-knowledge capabilities while adding image underst. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
DeepSeek-V4-Flash-Vision-Exp on kokeellinen multimodaalimalli, joka laajentaa DeepSeekin V4-Flashia kuvien ymmärtämisellä. Malli tuli saataville DeepSeekin API-alustalle 21. elokuuta 2026, ja se on tarkoitettu tekstiä, kuvia, päättelyä ja työkaluja yhdistäviin agenttityönkulkuihin.
DeepSeekin julkaisussa kiinnostavin väite on vertailu Anthropic-yhtiön Claude Opus 4.8 -malliin. Yhtiön mukaan uusi malli yltää lähelle Opus 4.8:aa multimodaalisissa agenttitesteissä ja säilyttää samalla V4-Flashin tekstikyvyt. Väite on merkittävä, mutta sitä on syytä lukea maltilla: The Next Webin raportoimassa DeepSeekin omassa vertailutaulukossa Vision-Exp voitti Opus 4.8:n kolmessa 11 benchmarkista.
Keskeinen uudistus on visuaalinen syöte. Kehittäjä voi lähettää mallille tekstiä ja kuvia samassa pyynnössä, jolloin agentti voi esimerkiksi tulkita:
API-pyynnöissä käytettävä mallin tunniste on:
deepseek-v4-flash-vision-expDeepSeek kertoo mallin säilyttävän V4-Flash-perheen tekstiominaisuudet, kuten päättelyn, agenttitoiminnot ja maailmantiedon. Virallisessa muutoslokissa ilmoitetaan muun muassa tulokset 83,9 Terminal Bench 2.1 -testissä, 59,3 DeepSWE-testissä ja 63,6 DSBench-Hard-testissä.
Kyse ei siis ole pelkästä kuvatekstejä tuottavasta mallista. Vision-Exp pyrkii tuomaan näkökyvyn jo olemassa olevaan teksti- ja agenttimalliin, jotta sama järjestelmä voi ymmärtää sekä keskustelua että näytöllä tai kuvassa näkyvää sisältöä.
DeepSeekin virallisessa muutoslokissa Vision-Expille ilmoitetaan seuraavia multimodaalisiin agenttitehtäviin liittyviä tuloksia:
Näistä luvuista ei kuitenkaan voi päätellä, että malli olisi yleisesti Claude Opus 4.8:n tasolla. Benchmark-tulos riippuu muun muassa käytetyistä kehotteista, työkaluympäristöstä, tehtävien valinnasta, viivevaatimuksista ja arviointitavasta. Lisäksi kyse on ensisijaisesti DeepSeekin omasta raportoinnista, ei kattavasta kolmannen osapuolen arvioinnista.
Siksi ilmaus ”lähellä Opus 4.8:aa” tarkoittaa käytännössä lähellä valitussa testijoukossa. Se ei vielä todista samanlaista laatua kaikissa visuaalisissa tehtävissä, ohjelmointityössä, tuotantokäytössä tai pitkissä agenttisessioissa.
Tekstipainotteisessa käytössä DeepSeek korostaa jatkuvuutta eikä selvää ylivoimaa. Vision-Expin on tarkoitus säilyttää V4-Flashin aiemmat päättely- ja agenttikyvyt, jotta kehittäjän ei tarvitse vaihtaa kokonaan uuteen malliperheeseen saadakseen kuvatuen.
Mallin rooli onkin helpompi hahmottaa näin:
Vision-Exp on saatavana DeepSeekin API:n kautta. Se tukee Chat Completions-, Messages- ja Responses-rajapintoja sekä tekstin ja kuvan yhdistelmiä.
Kuvan voi toimittaa kolmella tavalla:
file_id-tunnisteella.Tuetut tiedostomuodot ovat JPEG, PNG, GIF ja WebP. Responses API:ssa kuva välitetään input_image-sisältöosana, joka voi sisältää URL-osoitteen, base64-data-URL:n tai ladatun tiedoston viitteen.
Kuvat muunnetaan laskutettaviksi syötetokeneiksi. DeepSeekin mukaan yksi kuva tuottaa laskutuksessa enintään 384 syötetokenia, ja hinnoittelu noudattaa V4-Flashin hintoja.
Julkaisun yhteydessä ilmoitetut hinnat miljoonaa tokenia kohden ovat:
384 tokenin enimmäismäärä tekee kuvan osuudesta melko ennakoitavan. Se ei kuitenkaan rajoita pyynnön mukana lähetettävää tekstiä, työkalukutsuja tai mallin tuottamaa vastausta. Kokonaisen agenttityönkulun hinta voi siis olla huomattavasti kuvan omaa osuutta suurempi.
DeepSeek julkaisi Vision-Expin rinnalla Harness 0.1.1:n, jossa on suora tuki uudelle mallille. Harness on kehittäjille olennainen erityisesti silloin, kun mallia käytetään työkaluja kutsuvassa agentissa eikä vain yksittäiseen kuvakysymykseen vastaavana järjestelmänä.
Samalla julkaistu Files API on maksuton. Kehittäjä voi ladata kuvan kerran ja viitata siihen myöhemmissä pyynnöissä file_id-tunnisteella sen sijaan, että kuvan sisältö lähetettäisiin aina uudelleen. DeepSeekin dokumentaatiossa tiedostoviitteet ovat muotoa file-api-....
Ratkaisu sopii esimerkiksi tilanteisiin, joissa agentti tarkastelee samaa kuvakaappausta, dokumenttisivua tai muuta visuaalista aineistoa usean keskustelukierroksen aikana. Files API:n käyttö on maksutonta, mutta mallin suorittama päättely ja tokenien käyttö ovat edelleen laskutettavia.
Vision-Exp kertoo laajemmasta muutoksesta tekoälykilpailussa. Mallin laadun lisäksi kehittäjille merkitsevät API-yhteensopivuus, hinta, tiedostojen uudelleenkäyttö ja agenttityökalut. DeepSeek tarjoaa Flash-malliperheensä yhteyteen visuaalisen laajennuksen samoilla julkaistuilla tokenhinnoilla kuin V4-Flash, ja vertaa sitä Anthropic-yhtiön Opus 4.8:aan.
Tämä ei silti ole selvä lippulaivajulkistus. ”Flash” ja ”Exp” viittaavat edullisempaan ja kokeelliseen julkaisuun, jonka todellinen arvo riippuu käytännön luotettavuudesta. Kehittäjien on nähtävä, miten malli suoriutuu esimerkiksi kuvakaappauksiin perustuvasta koodauksesta, dokumenttianalyysistä, käyttöliittymäagenteista ja visuaalisesta työkalujen käytöstä.
Varovaisin mutta selkein johtopäätös on seuraava: DeepSeek tekee edullisesta visuaalisesta päättelystä helpommin saavutettavaa nykyisen API-ekosysteeminsä kautta, ja sen ensimmäiset benchmarkit viittaavat kilpailukykyyn tietyissä multimodaalisissa testeissä. Riippumattomat arvioinnit, todellinen toimintavarmuus ja kehittäjien pitkäaikainen kiinnostus ratkaisevat, kasvaako Vision-Exp varteenotettavaksi vaihtoehdoksi vai jääkö se kiinnostavaksi kokeiluksi.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
21. elokuuta 2026 julkaistu DeepSeek V4 Flash Vision Exp lisää kuvien ymmärtämisen V4 Flashin teksti , päättely ja agenttikykyihin.
21. elokuuta 2026 julkaistu DeepSeek V4 Flash Vision Exp lisää kuvien ymmärtämisen V4 Flashin teksti , päättely ja agenttikykyihin. API:ssa käytettävä mallin tunniste on deepseek v4 flash vision exp. Yksi kuva vastaa laskutuksessa enintään 384:ää syötetokenia, ja kuvan voi lähettää base64 muodossa, URL osoitteella tai Files API viitteenä.
Julkaisun yhteydessä DeepSeek toi Harness 0.1.1 tuen ja maksuttoman Files API:n, jonka avulla sama kuva voidaan ladata kerran ja käyttää uudelleen monikierroksisissa agenteissa.