Qwen3.8 Omni Flash vastaanottaa tekstiä, kuvia, ääntä ja videota, ja sen konteksti ikkuna on enintään miljoona tokenia. Alibaban mukaan mallin tulos parani keskimäärin yli 25 prosenttia Qwen3.5 Omni Plusiin verrattuna 29 arvioinnissa.
JulkaisijaMuokattu mallilla GPT-6 SolKuvat luotu mallilla GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What is Alibaba’s Qwen3.8 Omni Flash, launched on the Qwen AI platform in September 2026, and how do its native text, image, audio, and vide. Article summary: Alibaba’s Qwen3.8 Omni Flash is a September 2026 model available on the Qwen AI platform that accepts text, images, audio, and video natively in one workflow, with a context window of up to 1 million tokens.. Topic tags: general web, agents, ai, workflow, productivity. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake
Alibaban Qwen3.8-Omni-Flash tuli Qwen AI -alustalle syyskuussa 2026. Se ottaa vastaan tekstiä, kuvia, ääntä ja videota samassa työnkulussa. Sen konteksti-ikkuna – eli kerralla käsiteltävän aineiston enimmäismäärä – on jopa miljoona tokenia. Perusmallin ulostulo on tekstiä; ääntä tuottava reaaliaikainen vuorovaikutus kuuluu erilliseen Realtime-versioon. 2
5
1
Tavoitteena ei ole vain kuvailla tallennetta. Agentti voi etsiä tehtävän kannalta olennaisen puheen tai videokohdan, päätellä seuraavan vaiheen ja käyttää työkaluja lopputuloksen tuottamiseen. Pitkän videon kohdalla sen ei tarvitse käsitellä jokaista ruutua samalla tarkkuudella. Alibaban ilmoituksen mukaan valikoiva käsittely kulutti OmniVideoBench-testissä 51,8 prosenttia vähemmän tokeneita kuin staattinen käsittely. Luku on testitulos, ei lupaus vastaavasta säästöstä kaikessa käytössä. 16
Kokous on konkreettinen esimerkki: malli tukee enintään tunnin mittaista ääni- ja videotallennetta ja voi yhdistää puhujien äänet videolla näkyviin henkilöihin, litteroida keskustelun sekä erotella puhujat. Työkaluja hyödyntävä työnkulku voi jatkaa tästä esimerkiksi muistion tai tehtävälistan tekemiseen. Miljoonan tokenin konteksti ja tunnin tallennetuki kuvaavat eri rajoja, eikä niitä pidä pitää samana asiana. 52
Alibaban mukaan Qwen3.8-Omni-Flashin keskimääräinen tulos oli yli 25 prosenttia parempi kuin Qwen3.5-Omni-Plusin 29 arvioinnissa. Vertailu kertoo raportoidusta testimenestyksestä, ei yksittäisen käyttötapauksen varmuudella paranevasta laadusta. 12
Laajennetut, avoimen lähdekoodin Qwen-MM-Plugins-lisäosat auttavat liittämään äänen ja videon käsittelyn agenttisovelluksiin ja pitkäkestoisiin työnkulkuihin. Erillinen avoimen lähdekoodin Qwen-Live Harness on tarkoitettu jatkuvaan, reaaliaikaiseen vuorovaikutukseen. Avoimuus koskee näitä työkaluja, ei itse Qwen3.8-Omni-Flash-mallin painoja. 5
Qwen3.8-Omni-Flash-Realtime puolestaan tukee suoraa ääni- ja videovuorovaikutusta sekä teksti- ja ääniulostuloa. Sen ominaisuuksiin kuuluvat myös monikanavainen ääni, videon koonti ja etäkäyttöiset MCP-työkalut. MCP on tapa yhdistää agentti ulkoisiin työkaluihin. 1
Kustannusten kannalta olennaista on Alibaban ilmoitus: äänen API-syötteen hinta tuntia kohti laski yli 98 prosenttia ja yhdistetyn ääni- ja videosyötteen yli 93 prosenttia. Kun agentti voi lisäksi käsitellä pitkästä videosta vain tarpeelliset osat, toistuva analysointi voi tulla aiempaa edullisemmaksi. Todellinen kokonaislasku riippuu silti käsitellystä aineistosta, kuluneista tokeneista, tuotetusta ulostulosta ja käytetyistä työkaluista. 12
16
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Qwen3.8 Omni Flash vastaanottaa tekstiä, kuvia, ääntä ja videota, ja sen konteksti ikkuna on enintään miljoona tokenia.
Qwen3.8 Omni Flash vastaanottaa tekstiä, kuvia, ääntä ja videota, ja sen konteksti ikkuna on enintään miljoona tokenia. Alibaban mukaan mallin tulos parani keskimäärin yli 25 prosenttia Qwen3.5 Omni Plusiin verrattuna 29 arvioinnissa.
Valikoiva videonkäsittely, agenttien lisätyökalut ja Alibaban ilmoittamat syötehintojen laskut tähtäävät pitkäkestoisten työnkulkujen kustannusten pienentämiseen.