Qwen3.8 Omni Flash přijímá text, obrázky, zvuk a video v jednom pracovním postupu. Alibaba uvádí průměrné zlepšení o více než 25 % oproti Qwen3.5 Omni Plus ve 29 hodnoceních; u dlouhého videa model cílí na výběr relevantních úseků.
PublikovalUpraveno pomocí GPT-6 SolObrázky vytvořeny pomocí GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What is Alibaba’s Qwen3.8 Omni Flash, launched on the Qwen AI platform in September 2026, and how do its native text, image, audio, and vide. Article summary: Alibaba’s Qwen3.8 Omni Flash is a September 2026 model available on the Qwen AI platform that accepts text, images, audio, and video natively in one workflow, with a context window of up to 1 million tokens.. Topic tags: general web, agents, ai, workflow, productivity. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake
Alibaba v září 2026 zpřístupnila na platformě Qwen AI model Qwen3.8-Omni-Flash. Jeho hlavní změna nespočívá jen v tom, že přijímá více druhů souborů: text, obrázky, zvuk a video dokáže zpracovat společně v jednom zadání. Má přitom kontextové okno až milion tokenů – tedy prostor pro rozsáhlý vstup, z něhož může při řešení úkolu vycházet. Základní model vrací textový výstup; živá hlasová interakce patří samostatné variantě Realtime. 2
5
1
Představme si zadání nad nahrávkou schůzky: zjistit, kdo co řekl, sepsat závěry a připravit další kroky. Qwen3.8-Omni-Flash má pro takovou práci spojit obraz se zvukem, rozlišit mluvčí, přepsat jejich řeč a přiřadit ji správným osobám. Podporováno je až hodinové zvukově-obrazové zadání. Smyslem návazného použití nástrojů je pak výsledek zpracovat, nejen nahrávku popsat. 52
16
U dlouhého videa je důležité i to, co model nemusí zpracovat. Při selektivním postupu může podle úkolu vyhledávat relevantní okamžiky místo průběžného zpracování každého snímku. Alibaba uvádí v testu OmniVideoBench o 51,8 % nižší spotřebu tokenů oproti statickému způsobu porozumění videu. Jde o výsledek konkrétního hodnocení, nikoli o slíbenou úsporu u každé nahrávky. 12
16
Podle vlastního vyhodnocení Alibaby dosáhl nový model v průměru o více než 25 % lepšího skóre než Qwen3.5-Omni-Plus napříč 29 hodnoceními. To naznačuje posun v práci se zvukem a obrazem, samo o sobě však neurčuje, jak spolehlivý bude konkrétní firemní postup nebo jednotlivý přepis. 12
Pro vývojáře Alibaba rozšířila otevřeně dostupné Qwen-MM-Plugins, které mají agentním aplikacím zpřístupnit práci se zvukem a videem, volání nástrojů a delší pracovní postupy. Samostatný otevřený Qwen-Live Harness je určen pro průběžnou interakci. Varianta Qwen3.8-Omni-Flash-Realtime podporuje živý zvuk a video, textové i zvukové odpovědi, vícekanálový zvuk, agregaci videa a vzdálené nástroje přes MCP – rozhraní pro propojení AI s externími nástroji. Otevřená dostupnost těchto doprovodných nástrojů neznamená, že jsou otevřeně zveřejněné i váhy samotného modelu. 1
52
5
Ekonomický argument je výrazný: Alibaba uvádí pokles ceny API za hodinu zvukového vstupu o více než 98 % a za hodinu kombinovaného zvukového a obrazového vstupu o více než 93 %. Spolu s výběrovým zpracováním videa to může zlevnit opakovanou práci AI agentů s nahrávkami. Účet za konkrétní nasazení ale bude dál záviset na množství zpracovaných médií, spotřebovaných tokenech, výstupech a použitých nástrojích. 12
16
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Qwen3.8 Omni Flash přijímá text, obrázky, zvuk a video v jednom pracovním postupu.
Qwen3.8 Omni Flash přijímá text, obrázky, zvuk a video v jednom pracovním postupu. Alibaba uvádí průměrné zlepšení o více než 25 % oproti Qwen3.5 Omni Plus ve 29 hodnoceních; u dlouhého videa model cílí na výběr relevantních úseků.
Podle Alibaby klesla cena API za hodinu zvukového vstupu o více než 98 % a za hodinu kombinovaného zvukového a obrazového vstupu o více než 93 %.