Udostępniony we wrześniu 2026 r. na platformie Qwen AI model przyjmuje tekst, obrazy, dźwięk i wideo oraz oferuje okno kontekstowe do miliona tokenów.
Opublikowane przezEdytowane za pomocą GPT-6 SolObrazy wygenerowane za pomocą GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What is Alibaba’s Qwen3.8 Omni Flash, launched on the Qwen AI platform in September 2026, and how do its native text, image, audio, and vide. Article summary: Alibaba’s Qwen3.8 Omni Flash is a September 2026 model available on the Qwen AI platform that accepts text, images, audio, and video natively in one workflow, with a context window of up to 1 million tokens.. Topic tags: general web, agents, ai, workflow, productivity. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake
Qwen3.8-Omni-Flash to udostępniony we wrześniu 2026 r. na platformie Qwen AI model Alibaby, który przyjmuje tekst, obrazy, dźwięk i wideo w jednym przepływie pracy. Jego okno kontekstowe sięga miliona tokenów, czyli jednostek używanych do mierzenia ilości przetwarzanych danych. Sam model zwraca odpowiedź tekstową; jego zadaniem jest jednak nie tylko opisać materiał, lecz także pomóc agentowi AI zaplanować kolejne kroki i skorzystać z narzędzi. 1
2
5
16
Duży kontekst pozwala pracować na obszernych materiałach łączących różne formaty. W przypadku spotkań model obsługuje do godziny nagrania audio-wideo: może powiązać obraz osób z ich wypowiedziami, rozróżnić mówców i przygotować transkrypcję. Taki materiał może następnie posłużyć do opracowania notatki lub dalszych działań z użyciem narzędzi. 52
16
Przy długim filmie agent nie musi stale analizować każdej klatki. Może najpierw ustalić, jakiej informacji szuka, a potem sprawdzać istotne fragmenty. Według danych podanych przez Alibabę takie wybiórcze przetwarzanie zużyło w teście OmniVideoBench o 51,8% mniej tokenów niż statyczna analiza. To wynik konkretnego testu, a nie gwarantowana oszczędność dla każdego filmu. 16
Alibaba podaje, że średni wynik Qwen3.8-Omni-Flash w 29 ocenach wzrósł o ponad 25% względem Qwen3.5-Omni-Plus. Są to wyniki raportowane przez twórcę modelu; skuteczność przy własnych zadaniach trzeba sprawdzić osobno. 12
Dla programistów firma rozszerzyła Qwen-MM-Plugins, które pomagają włączać obsługę dźwięku i wideo do agentów wykonujących dłuższe zadania. Osobno udostępniła jako open source Qwen-Live Harness do ciągłej interakcji na żywo. Wariant Qwen3.8-Omni-Flash-Realtime obsługuje strumieniowy dźwięk i obraz, odpowiedzi tekstowe i głosowe, dźwięk wielokanałowy, agregację wideo oraz zdalne narzędzia MCP — interfejsy pozwalające agentowi korzystać z zewnętrznych funkcji. 1
52
Według Alibaby koszt API liczony na godzinę wejściowego audio spadł o ponad 98%, a wejściowego audio-wideo — o ponad 93%. W połączeniu z wybiórczą analizą nagrań może to ułatwić ekonomiczne wdrażanie agentów, którzy wielokrotnie sięgają po materiał i narzędzia. Całkowity koszt pracy nadal zależy jednak od ilości przetworzonych danych, zużytych tokenów, wygenerowanych odpowiedzi i użytych narzędzi. 12
16
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Udostępniony we wrześniu 2026 r. na platformie Qwen AI model przyjmuje tekst, obrazy, dźwięk i wideo oraz oferuje okno kontekstowe do miliona tokenów.
Udostępniony we wrześniu 2026 r. na platformie Qwen AI model przyjmuje tekst, obrazy, dźwięk i wideo oraz oferuje okno kontekstowe do miliona tokenów. Według Alibaby jego średni wynik w 29 testach jest o ponad 25% lepszy niż Qwen3.5 Omni Plus; wybiórcza analiza długiego wideo może ograniczać zużycie tokenów.
Firma deklaruje spadek kosztu wejściowego audio w API o ponad 98% za godzinę, a połączonego audio i wideo — o ponad 93%.