Dirilis pada September 2026 di platform Qwen AI, model ini menerima teks, gambar, audio, dan video secara native, dengan jendela konteks hingga 1 juta token. Alibaba melaporkan kenaikan skor rata rata lebih dari 25% dibanding Qwen3.5 Omni Plus dalam 29 evaluasi, serta penggunaan token 51,8% lebih sedikit pada uji pe...
Diterbitkan olehDiedit dengan GPT-6 SolGambar dibuat dengan GPT Image 2
Jawaban penelitian

Create a landscape editorial hero image for this Studio Global article: What is Alibaba’s Qwen3.8 Omni Flash, launched on the Qwen AI platform in September 2026, and how do its native text, image, audio, and vide. Article summary: Alibaba’s Qwen3.8 Omni Flash is a September 2026 model available on the Qwen AI platform that accepts text, images, audio, and video natively in one workflow, with a context window of up to 1 million tokens.. Topic tags: general web, agents, ai, workflow, productivity. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake
Qwen3.8-Omni-Flash adalah model AI Alibaba yang tersedia melalui platform Qwen AI sejak September 2026. Model ini menerima teks, gambar, audio, dan video dalam satu alur kerja, dengan jendela konteks hingga 1 juta token—kapasitas untuk menampung banyak informasi dalam satu proses, bukan jaminan bahwa setiap rekaman panjang akan dipahami sempurna. Model utamanya menghasilkan keluaran teks. 2
1
5
Yang ingin dicapai bukan sekadar deskripsi isi rekaman. Sebagai dasar agen AI—sistem yang dapat merencanakan langkah dan memakai alat—model ini dirancang untuk menemukan bagian media yang relevan, menalar isinya, lalu membantu menghasilkan pekerjaan yang bisa digunakan. 16
52
Untuk video panjang, agen dapat memeriksa bagian yang berkaitan dengan tugas alih-alih terus-menerus memproses setiap cuplikan. Alibaba melaporkan penggunaan token 51,8% lebih sedikit dibanding pendekatan pemahaman statis dalam pengujian OmniVideoBench. Perusahaan juga menyebut skor rata-rata Qwen3.8-Omni-Flash naik lebih dari 25% dari Qwen3.5-Omni-Plus dalam 29 evaluasi. Keduanya adalah hasil pengujian yang dilaporkan Alibaba, bukan janji penghematan atau kinerja yang sama untuk semua penggunaan. 16
12
Dalam rapat yang direkam, kemampuan menerima audio-video hingga satu jam memungkinkan model mengaitkan pembicara yang terlihat dengan suaranya, memisahkan giliran bicara, dan membuat transkrip. Alur kerja agen kemudian dapat memakai hasil itu untuk menyusun catatan atau langkah tindak lanjut dengan bantuan alat. 52
Qwen-MM-Plugins yang diperluas ditujukan untuk membantu agen mengakses kemampuan audio-video dalam alur kerja panjang. Qwen-Live Harness, yang dirilis sebagai sumber terbuka secara terpisah, ditujukan untuk interaksi multimodal berkelanjutan secara langsung. Status sumber terbuka perangkat pendukung ini tidak berarti bobot model Qwen3.8-Omni-Flash juga dibuka. 52
5
Ada pula varian Qwen3.8-Omni-Flash-Realtime untuk menerima audio dan video secara langsung serta memberi keluaran teks dan audio. Dokumentasi Qwen mencantumkan dukungan audio multikanal, penggabungan informasi video, dan penggunaan alat MCP jarak jauh. 1
Dari sisi harga API, Alibaba menyatakan biaya per jam input audio turun lebih dari 98%, sedangkan input gabungan audio-video turun lebih dari 93%. Dipadukan dengan pemrosesan video selektif, perubahan ini dapat membuat agen yang berulang kali mengamati media dan memakai alat lebih masuk akal secara biaya. Namun, tagihan nyata tetap bergantung pada media yang diproses, token yang terpakai, keluaran, dan alat dalam alur kerjanya. 12
16
Studio Global AI
Halaman ini berisi jawaban yang didukung sumber yang dapat Anda lanjutkan di dalam Studio Global.
Dirilis pada September 2026 di platform Qwen AI, model ini menerima teks, gambar, audio, dan video secara native, dengan jendela konteks hingga 1 juta token.
Dirilis pada September 2026 di platform Qwen AI, model ini menerima teks, gambar, audio, dan video secara native, dengan jendela konteks hingga 1 juta token. Alibaba melaporkan kenaikan skor rata rata lebih dari 25% dibanding Qwen3.5 Omni Plus dalam 29 evaluasi, serta penggunaan token 51,8% lebih sedikit pada uji pemrosesan video selektif.
Plugin untuk alur kerja panjang, perangkat untuk interaksi langsung, dan penurunan harga input audio serta audio video ditujukan untuk membuat agen multimodal lebih praktis dijalankan.