Alibaba, Qwen3.8 Flash’ı milyon giriş token’ı başına 0,16 dolar, milyon çıkış token’ı başına 0,47 dolar fiyatla sunuyor; Flash Next ise Qwen4 mimarisine dair açık ağırlıklı bir önizleme niteliğinde. Flash Next; 125 milyar ana model parametresi, 51 milyar N gram gömme parametresi ve token başına etkinleştirilen yalnı...
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Alibaba announce with the release of the multimodal Qwen3.8-Flash and the open-weight Qwen3.8-Flash-Next prototype for its future Q. Article summary: Alibaba is pairing a low-cost production model with an open-weight architectural preview: it is trying to make Qwen a widely deployed cloud service while seeding the developer ecosystem for the forthcoming Qwen4 generati. Topic tags: general, documentation, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, water
Alibaba’nın Qwen ekibi, farklı amaçlara hizmet eden ancak aynı stratejinin parçası olan iki yeni sürüm açıkladı. Qwen3.8-Flash, QwenCloud üzerinden sunulacak üretim odaklı çok kipli model. Qwen3.8-Flash-Next ise Alibaba’nın gelecekteki Qwen4 ailesine temel oluşturacağını söylediği mimarinin açık ağırlıklı önizlemesi. 515
Bu ikili hamlenin arkasındaki yaklaşım net: Alibaba, düşük fiyatlı barındırılan çıkarım hizmetiyle kurumsal iş yüklerini çekmeye çalışırken, açık ağırlıklar sayesinde geliştiricilerin Qwen4 mimarisine, araçlarına ve ekosistemine erkenden alışmasını hedefliyor. Teknik iddialar dikkat çekici olsa da performans ve maliyet verilerinin büyük bölümü Alibaba veya model kartı tarafından yayımlandı; bağımsız testlerle doğrulanmış kapsamlı bir tablo henüz bulunmuyor.
Alibaba, Qwen3.8-Flash’ı kodlama, ofis işleri ve uzun bağlamlı görevler için geliştirilen çok kipli bir Mixture-of-Experts (MoE) modeli olarak tanımlıyor. Modelin varsayılan bağlam penceresi 262.144 token. Bu kapasite; büyük dosyalar, uzun görüşmeler ve araştırma iş akışları için 1 milyon tokene kadar genişletilebiliyor. 515
QwenCloud için açıklanan fiyatlandırma, 1 milyon giriş token’ı başına 0,16 dolar ve 1 milyon çıkış token’ı başına 0,47 dolar. Alibaba üretim API’sinin yakında kullanıma açılacağını duyurdu; sonraki raporlar QwenCloud’un modeli bu oranlarla sunduğunu aktardı. 415
Bu fiyat, Flash’ı yalnızca yeni bir model değil, aynı zamanda bir altyapı ürünü hâline getiriyor. Geliştiriciler bu seviyedeki ücretlerle belge işleme, kodlama ajanları ve yüksek hacimli otomasyon iş akışlarını, amiral gemisi modellerde görülen yüksek maliyet baskısı olmadan deneyebilir.
Flash-Next, QwenCloud’da sunulan ikinci bir API paketi değil. Qwen4 ailesine giden yolda mimari fikirleri gösteren açık ağırlıklı bir model. Model deposunda 125 milyar parametreli ana model, buna ek olarak 51 milyar N-gram gömme parametresi ve token başına etkinleştirilen yalnızca 6 milyar parametre belirtiliyor.
Bu yapı seyrek bir Mixture-of-Experts tasarımına dayanıyor. Modelin toplam parametre havuzu büyük olsa da her token işlenirken bunun yalnızca küçük bir bölümü kullanılıyor. Teorik olarak bu yaklaşım, benzer büyüklükte yoğun bir modele kıyasla token başına hesaplama maliyetini düşürürken daha yüksek bir kapasite tavanı sağlayabilir.
Model kartında Flash-Next için yerel bağlam penceresi 262.144 token olarak veriliyor; YaRN kullanıldığında bu kapasitenin 1 milyona çıkarılabildiği bildiriliyor. Flash ve Flash-Next ayrı sürümler olduğu için geliştiricilerin kullanacakları sürümün kesin sınırlarını, bellek gereksinimlerini ve sunum davranışını dağıtım belgelerinden ayrıca doğrulaması gerekiyor. 13
| Özellik | Qwen3.8-Flash | Qwen3.8-Flash-Next |
|---|---|---|
| Temel rol | Üretim kullanımı için barındırılan model | Qwen4 mimarisi için açık ağırlıklı önizleme |
| Kullanım alanları | Çok kipli kodlama, ofis işleri ve ajan iş akışları | Çok kipli kodlama, ofis işleri ve uzun süreli ajan görevleri |
| Bağlam | Varsayılan 262.144 token; 1 milyona kadar genişletilebilir | Yerel 262.144 token; YaRN ile bildirilen 1 milyon token desteği |
| Barındırılan fiyat | Girişte milyon token başına 0,16 dolar; çıkışta 0,47 dolar | Açık ağırlıklar için Alibaba API fiyatı belirlenmiş değil |
| Mimari veriler | Alibaba, Flash serisini çok kipli MoE olarak tanımlıyor | 125 milyar ana model parametresi, 51 milyar N-gram gömme parametresi ve token başına 6 milyar etkin parametre |
| Kullanılabilirlik | QwenCloud üretim API’si duyuruldu | Ağırlıklar ve model kartı Ağustos 2026’nın son günlerinde yayımlandı |
Zamanlama da iki sürüm arasındaki ilişkiyi güçlendiriyor. Flash-Next’in deposu ve model kartı, üretim API’si duyurusundan önce veya onunla aynı dönemde erişime açıldı. Böylece geliştiriciler, Alibaba barındırılan hizmeti hazırlarken mimarinin erken bir örneğini inceleyebildi. 7
Alibaba, yeni Flash serisinin Qwen3.7-Plus’a kıyasla yaklaşık dokuzda bir eğitim maliyetiyle geliştirildiğini ve özellikle kodlama ile ofis görevlerinde daha iyi performans sunduğunu belirtiyor. 515
Bu önemli bir iddia; ancak bağımsız denetimden geçmiş bir maliyet çalışması olarak değil, şirket tarafından bildirilen bir karşılaştırma olarak okunmalı. Eğitim maliyeti; donanım fiyatları, eğitim süresi, veri hazırlama, başarısız denemeler ve muhasebe yöntemi gibi birçok değişkene bağlıdır.
Bununla birlikte seyrek mimari, Alibaba’nın daha düşük eğitim ve çıkarım maliyetine yaptığı vurguyu teknik açıdan anlaşılır kılıyor. Her token için modeldeki parametrelerin yalnızca bir kısmının etkinleştirilmesi, hesaplama yükünü azaltabilir.
Alıcılar açısından pratik ayrım daha basit: Barındırılan Flash fiyatı API bütçesi hazırlamak için doğrudan kullanılabilir bir veri. “Dokuzda bir maliyet” ifadesi ise dışarıdan yapılacak karşılaştırmalı ölçümler gelene kadar mimari ve stratejik bir sinyal olarak değerlendirilmeli.
Alibaba’nın Flash-Next model kartında şu sonuçlar yer alıyor:
Model kartında yeniden yayımlanan karşılaştırma tablosuna göre Flash-Next, listelenen Claude Opus 4.6 Max sonucunu SWE-bench Pro, SWE-bench Multilingual, CoWorkBench ve JobBench testlerinde geçiyor. Örneğin SWE-bench Pro’da bildirilen karşılaştırma 62,5’e karşı 53,4, SWE-bench Multilingual’da ise 81,0’a karşı 77,5.
Bu sonuçlar, yazılım mühendisliği ve iş yeri ajanı görevlerinde güçlü bir performansa işaret ediyor. Ancak Flash-Next’in Claude’dan veya diğer öncü sistemlerden her alanda daha iyi olduğunu kanıtlamıyor. Rakamlar tedarikçi tarafından yayımlandı, değerlendirme düzenekleri farklılık gösterebilir ve Flash-Next benchmark sonuçları her üretim Qwen3.8-Flash dağıtımına otomatik olarak genellenmemeli.
Kaynaklar Flash-Next’i açık ağırlıklı bir model olarak tanımlıyor. Yayımlanan bir model özeti lisansı qwen-community-1.0 olarak listeliyor. Buna rağmen geliştiricilerin ticari yeniden dağıtım, ince ayar veya barındırılan kullanım öncesinde resmi depo ve model kartındaki geçerli lisansı kontrol etmesi gerekiyor. 6
“Açık ağırlık” ifadesi, tüm kullanım biçimlerinin sınırsız olduğu anlamına gelmez. Lisans; yeniden dağıtım, atıf, kabul edilebilir kullanım veya türev modeller konusunda koşullar getirebilir. Mevcut kanıtlar, sürümün tüm bileşenleri için ticari izinlerin kapsamı hakkında daha geniş bir hüküm vermeye yetmiyor.
Model lansmanı, Alibaba’nın yapay zekâ altyapısını büyütmek için yüksek harcama yaptığı bir döneme denk geliyor. Reuters’a göre şirketin çeyreklik bulut geliri yüzde 45 artarken sermaye harcamaları yüzde 75 yükseldi ve çeyreklik net kâr yüzde 75 düştü. 18
Reuters ayrıca Alibaba’nın yapay zekâ hedeflerini finanse etmek için Hong Kong’da hisse yerleştirmesi yoluyla 10 milyar dolar toplamaya çalıştığını bildirdi. Bu rakamlar, stratejinin temel gerilimini ortaya koyuyor: Bulut ve yapay zekâ hesaplama talebi büyüyor, ancak kapasite kurmanın maliyeti kısa vadede kâr ve nakit üretimi üzerinde baskı oluşturuyor.
Bu nedenle düşük fiyat, kısa vadede model marjlarını sınırlasa bile stratejik açıdan değerli olabilir. Ucuz çıkarım hizmeti Alibaba’nın bulut altyapısının kullanımını artırabilir, kurumsal iş yüklerini çekebilir ve Qwen’i uzun bağlamlı uygulamalar geliştiren ekipler için varsayılan seçeneklerden biri hâline getirebilir.
Flash-Next’in açık ağırlıklı yayımlanması, Alibaba’nın erişimini kendi API’sinin dışına taşıyor. Geliştiriciler modeli indirip test edebilir, uyarlayabilir ve kendi altyapılarında çalıştırabilir. Böylece hemen QwenCloud’a bağlanmadan Qwen araçları ve mimarisiyle deneyim kazanabilirler.
Bu dağıtım modeli Alibaba’ya birkaç açıdan katkı sağlayabilir:
Mevcut kanıtlar bu tabloyu stratejik bir yorum olarak destekliyor; ancak Qwen’in Çin’deki geliştirici ekosistemini kazandığını göstermiyor. Kaynaklarda aktif geliştirici, indirme veya kurumsal dağıtım sayısına ilişkin doğrulanmış güncel bir veri bulunmuyor.
Qwen3.8-Flash ve Flash-Next, tek başına iki model lansmanı olarak değil, aynı ürün stratejisinin iki ayağı olarak görülmeli. Flash, düşük maliyetli ve uzun bağlamlı bir bulut hizmeti. Flash-Next ise Qwen4’e uzanan açık ağırlıklı ekosistem ve mimari hamle.
Milyon giriş token’ı başına 0,16 dolar fiyat, 1 milyona kadar bağlam, çok daha büyük bir model içindeki 6 milyar etkin parametre yolu ve kodlama ile ajan görevlerinde yayımlanan güçlü benchmark sonuçları, çıkarım ekonomisini izleyen geliştiriciler için lansmanı önemli kılıyor. 4
Ancak sınırlar da önemli: Üretim modeliyle önizleme modeli birbirine karıştırılmamalı, eğitim maliyeti iddiası bağımsız biçimde denetlenmiş değil, benchmark karşılaştırmaları şirket kaynaklı ve benimseme düzeyi mevcut kanıtlarla ölçülemiyor.
Alibaba, Çin’in yapay zekâ yarışında ciddi ve finansal açıdan güçlü bir rakip görüntüsü veriyor; ancak tartışmasız lider konumunda olduğunu söylemek için yeterli veri yok. Şirketin yüksek harcama iştahı, Qwen’i kısa vadeli bir kâr merkezi olmaktan çok uzun vadeli bir bulut ve geliştirici ekosistemi yatırımı olarak gördüğünü ortaya koyuyor. 18
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Alibaba, Qwen3.8 Flash’ı milyon giriş token’ı başına 0,16 dolar, milyon çıkış token’ı başına 0,47 dolar fiyatla sunuyor; Flash Next ise Qwen4 mimarisine dair açık ağırlıklı bir önizleme niteliğinde.
Alibaba, Qwen3.8 Flash’ı milyon giriş token’ı başına 0,16 dolar, milyon çıkış token’ı başına 0,47 dolar fiyatla sunuyor; Flash Next ise Qwen4 mimarisine dair açık ağırlıklı bir önizleme niteliğinde. Flash Next; 125 milyar ana model parametresi, 51 milyar N gram gömme parametresi ve token başına etkinleştirilen yalnızca 6 milyar parametreyle seyrek Mixture of Experts mimarisini kullanıyor.
Qwen3.8 Flash, varsayılan 262.144 token bağlam penceresini 1 milyon tokene kadar genişletebiliyor; ancak performans ve maliyet iddialarının önemli bölümü Alibaba’nın kendi açıklamalarına dayanıyor.