| Varyant | Toplam Parametre | Aktif Parametre | Bağlam Penceresi | Maks. Çıktı |
|---|---|---|---|---|
| V4-Pro | 1,6 trilyon (MoE) | Token başına ~49B | 1 milyon token | 384 bin token |
| V4-Flash | 284 milyar (MoE) | Token başına ~13B | 1 milyon token | 384 bin token |
Her iki varyant da çok modludur (metin, görüntü, video), JSON çıktısını ve araç çağrılarını destekler, API ve web üzerinden kullanılabilir .
| Varyant | Giriş (yoğun olmayan) | Çıkış (yoğun olmayan) | Önbellek İsabeti |
|---|---|---|---|
| V4-Pro | 0,435 $ | 0,87 $ | %90 indirim |
| V4-Flash | 0,14 $ | 0,28 $ | %90 indirim |
DeepSeek ayrıca Mayıs 2026 başına kadar V4-Pro'da %75 indirim kampanyası yürüttü . Karşılaştırma için GPT-5.5 çıktı fiyatlandırması ~30 $/MTok seviyesinde; bu da V4-Flash'ı çıktıda kabaca 107 kat daha ucuz yapıyor .
DeepSeek V4'ün kıyaslama sonuçları incelikli bir hikaye anlatıyor:
NIST CAISI değerlendirmesinden (Mayıs 2026) önemli uyarı: DeepSeek'in kendi bildirdiği kıyaslamalar GPT-5.4 ve Opus 4.6 ile eşitlik iddia ediyor, ancak CAISI'nin bağımsız değerlendirmesi V4'ü genel olmayan kıyaslamalarda "önemli ölçüde daha az yetenekli" buldu; bu da bazı kendi bildirilen puanların şişirilmiş olabileceğini gösteriyor . Artificial Analysis'in Zeka Endeksi, GPT-5.5'i (yüksek) 53, DeepSeek V4 Pro'yu (Akıl Yürütme, Yüksek Çaba) ise 41* olarak derecelendiriyor. GPT-5.5 daha zeki ve daha hızlı (saniyede 69 tokene karşılık 56 token), ancak DeepSeek (akıl yürütme modunda milyon token başına 0,18 $'a karşı 4,35 $) önemli ölçüde daha ucuz .
Alibaba'nın Qwen ekibi, Qwen 3.8 Max'i 19 Temmuz 2026'da Şanghay'daki Dünya Yapay Zeka Konferansı'nda tanıttı . Bu, ekibin 1 trilyon parametrenin üzerindeki ilk amiral gemisi modeli.
| Nitelik | Detay |
|---|---|
| Toplam parametre | 2,4 trilyon (seyrek MoE) |
| Mimari | Uzman Karışımı (MoE), çok modlu (metin + görüntü onaylandı) |
| Bağlam penceresi | Qwen Cloud uç noktası başına 983.616 token ; bazı kaynaklarda ~1M olarak tekrarlanıyor |
| Maks. çıktı | 64.000 token |
| Lisans | Henüz yayınlanmadı; Alibaba "yakında" açık ağırlıklı olacağını söylüyor |
Kullanıma hazır fiyatlandırma henüz yayınlanmadı. Erişim şu anda Qwen Chat ve seçili API ortakları aracılığıyla abonelik yoluyla sağlanıyor. BenchLM, Qwen 3.8 Max Preview fiyatlandırmasını "Listelenmemiş" olarak gösteriyor . Bazı üçüncü taraf izleyiciler, milyon giriş/çıkış token başına 1,50 $/5,00 $ olarak otomatik fiyatlandırma gösteriyor ancak bu Alibaba tarafından doğrulanmadı .
Alibaba, Qwen 3.8'in "yalnızca Fable 5'ten (Anthropic'in en iyi Claude modeli) sonra geldiğini" belirtiyor; bu, Alibaba'nın kendi sıralamasında onu GPT-5.5 ve DeepSeek V4'ün önüne koyar . Kodlama, profesyonel üretkenlik, tam yığın geliştirme, veri analizi ve ofis iş akışlarında Qwen 3.7 Max'e göre kazanımlar olduğu iddia ediliyor .
Ancak hiçbir bağımsız kıyaslama yayınlanmadı. Kıyaslama takip sitesi BenchLM, 20 Temmuz 2026 itibarıyla Qwen 3.8 Max Preview için 321 kıyaslamayı takip ediyor ve 0 doğrulanmış sonuç var . Bir analizin belirttiği gibi, "Qwen 3.8 test etmeye değer, ancak Kimi K3, GPT-5.6 Sol veya Claude Fable 5'in yerine geçecek istikrarlı bir üretim modeli olarak kabul etmek için çok erken" .
Bağlam açısından, Qwen'in öncekileri güçlü bir temel oluşturdu: Qwen 3.6-Max-Preview (20 Nisan 2026), 35B toplam / 3B aktif parametreli, yalnızca metin tabanlı, 262K bağlamlı bir modeldi ve altı kodlama ve aracı kıyaslamasında 1 numara olduğunu iddia ediyordu . Qwen 3.7-Max (Mayıs 2026), akıl yürütme aracı yetenekleriyle 1 milyon token bağlam penceresine genişledi . Ancak hiçbiri, aracılı kodlama dışında genel olarak sınır ötesi olarak kabul edilmiyordu.
Alibaba, Qwen 3.8'i açıkça "yalnızca Fable 5'ten sonra" olarak konumlandırıyor . Bu iddia bağımsız değerlendirme altında doğrulanırsa, Qwen 3.8'i GPT-5.5'in ve DeepSeek V4'ün oldukça önüne koyar. Ancak sıfır doğrulanmış kıyaslama ile bu, kanıtlanmış bir gerçek değil, bir pazarlama iddiası olarak kalıyor. Anthropic'in Fable 5'i, Alibaba'nın kendi çerçevesine göre mevcut tanınan sınır lideri gibi görünüyor .
DeepSeek'in agresif fiyatlandırması, API maliyetlerinde bir dibe doğru yarışı tetikledi. V4-Flash'ın 0,14 $/M giriş fiyatı, herhangi bir Batılı sınır modelinden radikal biçimde daha ucuz. Alibaba henüz Qwen 3.8 fiyatlandırmasını belirlemedi, ancak Qwen 3.6 zaten agresif bir şekilde fiyatlandırılmıştı (~1,25 $/7,50 $ giriş/çıkış) .
DeepSeek V4 için açık ağırlıklı MIT lisansı, kendi kendine barındırmayı da mümkün kılıyor ve kapalı kaynak sağlayıcıların marjlarını daha da sıkıştırıyor . Bir analizin belirttiği gibi, pratik etki, "geliştiricilerin artık sınır ötesi yeteneklere (kodlama görevlerinde) GPT-5.5 veya Claude'un maliyetinin çok daha azıyla erişebilmesidir."