NIST'in CAISI değerlendirmesindeki bağımsız kıyaslamalar, DeepSeek V4 Pro'nun OpenAI ve Anthropic'in en iyileriyle doğrudan rekabet ettiğini gösteriyor :
| Kıyaslama | DeepSeek V4 Pro | OpenAI GPT-5.5 | Anthropic Opus 4.6 |
|---|---|---|---|
| GPQA Diamond (bilimsel akıl yürütme) | %90.1 | %96 | %91 |
| MMLU-Pro (geniş bilgi) | %87.5 | ~%92 | %89.1 |
| SWE-bench Verified (kodlama) | %80.6 | ~%75 | ~%78 |
Ek performans öne çıkanları:
Çin yapay zekasının finansal hikayesi, teknik hikayesi kadar dramatik:
Alibaba (Qwen), açık kaynak ekosistemi stratejisi izliyor: modellerin çoğu Apache 2.0 lisansıyla yayınlanıyor, ince ayar yapması kolay ve kendi sunucusunda barındırması ücretsiz . Bu, Qwen'i Hugging Face'te en çok indirilen model ailesi haline getirdi. Bunun takası ise para kazanma zorluğu; New York Times'ın bildirdiğine göre Alibaba'nın yapay zekası büyük bir başarı ancak doğrudan para kazanması zor
. Ancak Alibaba, Nisan 2026'da amiral gemisi Qwen 3.6 Max Preview'i kapalı, tescilli bir API modeli olarak yayınlayarak bir dönüş sinyali verdi
.
DeepSeek, hibrit bir yaklaşım benimsiyor: V4 ağırlıklarını MIT lisansı altında açık kaynak olarak sunarken (1,6 trilyon parametreli Uzmanlar Karışımı, 49 milyar aktif parametre), aynı zamanda ucuz bir API katmanı da sağlıyor . Mimarisi (oldukça seyrek aktivasyonlu MoE), öncü performansı önemli ölçüde daha düşük çıkarım maliyetiyle mümkün kılıyor.
Batılı şirketler (OpenAI, Anthropic, Google) ise ağırlıklı olarak kapalı, tescilli API'lere ve yüksek fiyatlandırmaya güveniyor. OpenAI ve Anthropic, baskıya yanıt olarak daha ucuz "nano" ve "mini" katmanlar yayınladı ancak hiçbiri DeepSeek'in öncü sınıf fiyat-performans oranını yakalayamıyor .