Alibaba'nın Qwen 3.7 Max'i, Mayıs 2026'da piyasaya sürüldü. 2,8 trilyon parametreli bir uzman karışımı (MoE) amiral gemisi olan model, kıyaslamalarda Anthropic'in Fable 5'ine denk veya onu aşarken, maliyeti bunun yaklaşık altıda biri kadardı . Yüksek hacimli kullanım için Alibaba'nın Qwen3.6 Flash'ı, milyon giriş token'ı başına sadece $0.19'a mal oluyor .
Zhipu AI'nın GLM-5.2'si, 13 Haziran 2026'da piyasaya sürüldü. 744 milyar parametreli bir MoE mimarisi (40 milyarı aktif) ve 1 milyon token'lık bağlam penceresi ile gelen model, Artificial Analysis Intelligence Index'te 1 numaralı açık ağırlıklı model seçildi . Milyon token başına giriş $1.40 ve çıkış $4.40 fiyatıyla ABD'li sınır modellerini yaklaşık 5-6 kat daha ucuza geçiyor .
Moonshot AI'nın Kimi K3'ü, 16 Temmuz 2026'da tanıtıldı. Şu ana kadar duyurulmuş en büyük açık ağırlıklı yapay zeka sistemi olan model, 2,8 trilyon toplam parametreye, 1 milyon token bağlam penceresine ve doğal görsel anlama yeteneğine sahip . Moonshot, tam açık ağırlıkları 27 Temmuz 2026'ya kadar yayınlama sözü verdi . API fiyatlandırması, milyon giriş token'ı için $3 ve çıkış için $15 ile Çinli modeller arasında en pahalısı olsa da, karşılaştırılabilir ABD tekliflerinin hâlâ altında kalıyor .
Çin ve ABD sınır modelleri arasındaki maliyet farkı aşırı boyutlarda:
| Model | Giriş Fiyatı (1M token başına) | Çıkış Fiyatı (1M token başına) |
|---|---|---|
| DeepSeek V4-Flash | $0.14 | $0.28 |
| Alibaba Qwen3.6 Flash | $0.19 | $1.13 |
| Zhipu GLM-5.2 | $1.40 | $4.40 |
| Alibaba Qwen3.7 Max | $1.25 | $3.75 |
| Moonshot Kimi K3 | $3.00 | $15.00 |
| Anthropic Claude Fable 5 (tahmini) | ~$15.00 | ~$50.00 |
| OpenAI GPT-5.5 (tahmini) | ~$5.00 | ~$15.00 |
Kaynaklar:
Rakamlar hikayeyi anlatıyor: DeepSeek'in V4-Flash'ı, kıyaslama testi başına ortalama 3 sente mal olurken, bu rakam GPT-5.5 için $1.86 ve Claude Fable 5 için $3.33 . Girişimci Marc Andreessen, GLM-5.2'nin "herhangi bir taviz vermeden Amerikan büyük laboratuvar modelleriyle rekabet eden ve çoğu zaman onları geçen ilk Çin yapay zeka modeli" olduğunu belirtti .
Çin'in stratejisinin ikinci kolu ise açık ağırlıklı yayın. GLM-5.2 (MIT lisansı), Kimi K3 (vaat edilen Değiştirilmiş MIT lisansı) ve Qwen serisi gibi modeller ücretsiz olarak indirilebiliyor. Bu, herkesin token başına herhangi bir ücret ödemeden modeli çalıştırabileceği, değiştirebileceği veya ince ayar yapabileceği anlamına geliyor . Bu "modelleri bedavaya verme" stratejisi, ABD'li firmaların yüksek fiyatlar talep ettiği orta pazarı boşaltıyor .
Önemli bir dönüm noktası, Haziran 2026'da Trump yönetiminin ulusal güvenlik gerekçesiyle Anthropic'ten en gelişmiş iki yapay zeka sistemi olan Fable ve Mythos'un operasyonlarını durdurmasını istemesiyle yaşandı . İki hafta içinde Z.ai, Anthropic'in ürünlerine çok yakın bir model çıkardı: daha uygun fiyatlı ve ABD kısıtlamaları olmadan . Çinli şirketler bu açığı gördü ve doldurmak için harekete geçti .
ABD'nin tepkisi parçalı oldu. Anthropic, hükümet talebine uydu. Google'ın ise Çin modelleri arasındaki farkı kapatırken, Gemini modelinin en son sürümüyle zorlandığı bildiriliyor . Henüz koordineli bir ABD politikası önlemi açıklanmadı. Analistler, çipler üzerindeki ihracat kontrollerinin, Çinli firmaların kaba hesaplama gücü yerine mimari verimlilik (MoE, hibrit dikkat gibi) yoluyla rekabetçi performans elde etmelerini engellemediğini belirtiyor .
Bu arada ABD'li şirketler, maliyet nedenleriyle giderek artan oranda Çin modellerini test ediyor ve benimsiyor; bu da Amerikan yapay zeka laboratuvarlarının iç saha avantajını daha da aşındırıyor .