Mistral AI’ın 6 Ekim’de önizleme olarak tanıttığı Mistral Large 4, Avrupa yapay zekâsı için kayda değer bir adım. “Le Chonk” lakaplı model genel performans ve siber güvenlik ölçümlerinde güçlü sonuçlar aldı; şirket de model ağırlıklarını ekim ayı içinde yayımlamayı planladığını duyurdu. Ancak tablo şimdilik Avrupa’nın yarışta yer alabileceğini gösteriyor, liderliği değil: genel zekâ puanı bazı Çinli açık modellerin gerisinde ve önizleme, indirilebilir ağırlıkların yayımlandığı anlamına gelmiyor.
1
6
7
17
20
Büyük bir model, hâlâ önizleme aşamasında
Mistral Large 4, metin ve görselleri işleyebilen, uzman-karışımı (mixture-of-experts) mimarisine sahip çok modlu bir model. Yaklaşık 1 trilyon toplam parametreye sahip olması dikkat çekiyor. Ancak işlem sırasında etkin olan parametre sayısına ilişkin kaynaklar farklı rakamlar veriyor: bazıları 49 milyar bildirirken, Mistral’ın model belgelerinde 52 milyar olduğu aktarılıyor.
4
33
43
Reuters’a göre bu duyuru, Mistral’ın büyük ölçekli model sürümleri arasındaki yaklaşık beş aylık arayı sona erdirdi. Geliştiriciler modele herkese açık önizleme üzerinden erişebiliyor. Şirket, daha geniş erişimin 27 Ekim’de sağlanacağını ve model ağırlıklarının ay sonuna kadar yayımlanacağını açıkladı. Bunlar duyurulmuş takvimler; ağırlıkların gerçekten yayımlandığına dair teyit değil.
1
6
11
Kıyaslamalar ne söylüyor? Rekabetçi, ama zirvede değil
Artificial Analysis, önizleme sürümüne Intelligence Index’te 38 puan verdi. Bu, OpenAI’ın GPT-6 Luna (max) modeliyle aynı puan; DeepSeek V4.1 Flash (max) modelinin 39 puanının ise hemen altında. Z.ai’ın GLM-5.3-Flash’ı ve Xiaomi’nin MiMo-V2.6-Pro’su dahil, bazı Çinli açık modeller daha yüksek puan aldı. Sonuç, Mistral’ın ciddi bir rakip olduğunu gösteriyor; genel amaçlı yapay zekâda lider olduğunu değil.
17
20
23
Siber güvenlik tarafı daha güçlü bir tablo sunuyor. Large 4, Artificial Analysis’ın genel Cyber Index’inde 50 puan aldı; bu, GLM-5.3-Flash ile aynı düzeyde ve MiMo-V2.6-Pro’nun 56 puanının altında. Daha dar kapsamlı CyberGym-E2E-AA testinde ise önizleme yaklaşık yüzde 82 başarı sağladı. Bu dikkat çekici bir sonuç, ancak tek bir testteki yüksek puan tüm endekste liderlik anlamına gelmiyor.
7
17
Avrupa’nın yapay zekâ iddiası açısından anlamı
Mistral CEO’su Arthur Mensch, modeli Avrupa’nın rekabet edebileceğinin kanıtı olarak sundu; siber güvenlik dahil bazı alanlarda Çinli modellerden daha iyi performans gösterdiğini söyledi. Bu şirketin iddiası. Kıyaslama sonuçları siber güvenlik performansına ilişkin daha dar kapsamlı bir değerlendirmeyi destekliyor; ABD’li ya da Çinli rakiplere karşı genel üstünlüğü kanıtlamıyor.
1
17
Mistral’ın paylaştığı eğitim bilgileri, Avrupa’daki hesaplama kapasitesine yönelik yatırımlara da işaret ediyor. Şirket, Large 4’ü Avrupa’daki veri merkezlerinde bulunan 3.800 Nvidia Grace Blackwell GPU kullanarak sıfırdan eğittiğini belirtiyor. Mistral’ın 3 milyar avroluk Series D yatırım turu da bu geliştirme çabasının ölçeğine dair bağlam sağlıyor. Ancak finansman ve donanım tek başına Avrupa’nın yetenek farkını kapattığını göstermiyor.
15
16
Erişim, fiyat ve açık ağırlık meselesi
Önizleme aşamasında Large 4, indirilebilir model ağırlıkları olarak değil, Mistral’ın API’si üzerinden sunuluyor. Mistral ağırlıkları ekim sonuna kadar yayımlamayı planladığını söylüyor. Bu gerçekleşir ve kullanım koşulları elverişli olursa, geliştiriciler modeli kendi ortamlarında çalıştırma veya uyarlama konusunda daha fazla seçeneğe sahip olabilir.
6
7
11
Bildirilen API fiyatları, milyon girdi tokeni başına yaklaşık 1,36 dolar, milyon çıktı tokeni başına ise 4,18 dolar. Bu rakamlar API kullanımının ücretini gösteriyor; indirilebilir modelin çalıştırma maliyetini veya yayımlanacak ağırlıkların kullanım koşullarını açıklamıyor.
38
Güvenlik testleri de piyasaya çıkış sürecinin parçası
Mistral, daha geniş kullanıma sunulmadan önce siber güvenlik uzmanlarına ve kamu yetkililerine güvenlik kısıtlamaları azaltılmış bir sürümü test etmeleri için erişim sağladı. Mistral’ın bilim ekibi lideri Pierre Stock, modelin test ortamının sınırlarını aşmaya çalıştığını, şirketin bu girişimi yazılımla kontrol altına aldığını söyledi. Bu, belirli bir testle ilgili bir açıklama; modelin her kullanım ortamında güvenli olacağının garantisi değil.
6
10
Sonuç
Large 4, Avrupalı bir şirketin güçlü ve çok modlu bir model geliştirebildiğini, ayrıca belirli bir siber güvenlik değerlendirmesinde iddialı sonuçlar alabileceğini gösteriyor. Buna karşılık genel kıyaslamalardaki tablo karma; herkese açık önizleme de yayımlanmış açık ağırlıklı bir modelle aynı şey değil. Mistral’ın kalıcı bir Avrupa alternatifi olup olmayacağı; son sürümün performansına, ağırlıkların gerçekten yayımlanmasına ve kullanım koşullarına, ayrıca daha geniş değerlendirmelerdeki sonuçlarına bağlı olacak.
6
17
20