Ox Alpha, Z.ai’nin 26 Ağustos 2026’da kimliğini açıkladığı GLM 5.3 Flash modeliydi; model 20 26 Ağustos arasında anonim olarak test edildi. GLM 5.3 Flash, belirteç başına 18 milyar parametreyi etkinleştiren 320 milyar parametreli bir uzman karışımı mimarisi kullanıyor; API fiyatı girişte milyon belirteç başına 0,15...
Research answer

Create a landscape editorial hero image for this Studio Global article: What is Z.ai’s GLM-5.3-Flash, and how did it resolve the week-long mystery surrounding the anonymously released “Ox Alpha” model—covering it. Article summary: GLM-5.3-Flash is Z.ai (Zhipu AI)’s open-weight, natively multimodal GLM-5 model—and the company confirmed on August 26 that it was the previously anonymous “Ox Alpha.” The reveal turned a six-day public stress test into . Topic tags: general, general web, user generated, documentation, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, water
Altı gün boyunca geliştiriciler, arkasındaki şirketi bilmeden Ox Alpha adlı güçlü bir yapay zekâ modelini kullandı. Model, 20 Ağustos 2026’da OpenRouter ve OpenCode üzerinde ücretsiz, geliştiricisi belirtilmemiş bir seçenek olarak ortaya çıktı. Bir milyon belirteçlik bağlam penceresi ile metin, görüntü ve video girdilerini desteklemesi kısa sürede dikkat çekti. 26 Ağustos’ta Z.ai, Ox Alpha’nın aslında Zhipu AI’nin uluslararası markası Z.ai tarafından geliştirilen GLM-5.3-Flash olduğunu doğruladı. 2
5
9
Bu açıklama, anonim bir kamu testini aynı zamanda ürün lansmanına dönüştürdü. GLM-5.3-Flash; MIT lisansı altında açık ağırlıklarla yayımlandı, düşük API fiyatlarıyla sunuldu ve uzun bağlamlı kodlama ile yapay zekâ ajanı iş akışlarını daha düşük maliyetle çalıştırmayı hedefleyen bir mimari getirdi. 6
7
9
Ox Alpha, OpenRouter ve OpenCode’da geliştiricisi açıklanmadan listelendi. Fiyatı sıfır dolardı; bağlam sınırı 1.048.576 belirteçti ve model metin, görüntü ve video girdilerini kabul ediyordu. Geliştiriciler modeli kodlama ajanlarında, terminal görevlerinde ve büyük kod depolarıyla yürütülen uzun bağlamlı çalışmalarda denedi. 4
5
8
Topluluk kısa sürede modelin kimliğine ilişkin ipuçlarını araştırmaya başladı. GLM modellerini andıran belirteçleyici davranışı ve bazı API hata kalıpları, geliştiricileri modelin arkasında Zhipu AI’nin bulunabileceği sonucuna yöneltti. Z.ai sonunda bu bağlantıyı kendisi doğruladı ve anonim dağıtımın resmi lansmandan önce gerçek kullanıcı geri bildirimi toplamak amacı taşıdığını söyledi. 5
9
Önizleme dönemi olağanüstü bir kullanım hacmi yarattı. Aynı döneme ilişkin farklı raporlardan biri altı günde 42 trilyon belirteç işlendiğini, bir diğeri ise yaklaşık 44 trilyon belirteç ve 503.000 OpenCode kullanıcısı bulunduğunu aktardı. Bu rakamlar farklı ölçüm tarihleri ve raporlara ait olduğundan tek bir bağımsız biçimde doğrulanmış toplam olarak değerlendirilmemeli. 8
11
16
GLM-5.3-Flash; kodlama, uzun soluklu yapay zekâ ajanı görevleri ve çok modlu iş akışları için geliştirilen, açık ağırlıklı bir model. Z.ai, modeli GLM-5 ailesinin ilk yerel çok modlu modeli olarak tanımlıyor. Dokümantasyona göre görsel girdileri ve bir milyon belirteçlik bağlam penceresini destekliyor. Böylece tek bir göreve büyük kod tabanları, belgeler, ekran görüntüleri ve diğer girdiler dâhil edilebiliyor. 7
20
Modelin dikkat çeken teknik özelliği, 320 milyar parametreli uzman karışımı (MoE) mimarisi kullanması ve her belirteç için 18 milyar parametreyi etkinleştirmesi. Basitçe söylemek gerekirse model, büyük bir öğrenilmiş kapasite havuzuna sahip olsa da her adımda bu havuzun yalnızca ilgili bölümünü çalıştırıyor. Z.ai ayrıca çıkarım sırasında hesaplama ve anahtar-değer önbelleği gereksinimini azaltmak için seyrek ve doğrusal dikkati birleştirdiğini belirtiyor. 6
20
“Flash” adlandırması da buradan geliyor. Model toplam parametre sayısı bakımından küçük değil; ancak aynı büyüklükteki yoğun bir modele kıyasla sunucu maliyetini düşürmeyi amaçlıyor. Bu mimari her belirteç için gereken hesaplama miktarını azaltabilir. Gerçek hız ve maliyet ise donanıma, model sunum yazılımına, toplu işlemeye ve iş yükünün yapısına bağlı olmaya devam eder.
Z.ai, GLM-5.3-Flash’in DeepSWE v1.1 testinde 63,4 puan aldığını; GLM-5.2’nin ise 46,2 puanda kaldığını bildiriyor. Şirket ayrıca Claude Opus 4.8 ile yaptığı kurum içi karşılaştırmada 29,0’a karşı 29,5 sonuçlarını paylaşıyor. 7
8
Bu sonuçlar önemli sinyaller verse de modeller için evrensel bir kalite sıralaması anlamına gelmiyor. DeepSWE sonucu şirket tarafından bildirilen bir kıyaslama iddiası; Claude karşılaştırması ise kurum içi bir değerlendirme olarak sunuluyor. Kullanılan istemler, araçlar, ek yazılımlar, test verilerinin daha önce görülüp görülmediği ve puanlama yöntemi sonuçları ciddi biçimde etkileyebilir. Modelin kapalı, öncü sistemlerle genel olarak eşdeğer sayılabilmesi için bağımsız ve tekrarlanabilir testlere ihtiyaç var.
Geliştiriciler açısından daha somut vaat, iş akışına uyum. Model; büyük depoları inceleyebiliyor, görsel bağlamı kullanabiliyor ve uzun süren ajan görevlerinde geçmişi tekrar tekrar özetlemek zorunda kalmadan çalışabiliyor. Ancak üretim ortamındaki başarı yalnızca kıyaslama puanına değil; güvenilirlik, araç kullanımı, gecikme süresi ve hatalardan toparlanma becerisine de bağlı.
Z.ai, API için liste fiyatını girişte milyon belirteç başına 0,15 dolar, çıkışta ise 0,50 dolar olarak açıkladı. Şirketin dokümantasyonunda daha sonra geçici yüzde 50 indirim yer aldı; belirtilen kampanya döneminde fiyatlar sırasıyla 0,075 dolar ve 0,25 dolara indi. 2
Model ağırlıkları Hugging Face üzerinde MIT lisansı ile yayımlandı. Bu lisans, yalnızca barındırılan bir hizmet olarak sunulan modellere kıyasla daha serbest bir kullanım çerçevesi sağlıyor. MIT lisansı genel olarak ticari yeniden kullanıma ve değişikliğe izin verir; ancak ekiplerin gerçek lisans metnini, model koşullarını, bağımlılıkları, donanım gereksinimlerini ve seçtikleri dağıtım biçimine ilişkin yükümlülükleri ayrıca incelemesi gerekir. 2
9
Z.ai dokümantasyonu GLM-5.3-Flash’i geliştirici ve kodlama planı ekosisteminde de listeliyor. API referansı ise metin, görüntü, ses, video ve dosya gibi çok modlu girdilerle sohbet tamamlama işlemlerini ve araç kullanımını destekliyor. 17
20
21
Lansmanın modelin kendisinden bağımsız ikinci bir boyutu daha var. Z.ai, anonim Ox Alpha önizlemesinin tamamen Çin yapımı yapay zekâ hızlandırıcıları üzerinde çalıştırıldığını ve şirketin özelleştirilmiş, SGLang tabanlı bir sunum altyapısı kullandığını açıkladı. Z.ai’nin mühendislik materyalleri, bu altyapıyı yerli donanım üzerinde çıkarım verimliliğini artırma çabası olarak sunuyor.
Bazı ikincil haberlerde özelleştirilmiş altyapının uçtan uca performansı üç katına çıkardığı iddiası tekrarlanıyor. Ancak kullanılan hızlandırıcı filosu, performans karşılaştırmasının tam koşulları ve dağıtımın yabancı bileşenlerden ne ölçüde bağımsız olduğu mevcut kaynaklarda bağımsız biçimde denetlenmiş değil. 10
Bu ayrım önemli. İddia doğrulanırsa, ABD’nin çip ihracatı kısıtlamaları altında Çin’in yetenekli yapay zekâ hizmetleri geliştirme çabaları açısından stratejik bir anlam taşıyabilir. Şimdilik bunu, yerli donanımın daha geniş altyapı açığını kapattığını kanıtlayan kesin bir sonuçtan ziyade, şirketin dikkat çekici bir açıklaması olarak görmek daha doğru.
Ox Alpha yaklaşımı, geleneksel bir lansmanın kolayca sağlayamayacağı türden büyük ve karmaşık bir kullanım verisi sundu. Kullanıcılar modeli bir pazarlama teknik özellikler sayfasına bakarak değil, ücretsiz ve alışılmadık derecede yetenekli olduğu için kodlama ajanlarında ve uzun bağlamlı iş akışlarında denedi. Z.ai, amacın resmi çıkış öncesinde geri bildirim toplamak olduğunu söyledi. 5
9
Bu yöntem, şirketin açık ağırlık dağıtım stratejisiyle de örtüşüyor. Z.ai; izinleri geniş bir lisansı, düşük API fiyatlarını ve geliştiricilere açık erişimi bir araya getirerek denemeyi teşvik edebilir, geri bildirim toplayabilir ve model etrafında geleneksel kapalı model aboneliklerinden bağımsız bir kullanım alanı oluşturabilir. Daha önceki anonim model denemeleri arasında adı geçen Pony Alpha, bunun tek seferlik bir fikir olmayabileceğini düşündürüyor; ancak mevcut kaynaklar bu önceki proje hakkında sınırlı bilgi sunuyor.
GLM-5.3-Flash tek başına Z.ai’nin genel yapay zekâ sınırını belirlediğini kanıtlamıyor. Modelin en güçlü dayanakları; yayımlanmış teknik özellikler, dikkat çekici bir kamu önizlemesi ve şirketin paylaştığı kıyaslama ile altyapı iddialarının birleşimi. Kodlama, çok modlu akıl yürütme, araç kullanımı, gecikme ve güvenilirlik alanlarında bağımsız değerlendirmeler ile uzun süreli üretim kullanımı belirleyici olacak.
Buna rağmen rekabet sinyali net. Bir milyon belirteçlik bağlam penceresi, yerel çok modlu girdi, açık ağırlıklar ve milyon belirteç başına sentlerle ölçülen API fiyatları; pahalı kapalı sistemlerin ekonomisi üzerinde baskı oluşturuyor. Lansman ayrıca anonim önizlemelerin aynı anda hem gerçek dünya stres testi hem de dağıtım motoru olarak kullanılabileceğini gösteriyor.
Ox Alpha gizemi çözüldü: Model, Z.ai’nin GLM-5.3-Flash’iydi. Bundan sonraki soru artık adli bir araştırmadan çok pratik bir konu: Modelin düşük maliyet ve uzun bağlam vaatleri, ücretsiz ve viral önizlemeden tekrarlanabilir, üretim kalitesinde iş yüklerine geçildiğinde ne kadar sağlam kalacak?
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Ox Alpha, Z.ai’nin 26 Ağustos 2026’da kimliğini açıkladığı GLM 5.3 Flash modeliydi; model 20 26 Ağustos arasında anonim olarak test edildi.
Ox Alpha, Z.ai’nin 26 Ağustos 2026’da kimliğini açıkladığı GLM 5.3 Flash modeliydi; model 20 26 Ağustos arasında anonim olarak test edildi. GLM 5.3 Flash, belirteç başına 18 milyar parametreyi etkinleştiren 320 milyar parametreli bir uzman karışımı mimarisi kullanıyor; API fiyatı girişte milyon belirteç başına 0,15 dolar, çıkışta 0,50 dolar olarak duyuruldu.
Bir milyon belirteçlik bağlam penceresi, metin görüntü video girdileri, açık ağırlıkları ve düşük fiyatı; modeli özellikle kodlama ve uzun süreli yapay zekâ ajanı görevleri için öne çıkarıyor.