AMD, 24 Temmuz 2026'da Instella MoE'yi duyurdu: Tamamen açık kaynak, 16 milyar parametrelik bir Uzman Karışımı (MoE) dil modeli. Model, Gated Multi head Latent Attention (Gated MLA) ve FarSkip Collective gibi mimari yenilikler içeriyor.

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What are the key details of AMD's July 24 release of Instella-MoE, a fully open 16-billion-parame. Article summary: Here are the key verified details of AMD's Instella-MoE release, based primarily on the official AMD ROCm blog post (July 24, 2026) and corroborating news sources.. Topic tags: general, academic, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails
24 Temmuz 2026'da AMD, Instella-MoE'yi duyurdu. Bu, tamamen açık kaynak, 16 milyar parametrelik bir Uzman Karışımı (MoE) dil modeli olup, baştan sona AMD Instinct MI300X ve MI325X GPU'ları ve ROCm yazılım yığını kullanılarak eğitildi . Model, her bir token için yalnızca 2.8 milyar parametreyi aktif hale getirerek yüksek verimlilik sunarken, kıyaslama testlerinde rekabetçi bir performans sergiliyor. Bu sürüm, AMD'nin donanım ve açık kaynak yazılım yığınının, ön eğitimden pekiştirmeli öğrenmeye kadar büyük ölçekli yapay zeka geliştirmeyi destekleyebileceğini ve hakim NVIDIA CUDA ekosistemine meydan okuyabileceğini gösteren stratejik bir dönüm noktasıdır
.
Instella-MoE, paylaşımlı artı yönlendirilmiş uzman konfigürasyonu kullanır. Her bir token için 2'si her zaman aktif paylaşımlı uzman ve 64'lük bir havuzdan seçilen 6 yönlendirilmiş uzman olmak üzere toplam 27 kod çözücü katmanından oluşur . Modeldeki iki önemli mimari yenilik şunlardır:
Model ayrıca ön eğitim ve orta eğitim aşamalarında Multi-Token Prediction (MTP) hedefini kullanır .
Özel bir uzun bağlam genişletme eğitim aşamasının ardından Instella-MoE, 64K token uzunluğunda bir bağlamı destekler .
AMD, altı aşamadan oluşan tam eğitim hattını yayınladı :
Instella-MoE-16B-A3B temel modeli, standart kıyaslamalarda 76.7 ortalama puan elde ederek, kendi ölçeğindeki en iyi tamamen açık modeller arasında yer aldı . Bildirilenlere göre, SmolLM3-3B ve OLMo-3-7B modellerini geride bırakırken, token başına yalnızca 2.8 milyar parametreyi aktif hale getirmesine rağmen daha büyük modellerle rekabet etti
.
AMD, açık yapay zekaya olan bağlılığı doğrultusunda tüm eğitim yapıtlarını açıkça yayınladı :
Tüm yapıtlar, Hugging Face'te amd/Instella-MoE-16B-A3B ad alanında mevcut olup, Araştırma RAIL (Sorumlu Yapay Zeka Lisansı) kapsamında akademik ve araştırma amaçları için lisanslanmıştır .
Instella-MoE, bir model sürümünden daha fazlasıdır. Bu, AMD'nin ROCm yazılım yığını ve Instinct GPU donanımının, tamamen açık bir altyapı kullanarak ön eğitimden RL'ye kadar sınır ölçeğinde yapay zeka gelişimini destekleyebileceğinin doğrudan bir kanıtıdır. NVIDIA donanımında eğitilmiş önde gelen açık kaynak modellere karşı rekabetçi kıyaslamalar sunarak AMD, ekosistemini büyük ölçekli yapay zeka araştırma ve geliştirmesi için NVIDIA'nın CUDA'sına uygun bir alternatif olarak konumlandırıyor .
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
AMD, 24 Temmuz 2026'da Instella MoE'yi duyurdu: Tamamen açık kaynak, 16 milyar parametrelik bir Uzman Karışımı (MoE) dil modeli.
AMD, 24 Temmuz 2026'da Instella MoE'yi duyurdu: Tamamen açık kaynak, 16 milyar parametrelik bir Uzman Karışımı (MoE) dil modeli. Model, Gated Multi head Latent Attention (Gated MLA) ve FarSkip Collective gibi mimari yenilikler içeriyor.
Tüm yapay zeka eserleri (eğitim aşamalarının ağırlıkları, konfigürasyonlar, ara kontrol noktaları ve çıkarım kodu) Hugging Face üzerinde Research RAIL lisansıyla yayınlandı.