Efter en särskild fas med långkontextutökning stöder Instella-MoE ett 64K‑token långt kontextfönster .
Instella‑MoE‑16B‑A3B basmodell uppnådde ett genomsnittligt resultat på 76,7 i standardriktmärken, vilket placerar den bland de främsta helt öppna modellerna i sin storleksklass . Den rapporteras överträffa SmolLM3‑3B och OLMo‑3‑7B och konkurrerar med större modeller trots att den bara aktiverar 2,8 miljarder parametrar per token
.
Alla artefakter finns på Hugging Face under namnområdet amd/Instella‑MoE‑16B‑A3B och är licensierade under en Research RAIL (Responsible AI License) för akademiskt bruk och forskning .
Instella-MoE är mer än bara en modell – det är ett konkret bevis på att AMD:s ROCm‑programvara och Instinct‑hårdvara kan stödja AI‑utveckling i toppklass, från förträning till förstärkningsinlärning, med helt öppen infrastruktur. Genom att leverera konkurrenskraftiga riktmärken mot ledande öppna modeller som tränats på Nvidia‑hårdvara positionerar AMD sitt ekosystem som ett verkligt alternativ till Nvidias CUDA för storskalig AI‑forskning och utveckling .