AMD a présenté le 24 juillet 2026 Instella MoE, un modèle de langage à mixture d'experts (MoE) de 16 milliards de paramètres, dont seulement 2,8 milliards sont activés par token, entièrement entraîné sur des GPU AMD I... Le modèle introduit des innovations architecturales comme l'attention latente multi têtes à port...

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What are the key details of AMD's July 24 release of Instella-MoE, a fully open 16-billion-parame. Article summary: Here are the key verified details of AMD's Instella-MoE release, based primarily on the official AMD ROCm blog post (July 24, 2026) and corroborating news sources.. Topic tags: general, academic, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails
Le 24 juillet 2026, AMD a officialisé Instella-MoE, un modèle de langage de 16 milliards de paramètres à mixture d'experts (MoE), entièrement ouvert et entraîné de zéro sur ses GPU Instinct MI300X et MI325X, en s'appuyant sur la pile logicielle ROCm . Sa caractéristique principale ? Seulement 2,8 milliards de paramètres sont activés par token, ce qui le rend très efficace tout en offrant des performances compétitives. Cette annonce est un jalon stratégique : elle prouve que le matériel et les logiciels open source d'AMD peuvent soutenir le développement de l'IA à grande échelle, du pré-entraînement à l'apprentissage par renforcement, rivalisant ainsi avec l'écosystème dominant CUDA de Nvidia
.
Instella-MoE repose sur une configuration d'experts partagés et routés : 2 experts partagés toujours actifs et 6 experts routés, sélectionnés parmi un pool de 64 à chaque token . Le modèle compte 27 couches de décodeur avec une dimension cachée de 2 048
. Deux innovations architecturales se distinguent :
Le modèle utilise également un objectif de prédiction multi-tokens (MTP) pendant ses phases de pré-entraînement et d'entraînement intermédiaire .
Après une phase d'extension dédiée, Instella-MoE supporte un contexte de 64 000 tokens .
AMD a publié l'intégralité du pipeline d'entraînement, qui comprend six étapes séquentielles :
Le modèle de base Instella-MoE-16B-A3B a obtenu un score moyen de 76,7 sur des benchmarks standards, le plaçant parmi les meilleurs modèles entièrement ouverts de sa catégorie . Il surpasse notamment SmolLM3-3B et OLMo-3-7B, et rivalise avec des modèles plus gros, malgré l'activation de seulement 2,8 milliards de paramètres par token
.
Conformément à son engagement pour une IA ouverte, AMD a rendu publics tous les artéfacts d'entraînement :
Tous ces éléments sont disponibles sur Hugging Face sous l'espace de noms amd/Instella-MoE-16B-A3B, avec une licence Research RAIL (Responsible AI License) pour une utilisation académique et de recherche .
Instella-MoE est bien plus qu'un simple modèle : c'est une preuve de concept que la pile logicielle ROCm d'AMD et ses GPU Instinct peuvent prendre en charge le développement d'IA de pointe, du pré-entraînement à l'apprentissage par renforcement, en utilisant une infrastructure entièrement ouverte. En offrant des performances compétitives face aux meilleurs modèles open source entraînés sur du matériel Nvidia, AMD positionne son écosystème comme une alternative crédible à CUDA pour la recherche et le développement en IA à grande échelle .
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
AMD a présenté le 24 juillet 2026 Instella MoE, un modèle de langage à mixture d'experts (MoE) de 16 milliards de paramètres, dont seulement 2,8 milliards sont activés par token, entièrement entraîné sur des GPU AMD I...
AMD a présenté le 24 juillet 2026 Instella MoE, un modèle de langage à mixture d'experts (MoE) de 16 milliards de paramètres, dont seulement 2,8 milliards sont activés par token, entièrement entraîné sur des GPU AMD I... Le modèle introduit des innovations architecturales comme l'attention latente multi têtes à porte (Gated MLA) et FarSkip Collective, qui a accéléré le pré entraînement de 12,7 %.
Tous les artéfacts (poids du modèle à chaque étape, configurations, points de contrôle intermédiaires et code d'inférence) sont disponibles sur Hugging Face sous licence Research RAIL, faisant d'Instella MoE une vitri...