A AMD apresentou o Instella MoE em 24 de julho de 2026: um modelo de linguagem do tipo 'Mixture of Experts' com 16 bilhões de parâmetros, dos quais apenas 2,8 bilhões são ativados por token, treinado exclusivamente em... O modelo traz inovações como a 'Gated Multi head Latent Attention' (Gated MLA) e a técnica 'FarS...

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What are the key details of AMD's July 24 release of Instella-MoE, a fully open 16-billion-parame. Article summary: Here are the key verified details of AMD's Instella-MoE release, based primarily on the official AMD ROCm blog post (July 24, 2026) and corroborating news sources.. Topic tags: general, academic, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails
Em 24 de julho de 2026, a AMD anunciou o Instella-MoE, um modelo de linguagem do tipo 'Mixture of Experts' (MoE) totalmente aberto, com 16 bilhões de parâmetros, treinado do zero exclusivamente em GPUs AMD Instinct MI300X e MI325X, utilizando a pilha de software ROCm . O modelo ativa apenas 2,8 bilhões de parâmetros por token, o que o torna altamente eficiente, ao mesmo tempo que oferece desempenho competitivo em benchmarks. Este lançamento é um marco estratégico, demonstrando que o hardware e a pilha de software open source da AMD podem suportar o desenvolvimento de IA em larga escala, desde o pré-treinamento até o aprendizado por reforço, rivalizando com o ecossistema CUDA, da Nvidia
.
O Instella-MoE utiliza uma configuração de especialistas compartilhados e roteados, com 2 especialistas compartilhados sempre ativos e 6 especialistas roteados selecionados de um conjunto de 64 por token . O modelo é composto por 27 camadas de decodificação, cada uma com um tamanho oculto de 2.048
. Duas inovações arquiteturais se destacam:
O modelo também utiliza um objetivo de 'Multi-Token Prediction' (MTP) durante suas fases de pré-treinamento e treinamento intermediário .
Após um estágio de treinamento dedicado à extensão de contexto longo, o Instella-MoE suporta uma janela de contexto de 64 mil tokens .
A AMD publicou o pipeline de treinamento completo, que consiste em seis estágios sequenciais :
O modelo base Instella-MoE-16B-A3B alcançou uma pontuação média de 76,7 em benchmarks padrão, posicionando-se entre os principais modelos totalmente abertos em sua escala . Ele superou modelos como SmolLM3-3B e OLMo-3-7B, e competiu com modelos maiores, apesar de ativar apenas 2,8 bilhões de parâmetros por token
.
Em linha com seu compromisso com a IA aberta, a AMD disponibilizou todos os artefatos de treinamento :
Todos os artefatos estão disponíveis no Hugging Face sob o namespace amd/Instella-MoE-16B-A3B, licenciados sob uma 'Research RAIL (Responsible AI License)' para fins acadêmicos e de pesquisa .
O Instella-MoE é mais do que um simples lançamento de modelo — é uma prova direta de que a pilha de software ROCm e o hardware GPU Instinct da AMD podem suportar o desenvolvimento de IA de ponta, do pré-treinamento ao aprendizado por reforço, usando infraestrutura totalmente aberta. Ao entregar benchmarks competitivos contra os principais modelos open source treinados em hardware Nvidia, a AMD posiciona seu ecossistema como uma alternativa viável ao CUDA da Nvidia para pesquisa e desenvolvimento de IA em larga escala .
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
A AMD apresentou o Instella MoE em 24 de julho de 2026: um modelo de linguagem do tipo 'Mixture of Experts' com 16 bilhões de parâmetros, dos quais apenas 2,8 bilhões são ativados por token, treinado exclusivamente em...
A AMD apresentou o Instella MoE em 24 de julho de 2026: um modelo de linguagem do tipo 'Mixture of Experts' com 16 bilhões de parâmetros, dos quais apenas 2,8 bilhões são ativados por token, treinado exclusivamente em... O modelo traz inovações como a 'Gated Multi head Latent Attention' (Gated MLA) e a técnica 'FarSkip Collective', que acelerou o pré treinamento em 12,7%.
Todos os artefatos do modelo, incluindo pesos, configurações e código de inferência, estão disponíveis no Hugging Face sob a licença Research RAIL, posicionando o Instella MoE como um marco na estratégia da AMD para c...