Metan Muse Glimmer (julkaistu 10.8.2026) on 29,6 miljardin parametrin avoimen painon agenttimalli (Apache 2.0), joka toimii täysin yhdellä kuluttajan näytönohjaimella – ilman pilviyhteyttä. Muse Spark mallista tislattu Glimmer on optimoitu paikallisiin, aina päällä oleviin agenttityönkulkuihin: suunnittelu, työkaluj...
Research answer

Create a landscape editorial hero image for this Studio Global article: What is Meta's Muse Glimmer, a 30-billion-parameter open-weight AI model, and what are its key features, specifications (including offline c. Article summary: I need to verify this information about a model called "Muse Glimmer" from Meta. Let me search for it. Topic tags: general, general web, user generated, documentation, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustra
10. elokuuta 2026 Meta Superintelligence Labs julkaisi Muse Glimmerin – noin 29,6 miljardin parametrin avoimen painon tekoälymallin, joka toimii täysin yhdellä kuluttajan näytönohjaimella ilman pilviyhteyttä . Se on Metan ensimmäinen avoimen painon julkaisu yli vuoteen, mikä merkitsee paluuta avoimen lähdekoodin AI-juurille pettymystä herättäneen Llama 4:n jälkeen
.
Muse Glimmer on tiivis kausaalimuunnin (ei Mixture-of-Experts), jossa on erillinen noin 1,8 miljardin parametrin ViT-G/14-havaintoenkooderi multimodaalista syötettä varten . Siinä on 52 kerrosta, piilotettu ulottuvuus 6 656, 32 kyselypäätä ja 16:1 Grouped Query Attention -malli
.
Täystarkkuusmalli vaatii noin 55 Gt VRAM-muistia, mutta Meta toimittaa sen 4-bittisenä kvantisoituna, jolloin malli mahtuu alle 20 Gt:een .
Meta toimittaa kaksi kvantisoitua julkaisukokoonpanoa, molemmat K-Quant-menetelmällä ja mitattuna 15 vertailuarvossa :
Riippumattomat laboratoriot eivät ole vielä toistaneet näitä kokonaisheikennysväitteitä .
Ratkaistakseen 30 miljardin parametrin mallin paikallisen käytön viiveongelman Meta yhdistää Muse Glimmeriin DFlashin – pienen viisikerroksisen spekulatiivisen dekoodauksen luonnostelijan, joka ehdottaa kerralla 16 tokenin lohkoja, jotka päämalli sitten tarkistaa rinnakkain .
Meta raportoi seuraavat läpäisynopeudet 17 Gt:n kvantisoidulla mallilla eräkoko 1 ja ahne dekoodaus :
| Laitteisto | Perustaso (tok/s) | DFlashin kanssa (tok/s) | Nopeutus |
|---|---|---|---|
| NVIDIA RTX 5090 | 74,9 | 233,4 | 3,1x |
| Apple M5 Max | 26,6 | 50,2 | 1,9x |
| Apple M4 Max | 23,7 | 37,8 | 1,6x |
SGLang raportoi 236,4 tok/s samalla RTX 5090 -laitteistolla erillisessä päivä-0-mittauksessa . Varhaiset riippumattomat testit RTX 5090:lla ja llama.cpp:llä tuottavat joskus alhaisempia lukemia (esim. ~137 tok/s), mikä viittaa siihen, että 233+ tok/s -luku vaatii tiettyjä optimointeja
.
Muse Glimmer ei ole ensisijaisesti keskustelubotti – se on paikallinen tekoälyagentti, joka on suunniteltu autonomisiin työnkulkuihin . Meta on nimenomaisesti virittänyt sen suunnittelemaan, kutsumaan työkaluja ja palautumaan omista virheistään
. Se tukee natiivisti Model Context Protocol (MCP) -protokollaa ja integroituu suosittuihin agenttikehyksiin
.
Keskeisiä käyttötapauksia ovat: funktiokutsut, paikallinen koodaus, pitkät työkaluistunnot, LLM-tuomariarviointi, dokumenttianalyysi ja henkilökohtaiset avustajat .
Meta julkaisi suorat vertailut Googlen Gemma 4 31B:tä ja Alibaban Qwen 3.6 27B:tä vastaan (molemmat ajettuna ajattelu-/päättelytilassa) :
Muse Glimmer johtaa useimmissa agenttivertailuarvoissa, mukaan lukien MCP Atlas (75,5 vs. Qwenin 62,5) ja DeepSearch QA (74,6 vs. 71,1) . Se saa myös 94,7 AIME 2026:ssa, johtaen molempia kilpailijoita
.
Huomautus: Eräs kolmannen osapuolen analyysi toteaa, että Glimmer jää jälkeen Qwen 3.6 27B:stä TerminalBench 2.1:ssä (51,7 vs. 60,7) ja OSWorld-Verified:ssä (65,9 vs. 75,6), ja sillä on taipumus kieltäytyä tietyistä OS-tason automatisointitehtävistä .
Muse Glimmer tislattiin Muse Sparkista (Metan suurempi, suljetun lähdekoodin huippumalli) käyttäen logiittitislautta esikoulutuksen aikana, jota seurasivat ohjattu hienosäätö ja RLHF . Muse Spark itse pysyy suljettuna – saatavilla vain isännöitynä API:na – joten Glimmer on avoimen painon tislaus paikallista käyttöä varten
. Meta on vihjannut, että Muse Sparkin avoin julkaisu saattaa seurata
.
Muse Glimmer on selkein tuote tähän mennessä Mark Zuckerbergin visiosta "henkilökohtaisesta superälykkyydestä" – tehokas tekoäly, joka toimii paikallisesti henkilökohtaisilla laitteilla, ilman pilvikustannuksia, tilausmaksuja tai tietojen poistumista laitteelta . TechCrunch kutsui sitä "selkeimmäksi kuvaksi" tästä visiosta
.
Julkaisu seuraa kuukausien sisäistä myllerrystä Llama 4:n pettymystä herättäneen kevään 2026 julkaisun jälkeen, jonka jälkeen Meta vaikutti hylkäävän avoimen painon tekoälyn. Muse Glimmer avaa tämän strategian uudelleen .
Kesäkuussa 2025 Meta sijoitti 14,3 miljardia dollaria data-merkintäyritys Scale AI:hin, hankkien noin 49 %:n osuuden . Kauppa toi Scale AI:n 28-vuotiaan toimitusjohtajan Alexandr Wangin johtamaan Metan uutta "Superälykkyys"-divisioonaa
. Investointi tähtäsi korkealaatuisen koulutusdatan ja osaamisen varmistamiseen Muse-malliperheelle
. CNBC raportoi tammikuussa 2026, että Wang johti Metan TBD AI -yksikköä, joka rakensi seuraajaa Llama-sarjalle, koodinimeltään Avocado
.
Muse Glimmer on ladattavissa Hugging Facesta osoitteesta meta-models/Muse-Glimmer-30B Apache 2.0 -lisenssillä . Sillä on päivä-0-tuki:
Varhaiset yhteisöraportit osoittavat, että jopa RTX 3090 (24 Gt) pystyy ajamaan Q4_K_XL-kvantisoidun mallin DFlashilla ja 262K konteksti-ikkunalla käyttäen noin 22-23 Gt VRAM-muistia .
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Metan Muse Glimmer (julkaistu 10.8.2026) on 29,6 miljardin parametrin avoimen painon agenttimalli (Apache 2.0), joka toimii täysin yhdellä kuluttajan näytönohjaimella – ilman pilviyhteyttä.
Metan Muse Glimmer (julkaistu 10.8.2026) on 29,6 miljardin parametrin avoimen painon agenttimalli (Apache 2.0), joka toimii täysin yhdellä kuluttajan näytönohjaimella – ilman pilviyhteyttä. Muse Spark mallista tislattu Glimmer on optimoitu paikallisiin, aina päällä oleviin agenttityönkulkuihin: suunnittelu, työkalujen kutsuminen, virheistä palautuminen ja multimodaalinen (teksti+kuva) ymmärrys.
Meta yhdistää malliin 4 bittisen kvantisoinnin (alle 20 Gt VRAM) ja DFlash lohko spekulatiivisen dekoodauksen, mahdollistaen reaaliaikaisen päättelyn RTX 5090:stä Apple M5 Maxiin.