Muse Glimmer daripada Meta Superintelligence Labs, dikeluarkan 10 Ogos 2026, ialah model ejen 29.6B parameter berat terbuka (lesen Apache 2.0) yang berjalan sepenuhnya pada satu GPU pengguna tanpa perlu sambungan awan. Disuling daripada model sumber tertutup Muse Spark, Glimmer dioptimumkan untuk aliran kerja ejen t...
Research answer

Create a landscape editorial hero image for this Studio Global article: What is Meta's Muse Glimmer, a 30-billion-parameter open-weight AI model, and what are its key features, specifications (including offline c. Article summary: I need to verify this information about a model called "Muse Glimmer" from Meta. Let me search for it. Topic tags: general, general web, user generated, documentation, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustra
Pada 10 Ogos 2026, Meta Superintelligence Labs melancarkan Muse Glimmer — model AI berat terbuka ~29.6 bilion parameter yang berjalan sepenuhnya pada satu GPU pengguna biasa, tanpa memerlukan sebarang sambungan awan . Ia merupakan keluaran berat terbuka pertama Meta dalam tempoh lebih setahun, menandakan kembalinya kepada akar AI sumber terbuka selepas pelancaran Llama 4 yang mengecewakan
.
Muse Glimmer ialah pengubah berjujukan kausal padat (bukan Mixture-of-Experts) dengan pengekod persepsi ViT-G/14 khusus ~1.8B parameter untuk input multimodal . Ia mempunyai 52 lapisan, dimensi tersembunyi 6,656, dan 32 kepala pertanyaan dengan corak Perhatian Berkumpulan 16:1
.
Model ketepatan penuh memerlukan ~55 GB VRAM, tetapi Meta menghantarnya dengan kuantisasi 4-bit yang memampatkan model kepada bawah 20 GB .
Meta menghantar dua konfigurasi keluaran terkuantisasi, kedua-duanya dibina dengan K-Quant dan diukur pada 15 penanda aras :
Makmal bebas belum lagi menghasilkan semula tuntutan degradasi agregat ini .
Untuk menyelesaikan masalah kependaman menjalankan model 30B setempat, Meta menggandingkan Muse Glimmer dengan DFlash — drafter decoding spekulatif lima lapisan kecil yang mencadangkan blok 16 token sekaligus, yang kemudian disahkan oleh model utama secara selari .
Meta melaporkan throughput berikut pada model terkuantisasi 17 GB pada saiz kumpulan 1 dengan decoding tamak :
| Perkakasan | Garis dasar (tok/s) | Dengan DFlash (tok/s) | Peningkatan |
|---|---|---|---|
| NVIDIA RTX 5090 | 74.9 | 233.4 | 3.1x |
| Apple M5 Max | 26.6 | 50.2 | 1.9x |
| Apple M4 Max | 23.7 | 37.8 | 1.6x |
SGLang melaporkan 236.4 tok/s pada perkakasan RTX 5090 yang sama dalam pengukuran hari-0 yang berasingan . Ujian bebas awal pada RTX 5090 dengan llama.cpp kadangkala melaporkan nombor yang lebih rendah (cth., ~137 tok/s), menunjukkan bahawa angka 233+ tok/s memerlukan pengoptimuman khusus
.
Muse Glimmer bukan terutamanya chatbot — ia adalah ejen AI tempatan yang direka untuk aliran kerja autonomi . Meta secara eksplisit menalanya untuk merancang, memanggil alat, dan pulih daripada kesilapannya sendiri
. Ia menyokong Protokol Konteks Model (MCP) secara asli dan berintegrasi dengan rangka kerja ejen popular
.
Kes penggunaan utama termasuk: panggilan fungsi, pengekodan tempatan, sesi penggunaan alat yang panjang, penilaian LLM-sebagai-hakim, analisis dokumen, dan pembantu peribadi .
Meta menerbitkan perbandingan langsung dengan Gemma 4 31B Google dan Qwen 3.6 27B Alibaba (kedua-duanya dalam mod pemikiran/penaakulan) :
Muse Glimmer mendahului kebanyakan penanda aras ejen, termasuk MCP Atlas (75.5 vs. 62.5 untuk Qwen) dan DeepSearch QA (74.6 vs. 71.1) . Ia juga mendapat skor 94.7 pada AIME 2026, mendahului kedua-dua pesaing
.
Amaran: Satu analisis pihak ketiga menyatakan bahawa Glimmer ketinggalan di belakang Qwen 3.6 27B pada TerminalBench 2.1 (51.7 vs. 60.7) dan OSWorld-Disahkan (65.9 vs. 75.6), dan mempunyai kecenderungan untuk menolak tugas automasi peringkat OS tertentu .
Muse Glimmer telah disuling daripada Muse Spark (model sempadan sumber tertutup Meta yang lebih besar) menggunakan penyulingan logit semasa pra-latihan, diikuti dengan penalaan halus terselia dan RLHF . Muse Spark sendiri kekal tertutup — hanya tersedia sebagai API yang dihoskan — menjadikan Glimmer sebagai penyulingan berat terbuka untuk pengguna yang mahukan penggunaan tempatan
. Meta telah menunjukkan bahawa keluaran terbuka Muse Spark mungkin menyusul
.
Muse Glimmer ialah produk paling jelas setakat ini daripada visi Mark Zuckerberg tentang "superintelligence peribadi" — AI berkuasa berjalan secara tempatan pada peranti peribadi, bebas daripada kos awan, yuran langganan, atau data meninggalkan peranti . TechCrunch menyebutnya "gambaran paling jelas" tentang visi itu
.
Keluaran ini menyusul bulan-bulan pergolakan dalaman selepas pelancaran Llama 4 yang mengecewakan pada musim bunga 2026, selepas itu Meta kelihatan meninggalkan AI berat terbuka. Muse Glimmer membuka semula strategi itu .
Pada Jun 2025, Meta melabur $14.3 bilion dalam firma pelabelan data Scale AI, memperoleh ~49% pegangan . Perjanjian itu membawa CEO Scale AI yang berusia 28 tahun, Alexandr Wang, untuk mengetuai divisyen "Superintelligence" baharu Meta
. Pelaburan itu bertujuan untuk mendapatkan data latihan berkualiti tinggi dan bakat untuk keluarga model Muse
. CNBC melaporkan pada Januari 2026 bahawa Wang mengetuai unit AI TBD Meta yang membina pengganti kepada Llama, dengan nama kod Avocado
.
Muse Glimmer boleh dimuat turun dari Hugging Face di meta-models/Muse-Glimmer-30B di bawah lesen Apache 2.0 . Ia mempunyai sokongan hari-0 dalam:
Laporan komuniti awal menunjukkan bahawa walaupun RTX 3090 (24 GB) boleh menjalankan model terkuantisasi Q4_K_XL dengan DFlash dan tetingkap konteks 262K menggunakan kira-kira 22-23 GB VRAM .
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Muse Glimmer daripada Meta Superintelligence Labs, dikeluarkan 10 Ogos 2026, ialah model ejen 29.6B parameter berat terbuka (lesen Apache 2.0) yang berjalan sepenuhnya pada satu GPU pengguna tanpa perlu sambungan awan.
Muse Glimmer daripada Meta Superintelligence Labs, dikeluarkan 10 Ogos 2026, ialah model ejen 29.6B parameter berat terbuka (lesen Apache 2.0) yang berjalan sepenuhnya pada satu GPU pengguna tanpa perlu sambungan awan. Disuling daripada model sumber tertutup Muse Spark, Glimmer dioptimumkan untuk aliran kerja ejen tempatan yang sentiasa aktif: perancangan, panggilan alat, pemulihan ralat, dan pemahaman multimodal (teks+imej).
Meta menggandingkan model ini dengan kuantisasi 4 bit (bawah 20 GB VRAM) dan DFlash speculative decoding blok, membolehkan inferens masa nyata pada perkakasan daripada RTX 5090 hingga Apple M5 Max.