Meta Superintelligence Labs merilis Muse Glimmer pada 10 Agustus 2026: model open weight 29,6 miliar parameter (lisensi Apache 2.0) yang berjalan sepenuhnya di satu GPU konsumen — tanpa perlu cloud. Didistilasi dari model tertutup Muse Spark milik Meta, Glimmer dioptimalkan untuk alur kerja agen lokal yang selalu ak...
Jawaban penelitian

Create a landscape editorial hero image for this Studio Global article: What is Meta's Muse Glimmer, a 30-billion-parameter open-weight AI model, and what are its key features, specifications (including offline c. Article summary: I need to verify this information about a model called "Muse Glimmer" from Meta. Let me search for it. Topic tags: general, general web, user generated, documentation, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustra
Pada 10 Agustus 2026, Meta Superintelligence Labs merilis Muse Glimmer — model AI open-weight dengan sekitar 29,6 miliar parameter yang dirancang khusus untuk berjalan sepenuhnya di satu GPU konsumen, tanpa memerlukan koneksi cloud sama sekali . Ini adalah rilis open-weight pertama Meta dalam lebih dari setahun, menandai kembalinya perusahaan ke akar AI sumber terbuka setelah peluncuran Llama 4 yang mengecewakan
.
Muse Glimmer adalah dense causal transformer (bukan Mixture-of-Experts) dengan encoder persepsi ViT-G/14 khusus (~1,8 miliar parameter) untuk input multimodal . Model ini memiliki 52 lapisan, dimensi tersembunyi 6.656, dan 32 kepala kueri dengan pola Grouped Query Attention 16:1
.
Model presisi penuh membutuhkan ~55 GB VRAM, tetapi Meta menyertakannya dengan kuantisasi 4-bit yang menekan ukuran model hingga di bawah 20 GB .
Meta mengirimkan dua konfigurasi rilis terkuantisasi, keduanya dibangun dengan K-Quant dan diukur pada 15 benchmark :
Laboratorium independen belum memverifikasi klaim degradasi agregat ini .
Untuk mengatasi masalah latensi saat menjalankan model 30 miliar parameter secara lokal, Meta memasangkan Muse Glimmer dengan DFlash — drafter speculative-decoding kecil lima lapisan yang mengusulkan blok 16 token sekaligus, yang kemudian diverifikasi oleh model utama secara paralel .
Meta melaporkan throughput berikut pada model kuantisasi 17 GB dengan ukuran batch 1 dan greedy decoding :
| Perangkat Keras | Dasar (tok/dtk) | Dengan DFlash (tok/dtk) | Akselerasi |
|---|---|---|---|
| NVIDIA RTX 5090 | 74,9 | 233,4 | 3,1x |
| Apple M5 Max | 26,6 | 50,2 | 1,9x |
| Apple M4 Max | 23,7 | 37,8 | 1,6x |
SGLang melaporkan 236,4 tok/dtk pada perangkat RTX 5090 yang sama dalam pengukuran terpisah di hari pertama . Pengujian independen awal di RTX 5090 dengan llama.cpp terkadang menunjukkan angka yang lebih rendah (misalnya, ~137 tok/dtk), mengindikasikan bahwa angka 233+ tok/dtk memerlukan pengoptimalan khusus
.
Muse Glimmer pada dasarnya bukan chatbot — ia adalah agen AI lokal yang dirancang untuk alur kerja otonom . Meta secara eksplisit menyetelnya untuk merencanakan, memanggil alat, dan memulihkan diri dari kesalahannya sendiri
. Model ini mendukung Model Context Protocol (MCP) secara native dan terintegrasi dengan kerangka kerja agen populer
.
Kasus penggunaan utama meliputi: pemanggilan fungsi, coding lokal, sesi penggunaan alat yang panjang, evaluasi LLM-sebagai-hakim, analisis dokumen, dan asisten pribadi .
Meta menerbitkan perbandingan langsung melawan Google Gemma 4 31B dan Alibaba Qwen 3.6 27B (keduanya dalam mode berpikir/penalaran) :
Muse Glimmer unggul di sebagian besar benchmark agen, termasuk MCP Atlas (75,5 vs. 62,5 untuk Qwen) dan DeepSearch QA (74,6 vs. 71,1) . Ia juga mencetak 94,7 di AIME 2026, memimpin kedua pesaing
.
Catatan: Analisis pihak ketiga mencatat bahwa Glimmer tertinggal dari Qwen 3.6 27B di TerminalBench 2.1 (51,7 vs. 60,7) dan OSWorld-Terverifikasi (65,9 vs. 75,6), serta memiliki kecenderungan menolak tugas otomatisasi OS tertentu .
Muse Glimmer didistilasi dari Muse Spark (model frontier tertutup Meta yang lebih besar) menggunakan distilasi logit selama pra-pelatihan, diikuti dengan supervised fine-tuning dan RLHF . Muse Spark sendiri tetap tertutup — hanya tersedia sebagai API yang dihosting — menjadikan Glimmer sebagai distilasi open-weight bagi pengguna yang menginginkan penggunaan lokal
. Meta mengindikasikan bahwa rilis terbuka Muse Spark mungkin menyusul
.
Muse Glimmer adalah produk paling jelas dari visi Mark Zuckerberg tentang "superintelligence pribadi" — AI canggih yang berjalan secara lokal di perangkat pribadi, bebas dari biaya cloud, biaya berlangganan, atau data yang meninggalkan perangkat . TechCrunch menyebutnya "gambaran paling jelas" dari visi tersebut
.
Rilis ini menyusul gejolak internal berbulan-bulan setelah peluncuran Llama 4 yang mengecewakan pada musim semi 2026, yang membuat Meta tampak meninggalkan AI open-weight. Muse Glimmer membuka kembali strategi itu .
Pada Juni 2025, Meta berinvestasi $14,3 miliar di perusahaan pelabelan data Scale AI, mengakuisisi ~49% saham . Kesepakatan itu membawa CEO Scale AI yang berusia 28 tahun, Alexandr Wang, untuk memimpin divisi "Superintelligence" baru Meta
. Investasi ini bertujuan mengamankan data pelatihan berkualitas tinggi dan bakat untuk keluarga model Muse
. CNBC melaporkan pada Januari 2026 bahwa Wang memimpin unit AI TBD Meta yang membangun penerus Llama, dengan nama kode Avocado
.
Muse Glimmer dapat diunduh dari Hugging Face di meta-models/Muse-Glimmer-30B di bawah lisensi Apache 2.0 . Model ini mendapat dukungan hari pertama di:
Laporan komunitas awal menunjukkan bahwa bahkan RTX 3090 (24 GB) dapat menjalankan model kuantisasi Q4_K_XL dengan DFlash dan jendela konteks 262K menggunakan sekitar 22-23 GB VRAM .
Studio Global AI
Halaman ini berisi jawaban yang didukung sumber yang dapat Anda lanjutkan di dalam Studio Global.
Meta Superintelligence Labs merilis Muse Glimmer pada 10 Agustus 2026: model open weight 29,6 miliar parameter (lisensi Apache 2.0) yang berjalan sepenuhnya di satu GPU konsumen — tanpa perlu cloud.
Meta Superintelligence Labs merilis Muse Glimmer pada 10 Agustus 2026: model open weight 29,6 miliar parameter (lisensi Apache 2.0) yang berjalan sepenuhnya di satu GPU konsumen — tanpa perlu cloud. Didistilasi dari model tertutup Muse Spark milik Meta, Glimmer dioptimalkan untuk alur kerja agen lokal yang selalu aktif: merencanakan, memanggil alat, memulihkan kesalahan sendiri, serta memahami teks dan gambar.
Meta membekali model ini dengan kuantisasi 4 bit (ukuran di bawah 20 GB VRAM) dan DFlash speculative decoding, memungkinkan inferensi real time di perangkat keras dari RTX 5090 hingga Apple M5 Max.