Meta представила Muse Glimmer 10 августа 2026 года — модель с 29,6 млрд параметров под лицензией Apache 2.0, работающую полностью локально на одной видеокарте. Дистиллированная из закрытой модели Muse Spark, Glimmer оптимизирована для агентных сценариев: планирования, вызова инструментов, исправления ошибок и мульти...
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: What is Meta's Muse Glimmer, a 30-billion-parameter open-weight AI model, and what are its key features, specifications (including offline c. Article summary: I need to verify this information about a model called "Muse Glimmer" from Meta. Let me search for it. Topic tags: general, general web, user generated, documentation, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustra
10 августа 2026 года Meta Superintelligence Labs выпустила Muse Glimmer — открытую весовую модель с ~29,6 млрд параметров, работающую полностью на одной потребительской видеокарте без подключения к облаку . Это первый за год открытый весовой релиз Meta, знаменующий возвращение к истокам открытого ИИ после неудачного запуска Llama 4
.
Muse Glimmer — это плотный каузальный трансформер (не Mixture-of-Experts) со специализированным кодировщиком восприятия ViT-G/14 на ~1,8 млрд параметров для мультимодального ввода . Модель включает 52 слоя, скрытое измерение 6 656 и 32 запросные головки с шаблоном Grouped Query Attention 16:1
.
Модель в полной точности требует ~55 ГБ видеопамяти, но Meta поставляет её с 4-битным квантованием, сжимающим модель до объёма менее 20 ГБ .
Meta выпускает две квантованные конфигурации, построенные на K-Quant и протестированные на 15 бенчмарках :
Независимые лаборатории пока не воспроизвели эти показатели деградации .
Чтобы решить проблему задержки при работе 30-миллиардной модели локально, Meta использует DFlash — небольшой пятислойный спекулятивный декодер, предлагающий блоки по 16 токенов за раз, которые основная модель проверяет параллельно .
Meta сообщает о следующей пропускной способности для 17-гигабайтной квантованной модели при размере пакета 1 и жадном декодировании :
| Оборудование | Базовый режим (токен/с) | С DFlish (токен/с) | Ускорение |
|---|---|---|---|
| NVIDIA RTX 5090 | 74,9 | 233,4 | 3,1x |
| Apple M5 Max | 26,6 | 50,2 | 1,9x |
| Apple M4 Max | 23,7 | 37,8 | 1,6x |
SGLang сообщил о 236,4 токен/с на том же RTX 5090 в отдельном измерении . Ранние независимые тесты на RTX 5090 с llama.cpp иногда показывают меньшие значения (около ~137 токен/с), что говорит о том, что показатель 233+ токен/с требует определённых оптимизаций
.
Muse Glimmer — это не просто чат-бот, а локальный ИИ-агент, предназначенный для автономных рабочих процессов . Meta явно настраивала его на планирование, вызов инструментов и самостоятельное исправление ошибок
. Модель нативно поддерживает Model Context Protocol (MCP) и интегрируется с популярными агентными фреймворками
.
Ключевые сценарии: вызов функций, локальное программирование, длительные сессии с инструментами, оценка «ИИ как судья», анализ документов и работа в качестве личного ассистента .
Meta опубликовала прямые сравнения с Google Gemma 4 31B и Alibaba Qwen 3.6 27B (в режиме рассуждения) :
Muse Glimmer лидирует в большинстве агентных бенчмарков, включая MCP Atlas (75,5 против 62,5 у Qwen) и DeepSearch QA (74,6 против 71,1) . Также модель набирает 94,7 балла на AIME 2026, опережая обоих конкурентов
.
Важное уточнение: Согласно анализу третьей стороны, Glimmer уступает Qwen 3.6 27B в TerminalBench 2.1 (51,7 против 60,7) и OSWorld-Verified (65,9 против 75,6), а также склонна отказываться от некоторых задач по автоматизации ОС .
Muse Glimmer была дистиллирована из Muse Spark (более крупной закрытой флагманской модели Meta) с использованием дистилляции логитов на этапе предобучения, за которой последовали контролируемая донастройка и RLHF . Muse Spark остаётся закрытой — доступна только в виде API, поэтому Glimmer представляет собой открытую весовую дистилляцию для пользователей, желающих локального развёртывания
. Meta намекнула, что открытый релиз Muse Spark может последовать позже
.
Muse Glimmer — самый яркий на сегодня продукт видения Марка Цукерберга, получившего название «персональный сверхинтеллект»: мощный ИИ, работающий локально на персональных устройствах, без затрат на облако, подписок или передачи данных с устройства . TechCrunch назвал её «самой чёткой картиной» этой концепции
.
Релиз последовал за месяцами внутренних неурядиц после провального запуска Llama 4 весной 2026 года, после которого Meta, казалось, отказалась от открытых весовых моделей. Muse Glimmer возрождает эту стратегию .
В июне 2025 года Meta инвестировала 14,3 млрд долларов в компанию по разметке данных Scale AI, приобретя около 49% акций . Сделка привела 28-летнего генерального директора Scale AI Александра Вана к руководству новым подразделением «Сверхинтеллект» Meta
. Инвестиция была нацелена на обеспечение высококачественных обучающих данных и талантов для семейства моделей Muse
. В январе 2026 года CNBC сообщила, что Ванг руководит подразделением Meta TBD AI, которое создаёт преемника Llama под кодовым названием Avocado
.
Muse Glimmer доступна для загрузки на Hugging Face по адресу meta-models/Muse-Glimmer-30B под лицензией Apache 2.0 . Поддержка обеспечивается с первого дня в:
Ранние сообщения сообщества показывают, что даже RTX 3090 (24 ГБ) может запустить квантованную модель Q4_K_XL с DFlash и контекстным окном 262K при использовании примерно 22–23 ГБ видеопамяти .
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
Meta представила Muse Glimmer 10 августа 2026 года — модель с 29,6 млрд параметров под лицензией Apache 2.0, работающую полностью локально на одной видеокарте.
Meta представила Muse Glimmer 10 августа 2026 года — модель с 29,6 млрд параметров под лицензией Apache 2.0, работающую полностью локально на одной видеокарте. Дистиллированная из закрытой модели Muse Spark, Glimmer оптимизирована для агентных сценариев: планирования, вызова инструментов, исправления ошибок и мультимодального (текст + изображения) анализа.
Meta поставляет модель с 4 битным квантованием (менее 20 ГБ видеопамяти) и блочным спекулятивным декодированием DFlash, что обеспечивает до 233,4 токенов/с на NVIDIA RTX 5090.