Meta Superintelligence Labs представила Muse Glimmer — открытую dense-модель на 30 млрд параметров (точнее 29.6B), дистиллированную из более крупной закрытой Muse Spark. Модель заточена под локальных ИИ-агентов: работает с инструментами, пишет код, понимает изображения и видео, восстанавливается после ошибок инструментов, поддерживает более 100 языков и контекст 131К токенов. Веса выложены на Hugging Face под лицензией Apache 2.0, доступны официальные квантизации, GGUFi, MLX и ExecuTorch-версии.
Главная фишка — модель реально помещается на потребительское железо: при 4-битном квантовании она весит меньше 20 ГБ и работает на одной видеокарте (RTX 5090, Mac с M4/M5 Max) с 24–32 ГБ памяти. По заявленным бенчмаркам Glimmer обходит Qwen 3.6 27B и Gemma 4 31B в своём классе. Это первый заметный открытый релиз LLM от Meta с апреля 2025 года и первая модель такого размерного класса с Code Llama 34B (август 2023).
- Архитектура: dense-модель (не MoE), обучена логит-дистилляцией из закрытой Muse Spark; отдельный perception-энкодер ViT-G/14 (~1.8B параметров), до 4096 визуальных токенов на изображение
- Заявленная скорость инференса — 233 токена/сек на RTX 5090 благодаря спекулятивному декодированию DFlashi с приростом ×3.1 на 5090 и ×1.8 на M5 Max
- Экосистема поддержки: официальные квантизации, GGUF для llama.cpp, MLX (fp4, 8bit), ExecuTorch PTE, квантизация Unsloth с гайдом, контейнер NVIDIA NIM, инференс через vLLM и SGLang, поддержка AMD Ryzen AI Max/Radeon + LM Studio
- Вместе с релизом Цукерберг опубликовал 14-страничное эссе против концентрации разработки сверхинтеллекта в руках нескольких корпораций (по данным Хайтек+)
- Meta обещает открыть веса более мощной Muse Spark (упоминается версия 1.2) «в течение недель», пока модель остаётся закрытой
- Практический тест техноданя на MacBook Air M5 (32 ГБ, без Pro/Max, без вентилятора) показал: DFlash дал не ускорение, а замедление на 60% — вместо заявленного ×1.8 на M5 Max; при этом квант IQ3_XXS (13.1 ГБ) оказался медленнее более крупного IQ3_M (14.1 ГБ)
- Контекст в 131К токенов отмечен источником @ai_newz как главный видимый минус модели — меньше, чем у конкурентов
Meta обещает на неделе выпустить документацию по деплою на llama.cpp, ExecuTorch и MLX, а также открыть веса более мощной Muse Spark (версия 1.2); пока проверяются реальные заявленные ускорения (DFlash) и полнота техотчёта — сообщество сравнивает релиз с проблемным опытом Llama 4.
Это произошло: Meta выпустила ИИ-агента для программирования Muse Code →
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖