./новости · 10 августа 2026 г.
новость
Агентная модель Meta работает на ноутбуке: Muse Glimmer 30B укладывается в 24-32 GB после квантизации
источник: Hugging Face·
машинная выжимка · сверена с источником
Meta выпустила Muse Glimmer 10 августа 2026: 30B параметров, понимает текст и картинки, веса лежат на Hugging Face под Apache 2.0. В полной точности модели нужно 55+ GB памяти, после квантизации до 4 бит хватает 24-32 GB. Meta тестировала её на MacBook M4 Max, M5 Max и RTX 5090.
Раньше локальная открытая модель означала компромисс в агентной работе. Теперь на MCP Atlas Glimmer набирает 75.5 против 62.5 у Qwen3.6-27B и 54.2 у Gemma4-31B, на SWE-Bench Pro тоже впереди с 51.2. Проигрывает она только на научных вопросах GPQA Diamond: 83.5 против 85.7 у Gemma4-31B.
Поставить у себя можно за две команды. llama.cpp ставится строкой `curl -LsSf https://llama.app/install.sh | sh`, модель поднимается через `llama serve meta-models/Muse-Glimmer-30B-GGUF`. Готовые GGUF-кванты с рекомендованным семплингом выложил Unsloth, для картинок к запуску добавляется файл `--mmproj mmproj-BF16.gguf`.
Память выбирается квантом. Лёгкий UD-Q2_K_XL живёт в 18-20 GB, средний UD-Q4_K_XL - в 24-32 GB, максимальный UD-Q8_K_XL просит 40-48 GB. Драфтер DFlash ускоряет генерацию в 3.1 раза на RTX 5090 и в 1.8 раза на M5 Max без потери качества.
Контекст 131 тысяча токенов, обучение шло на данных 100+ языков. Кроме Hugging Face модель раздают Ollama, LM Studio, MLX и ещё полдюжины каналов.
В ближайшие недели Meta обещает выложить открытые веса своей самой сильной модели Muse Spark 1.2.
первоисточник