11 августа 2026 г.
Агентная модель Meta работает на ноутбуке: Muse Glimmer 30B укладывается в 24-32 GB после квантизации
Meta выпустила Muse Glimmer 10 августа 2026: 30B параметров, понимает текст и картинки, веса лежат на Hugging Face под Apache 2.0. В полной точности модели нужно 55+ GB памяти, после квантизации до 4 бит хватает 24-32 GB. Meta тестировала её на MacBook M4 Max, M5 Max и RTX 5090.

Раньше локальная открытая модель означала компромисс в агентной работе. Теперь на MCP Atlas Glimmer набирает 75.5 против 62.5 у Qwen3.6-27B и 54.2 у Gemma4-31B, на SWE-Bench Pro тоже впереди с 51.2. Проигрывает она только на научных вопросах GPQA Diamond: 83.5 против 85.7 у Gemma4-31B.
Поставить у себя можно за две команды. llama.cpp ставится строкой `curl -LsSf https://llama.app/install.sh | sh`, модель поднимается через `llama serve meta-models/Muse-Glimmer-30B-GGUF`. Готовые GGUF-кванты с рекомендованным семплингом выложил Unsloth, для картинок к запуску добавляется файл `--mmproj mmproj-BF16.gguf`.
Не хотите разбираться сами? Внедряем ИИ в ваш бизнес: задачи без лимита, одна цена в месяц, отмена в любой момент.
Память выбирается квантом. Лёгкий UD-Q2_K_XL живёт в 18-20 GB, средний UD-Q4_K_XL - в 24-32 GB, максимальный UD-Q8_K_XL просит 40-48 GB. Драфтер DFlash ускоряет генерацию в 3.1 раза на RTX 5090 и в 1.8 раза на M5 Max без потери качества.
Контекст 131 тысяча токенов, обучение шло на данных 100+ языков. Кроме Hugging Face модель раздают Ollama, LM Studio, MLX и ещё полдюжины каналов.
В ближайшие недели Meta обещает выложить открытые веса своей самой сильной модели Muse Spark 1.2.
* Meta Platforms Inc. признана в РФ экстремистской организацией, её деятельность запрещена; Facebook и Instagram заблокированы. Meta AI и другие продукты компании — продукты этой организации.
Первоисточник