Meta вернула открытые веса: Muse Glimmer 30B заводится на домашней видеокарте
источник: ft.com·
машинная выжимка · сверена с источником

Meta Superintelligence Labs выложила агентную модель Muse Glimmer 30B в открытые веса 10 августа, лицензия Apache 2.0. Модель дистиллировали из закрытой Muse Spark и затачивали под постоянную работу на одной потребительской видеокарте: 4-bit сборка занимает 17 GB видеопамяти, окно контекста 131 072 токена. На карточке Hugging Face заявлены SWE-Bench Verified 76.0 и AIME 2026 94.7.
Muse Spark, старшая модель Meta, вышла в 2026 году закрытой. Теперь Meta обещает открыть и её веса, а младшая Muse Glimmer уже лежит на Hugging Face в репозитории meta-models/Muse-Glimmer-30B.
Как поставить. Через vLLM это два шага: `pip install vllm`, потом `vllm serve "meta-models/Muse-Glimmer-30B"`. Через llama.cpp модель поднимается одной командой, рекомендованный старт у Unsloth - 4-bit сборка UD-Q4_K_XL. Модель поддержана в Transformers, SGLang, LM Studio, Ollama и ExecuTorch на Apple Silicon.
Сколько видеопамяти. Полная BF16-версия требует 64 GB, сборка K-Quant-Dynamic влезает в 32 GB, 4-bit у Unsloth занимает 17 GB, самая сжатая 2-bit стартует с 12 GB. Черновая модель DFlash из того же GGUF-репозитория ускоряет генерацию в 3.1 раза: 233.4 токена в секунду против 74.9 на Nvidia RTX 5090. Картинки на вход включает отдельный файл mmproj-kquant.gguf.
В эссе «The Future is for Everyone» от 10 августа Цукерберг бьёт по закрытым лабораториям без имён. Большинство из них, пишет он, строят ИИ для компаний, правительств и институтов, и если ведут они, баланс сил склонится к крупным институтам, а не к людям. По оценке Reuters, сама Muse Spark по совокупности пока отстаёт от сильнейших моделей Anthropic и OpenAI.
Следующая веха - веса старшей Muse Spark, которые Meta обещает открыть скоро.
первоисточник