Код-агент едет на домашней видеокарте: открытая Muse Glimmer-30B ужимается до 17 ГБ
источник: theverge.com·
машинная выжимка · сверена с источником

Meta выложила открытую модель под локальные кодинг-агенты, которая влезает в одну домашнюю видеокарту: Muse Glimmer-30B в сжатом виде занимает 17 ГБ и работает на карте с 24 ГБ памяти. Веса лежат на Hugging Face с 10 августа под Apache 2.0, в полной точности модель просит больше 55 ГБ. Вышла она в один день с эссе Марка Цукерберга «The Future is for Everyone» на 6500 слов.
Раньше была закрытая ставка. Meta держала в приоритете проприетарную Muse Spark 1.2: доступ к ней получали только разработчики по API. Glimmer стала её уменьшенной открытой версией, обученной на 100+ языках под память домашнего железа.
На SWE-Bench Pro модель набрала 51,2 против 50,2 у ближайшего открытого конкурента Qwen3.6-27B. На MCP Atlas, где меряют работу с инструментами, разрыв шире: 75,5 против 62,5.
Ставится одной командой. llama.cpp тянется скриптом с llama.app, дальше `llama serve -hf meta-models/Muse-Glimmer-30B-GGUF`. Ollama подхватывает модель с версии 0.32.7, на сервере с четырьмя картами её поднимает vLLM.
Рядом Meta выложила драфтер DFlash: маленькая модель угадывает продолжение, большая проверяет. На RTX 5090 генерация ускоряется в 3,1 раза, на MacBook M4 Max в 1,5. Проверяли на этих же машинах и на M5 Max.
Эссе Цукерберга вышло в тот же день: фонд на $1 млрд для сообществ рядом с дата-центрами Meta, $145 млрд расходов в текущем финансовом году и просьба к регуляторам не запрещать дистилляцию.
До 2028 года Meta обещает вложить в AI-инфраструктуру $600 млрд.
первоисточник