Новости · 13 августа 2026 г.
Модель больше не надо арендовать: Muse Glimmer от Meta влезает в карту на 24 ГБ
Muse Glimmer ставится одной командой и работает на твоей машине без интернета: выключить её снаружи нельзя.

Почти любой ИИ ты арендуешь: ChatGPT, Gemini и Claude живут на чужих серверах.
Muse Glimmer качается целиком и работает на твоём железе. Meta открыла веса 10 августа 2026, вместе с эссе Цукерберга «The Future Is for Everyone».
Что нужно железу. Тег 30b весит 18 ГБ, контекст 128K, на вход идут текст и картинки. В BF16 модель просит 64 ГБ видеопамяти, но сборка K-Quant-17GB укладывается в 24 ГБ при просадке качества 1%: это потолок обычной домашней карты.
Как поставить. Команда `ollama run muse-glimmer` поднимает модель локально, для Apple Silicon есть отдельная сборка `ollama run muse-glimmer:30b-mlx` на 21 ГБ. Веса лежат на Hugging Face под Apache 2.0, свой сервер поднимается через `vllm serve "meta-models/Muse-Glimmer-30B"`. Раздают её и через LM Studio, Together AI и OpenRouter.
На RTX 5090 модель выдаёт 233,4 токена/с, на Apple M4 Max - 37,8. По замерам карточки модели на SWE-Bench Verified у неё 76,0, но на TerminalBench 2.1 она уступает Qwen3.6-27B: 51,7 против 60,7.
Meta обещает личным агентам полностью приватный режим, закрытый и от самой компании.
первоисточник