18 августа 2026 г.
Qwen3.8 теперь работает без облака: версия на 27 млрд параметров весит 18 ГБ
Alibaba открыла веса Qwen3.8-27B. 18 ГБ на диске и одна команда в Ollama, и модель работает на домашнем ПК.

Раньше за такой уровень платили облаку. Теперь он лежит на диске файлом на 18 ГБ.
17 августа Alibaba выложила веса Qwen3.8-27B под лицензией Apache 2.0. Команда Qwen заявляет, что плотная 27B обходит их же MoE-модель Qwen3.7-Plus в кодинге и офисных задачах, хотя та в 10 раз крупнее.
Ставится одной командой. `ollama run qwen3.8` поднимает модель весом 18 ГБ с контекстом 256K, на вход идут текст и картинки. Для Mac в библиотеке Ollama лежит отдельный тег `qwen3.8:27b-mlx` (15.08).
Памяти нужно примерно столько, сколько весит сборка. 4-bit просит 16-19 ГБ оперативной и видеопамяти вместе, 8-bit требует 31 ГБ, полновесный BF16 занимает 56 ГБ (доки Unsloth, 19.08). Самая сжатая 1-bit сборка влезает в 8 ГБ видеопамяти. Кому нужен сервер, а не чат, карточка модели даёт готовые строки для vLLM и SGLang.
Флагман открыт, но не для дома. Веса Qwen3.8-2.4T-A95B на 2,4 трлн параметров тоже выложены на Hugging Face под той же Apache 2.0. Только самый сжатый GGUF весит 397 ГБ. Кто хочет флагман, идёт в QwenCloud по $2 за миллион входных токенов и $6 за миллион выходных (21.08).
Флагман на 2,4 трлн параметров лежит открытым файлом на 397 ГБ, и домашнее железо до него пока не доросло.
Первоисточник