18 августа 2026 г.
Claude Code работает с локальной моделью: Qwen3.8-27B ставится одной командой
Локальная Qwen3.8-27B подключается к Claude Code одной командой: 18 ГБ на диске, контекст 256K.
Одна команда в терминале, и Claude Code разговаривает с моделью, которая живёт на твоём диске.
Агент, который читает кодовую базу, правит файлы и запускает команды, больше не обязан ходить за каждым ответом в облако Anthropic.
Как поставить. `ollama run qwen3.8` тянет по умолчанию тег 27B: 18 ГБ загрузки, контекст 256K, на вход текст и картинки (библиотека Ollama, 18.08.2026). Дальше модель подхватывают Claude Code и OpenCode.
Сколько железа. Замер MindStudio от 15.08.2026: сборка Q4_K_M просит 20–24 ГБ видеопамяти. Ollama на дефолтных настройках KV-кеша в том же тесте заняла больше 35 ГБ, а llama.cpp с большим контекстом просит от 31 ГБ. Урезаешь контекст, аппетит падает.
Раньше связка выглядела так: агент в терминале, модель в облаке. У Qwen3.8-27B лицензия Apache 2.0, 27 млрд параметров и нативный контекст 262 144 токена с расширением до миллиона (карточка на Hugging Face, 18.08.2026), так что теперь её можно гонять у себя.
Дальше всё упирается в видеопамять: без 24 ГБ на машине локальный Claude Code остаётся теорией.
Первоисточник