19 августа 2026 г.
Топ-уровень переехал на домашнюю видеокарту: Qwen3.8-27B в индексе Artificial Analysis вровень с GPT-5.6 Luna
Qwen3.8-27B за четыре дня стала первой локальной моделью в Cline и оборвала четырёхмесячную серию Qwen2.5-Coder-7B.

Cline
@cline
Qwen3.8-27B теперь локальная модель №1 в Cline, и на это ушло всего 4 дня. Так оборвалась *четырёхмесячная* серия прошлого лидера, Qwen2.5-Coder-7B, который держал первое место с апреля.
Artificial Analysis Intelligence Index ставит Qwen3.8-27B на уровень DeepSeek V4-Pro и GPT 5.6 Luna. Локальная модель впервые дотянула до уровня frontier-моделей. Мы никак не ожидали, что локальный прогресс пойдёт с такой скоростью.


Четыре месяца лучшей локальной моделью в Cline оставалась Qwen2.5-Coder-7B. Новая Qwen3.8-27B снесла её за четыре дня.
Локальная догнала облачных. В индексе Artificial Analysis (17.08) Qwen3.8-27B набрала 52 балла, ровно как GPT-5.6 Luna. У DeepSeek V4 Pro 53 балла при 1,7 трлн параметров, у Qwen их 27 млрд.
Раньше локальный запуск означал размен: приватность и нулевой счёт за токены в обмен на заметно более слабые ответы. По индексу этого размена больше нет.
Как поставить. Одна команда `ollama run qwen3.8:27b`. Дефолтная 4-битная сборка весит 18 GB, на Mac есть тег `qwen3.8:27b-mlx`, для 8 бит `qwen3.8:27b-q8_0` на 30 GB.
В Cline выбирается провайдер Ollama и адрес http://localhost:11434, дальше модель берётся из выпадающего списка. Доки советуют включить «Use Compact Prompt» и держать задачи узкими.
По железу 4-битные веса просят 14–17 GB видеопамяти, то есть карту на 24 GB вроде RTX 4090 (гайд Yotta Labs, 11.08). KV-кэш добавляется сверху и растёт вместе с длиной диалога.
Год назад планка была другой: в августе 2025-го Cline рекомендовал локальный стек на Qwen3 Coder 30B A3B через LM Studio. Платит новая модель болтливостью. В замере Artificial Analysis она сожгла 160 млн токенов против медианы в 43 млн и забивает контекстное окно почти вчетверо быстрее.
На агентском индексе Artificial Analysis та же модель набрала 51 балл и обошла Claude Opus 4.8 на максимальном reasoning (18.08).
первоисточник