18 августа 2026 г.
Локальная модель впервые дотянулась до топ-уровня: Qwen3.8-27B сравнялась с GPT-5.6 Luna
Qwen3.8-27B набрала 52 балла в Artificial Analysis Intelligence Index, столько же у GPT-5.6 Luna, а веса лежат открытыми с 14 августа.

Qwen
@alibaba_qwen
Локальная модель на 27B с показателями фронтира! Огромное спасибо @cline за упоминание.🥳 Это только начало: Qwen3.8-27B будет находить себе применение во всё новых областях.🌱
Artificial Analysis Intelligence Index ставит Qwen3.8-27B на уровень DeepSeek V4-Pro и GPT 5.6 Luna. Локальная модель впервые дотянулась до возможностей фронтир-модели. Мы не ждали, что локальные модели пойдут такими темпами так скоро.

Модель на 27 млрд параметров набрала 52 балла в индексе Artificial Analysis. Столько же у GPT-5.6 Luna на максимальном reasoning.
Локальные модели до сих пор шли вторым сортом: на своей машине крутили что попроще, а за верхний уровень платили облаку по счёту API. 14 августа Alibaba выложила веса Qwen3.8-27B под Apache 2.0, и теперь тот же уровень считается на своём железе.
Скачок за одну версию. На DeepSWE 1.1 прежняя Qwen3.6-27B решала 13,3% задач, новая берёт 42,2% при том же размере. В агентском индексе Artificial Analysis у неё 51 балл, выше Claude Opus 4.8 на максимальном reasoning.
Сколько нужно видеопамяти. Рекомендуемый 4-битный квант Q4_K_XL просит 17–19 GB, 8-битный 31 GB, полный BF16 56 GB. Редакция heise гоняла Q8_0 на Nvidia RTX Pro 6000 Blackwell: он занял около 22 GB, задачу на REST API модель сделала за 12 минут и собрала код с первой попытки, хотя простые задачи любит переусложнять и жечь токены.
Как поднять у себя. Официальный рецепт из карточки модели укладывается в две команды: `pip install vllm`, затем `vllm serve "Qwen/Qwen3.8-27B"`. Кто ставит через GGUF, качает сборку Unsloth и запускает её в llama.cpp.
Cline цепляется к такому серверу штатно. В настройках выбираешь провайдера Ollama и вписываешь http://localhost:11434 или LM Studio с http://localhost:1234, берёшь модель из выпадающего списка и включаешь «Use Compact Prompt», без этого шага связка не работает.
Без своей видеокарты модель берут в облаке. OpenRouter отдаёт её по $0,45 за миллион входных токенов и $3,20 за миллион выходных.
первоисточник