19 августа 2026 г.
Локальная модель сравнялась с Fable 5: Qwen3.8-27B взяла 11,3 балла на Legal Agent
На Legal Agent от Harvey открытая Qwen3.8-27B набрала те же 11,3 балла, что и Fable 5 — замер Vals AI.

Qwen
@alibaba_qwen
#1 среди open-weight моделей на Legal Agent benchmark от Harvey! 🙌 Достаточно сильная для профессиональных задач. Достаточно компактная, чтобы работать на вашей машине. Qwen3.8-27B становится частью вашей повседневной работы.🧑💻
На Legal Agent от @harvey она идёт вровень с Fable 5 — 11,3 балла, и опережает Kimi K3, Qwen 3.8 Max и DeepSeek V4.

27 миллиардов параметров, 18 гигабайт на диске — и юридические задачи на уровне Fable 5.
До этого замера открытые модели держались в юридическом рейтинге позади закрытых: в срезе Vals AI от 14.08 лучшая open-weight набрала 10,42% и стояла седьмой. Qwen3.8-27B встала вровень с закрытым лидером своего класса, а помещается на одну видеокарту.
Что меряет Harvey. Legal Agent Benchmark — свыше 1 200 агентских задач в 24 практиках права и более 75 000 экспертных критериев. Зачёт только all-pass, частичного балла нет. Насколько это строго, показывают майские результаты Harvey: лидер Claude Opus 4.7 набрал 7,1%.
Как поставить у себя. Одна команда: `ollama run qwen3.8:27b`. Сборка весит 18 ГБ, контекст 256K, под Apple Silicon есть вариант qwen3.8:27b-mlx. На сервере вендор предлагает vLLM — `pip install vllm`, затем `vllm serve "Qwen/Qwen3.8-27B"`.
По видеопамяти вилка простая. 4-bit просит 14–16 ГБ, это класс RTX 4090. FP8 занимает около 28 ГБ, BF16 — около 56 ГБ. На длинном контексте KV-кэш почти удваивает запрос.
Две граббли из коробки. Модель стартует на reasoning_effort=xhigh. Simon Willison гонял её в LM Studio на MacBook Pro M5 Max: один тестовый рисунок занял 21 минуту и 22 276 токенов рассуждений, а тот же промпт без рассуждений уложился в 2 минуты. Willison советует начинать на low.
Вторая мелочь съедает контекст. По умолчанию модель берёт 8 192 токена, на бытовой задаче этого мало, поднимать надо до 262 144. Скорость добавляет спекулятивный MTP, примерно +72%.
первоисточник