27 августа 2026 г.
Qwen3.8-Flash приехала на OpenRouter: миллион токенов контекста в общем API
Alibaba просит $0.16 за миллион входных токенов: в 12 раз дешевле её собственного флагмана Qwen3.8-Max.

Qwen
@alibaba_qwen
Qwen3.8-Flash теперь на @OpenRouter! ⚡ Ассистенты для кода, агентные сценарии, понимание длинного видео - всё в один вызов API.
Qwen3.8 Flash от @Alibaba_Qwen теперь на OpenRouter. Мультимодальная рассуждающая модель для ассистентов по коду, агентных сценариев, понимания изображений, разбора кодовой базы и документов, управления десктопом, графиков и длинного видео. https://openrouter.ai/qwen/qwen3.8-flash
· 13,4 тыс. просмотров
На кодовом SWE-bench Pro новая Qwen набрала 62.5 против 55.8 у прошлой Qwen3.7-Plus.
При этом активных параметров стало втрое меньше: 6 миллиардов на токен вместо 17. Обучение обошлось Alibaba примерно в девять раз дешевле.
Дешёвая линейка перестала быть местом для черновиков. Модель за $0.16 за миллион входа тянет агентную работу: код, разбор репозитория, длинное видео.
Как подключить. OpenRouter совместим с API OpenAI, поэтому в рабочем коде меняются две вещи: адрес и имя модели qwen/qwen3.8-flash. Под этим слагом отдаёт один провайдер, Alibaba Cloud Int.
Окно контекста держит миллион токенов, ответ доходит до 131 072. На вход модель принимает текст, картинки и видео, а function calling и структурный вывод по JSON-схеме работают штатно: на них и держатся агентные обвязки.
Выход стоит $0.47 за миллион токенов, чтение из кэша - $0.016, вдесятеро дешевле обычного входа.
Веса открыты. Qwen3.8-Flash-Next лежит на Hugging Face и поднимается одной командой vllm serve. У себя модель держит 262 144 токена, миллион из коробки даёт только API.
Ближайший сосед по цене DeepSeek-V4-Flash на том же SWE-bench Pro даёт 56.0.
Веса Qwen3.8-Flash-Next уже на Hugging Face, так что первые сторонние замеры пойдут с локальных запусков.
Первоисточник