6 августа 2026 г.
Alibaba впервые откроет веса модели класса Max: Qwen3.8 обещают выложить около 10 августа
Qwen3.8 Max набрала 56 баллов в индексе Artificial Analysis (06.08) и встала вровень с Claude Opus 4.8. У открытого лидера Kimi K3 на балл больше, и задача на нём обходится на четверть дешевле. Alibaba обещает выложить веса Qwen3.8 Max примерно 10 августа, модель класса Max компания открывает впервые.

Artificial Analysis
@artificialanlys
Qwen3.8 Max от Alibaba набирает 56 в Artificial Analysis Intelligence Index при цене $1,14 за задачу, но лидер среди open weights Kimi K3 остаётся на балл впереди и на 25% дешевле по цене задачи ($0,86) @Alibaba_Qwen выпустила Qwen3.8 Max. По словам Alibaba, это MoE на 2,4T общих параметров с активацией 95B на один проход. Alibaba объявила, что планирует выложить веса на следующей неделе, и это смена стратегии: класс Max компания обычно держала проприетарным. После открытия Qwen3.8 Max окажется примерно в 6 раз больше, чем самый крупный open weights релиз Alibaba (Qwen3.5 397B), и станет второй по размеру открытой моделью после Kimi K3 (2.8T) Уточнение: раньше мы публиковали результаты, где Qwen3.8 Max набирала 53 в Artificial Analysis Intelligence Index. Те прогоны задели периодические сбои на endpoint, который мы замеряли, и мы перезапустили все замеры на публичном API-endpoint Alibaba Главное: ➤ Qwen3.8 Max набирает 56 в Artificial Analysis Intelligence Index, на 10 пунктов больше Qwen3.7 Max (46). Это вровень с Claude Opus 4.8 (max, 56) и второе место среди лабораторий из Китая: впереди GLM-5.2 (max, 51), позади Kimi K3 (max, 57) ➤ Qwen3.8 Max набирает 1739 Elo на GDPval-AA, прибавка 468 Elo к Qwen3.7 Max. Это выше Kimi K3 (1685), фактически вровень с Claude Fable 5 (1743) и GPT-5.6 Sol (max, 1730), и уступает только Claude Opus 5 (max, 1852) ➤ Прибавка к Qwen3.7 Max идёт по агентным замерам, научным рассуждениям и коду: Terminal-Bench v2.1 +6 пунктов, CritPt +7, SciCode +4, HLE +3, GPQA без изменений. AA-LCR (-2 пункта) и AA-Omniscience (-10 пунктов) просели, причина второго - рост доли галлюцинаций с 23% до 40% ➤ Задача Intelligence Index на Qwen3.8 Max стоит $1,14, больше чем вдвое против Qwen3.7 Max ($0,53), примерно в 1,3 раза дороже Kimi K3 (max, $0,86) и вдвое дороже GLM-5.2 (max, $0,57). Цену отчасти гонят лишние ходы на агентных замерах: входные токены на GDPval-AA выросли примерно в 15 раз к Qwen3.7 Max, а расход выходных токенов поднялся на 45%, до 145M ➤ Результат на 𝜏³-Bench Banking (42%) выглядит выбросом. Это +32 пункта к Qwen3.7 Max, и Qwen3.8 Max оказывается выше моделей, которые обходят её на других замерах Ключевые детали модели: ➤ Размер: 2,4T общих параметров, около 95B активных на проход (MoE) ➤ Окно контекста: 1M токенов ➤ Мультимодальность: вход - текст, изображение и видео, выход - текст ➤ Цены: $2,00/$6,00 за 1M входных/выходных токенов на первопартийном API @alibaba_cloud, попадание в кеш - $0,25. Это дешевле Qwen3.7 Max по всем позициям ($2,50/$7,50, попадание в кеш $0,50) ➤ Доступность: первопартийный API Alibaba Cloud. Alibaba заявляет, что веса выложат на следующей неделе

· 164,6 тыс. просмотров
Qwen3.7 Max набирала 46 баллов, новая версия берёт 56. Прибавка легла на агентные задачи и науку: Terminal-Bench v2.1 плюс 6 пунктов, SciCode плюс 4. На AA-Omniscience модель просела на 10 пунктов, доля выдуманных ответов выросла с 23% до 40%: отвечает вместо отказа чаще, чем прошлая версия.
Тарифы Alibaba снизила. Миллион входных токенов стоит $2,00 и миллион выходных $6,00, у Qwen3.7 Max было $2,50 и $7,50. Одна задача индекса при этом обходится в $1,14 вместо $0,53. Дороже её делают лишние ходы в агентных прогонах, расход выходных токенов вырос на 45%.
Не хотите разбираться сами? Внедряем ИИ в ваш бизнес: задачи без лимита, одна цена в месяц, отмена в любой момент.
Как включить сегодня. Модель отвечает по OpenAI-совместимому endpoint DashScope, base URL https://dashscope-intl.aliyuncs.com/compatible-mode/v1. В Claude Code хватает трёх строк в ~/.claude/settings.json: ANTHROPIC_BASE_URL на https://token-plan.ap-southeast-1.maas.aliyuncs.com/apps/anthropic, ANTHROPIC_MODEL=qwen3.8-max и ключ Token Plan в ANTHROPIC_AUTH_TOKEN. Для Codex в ~/.codex/config.toml идут model = qwen3.8-max и wire_api = responses. Превью-идентификатор qwen3.8-max-preview в новые интеграции не берут.
Веса откроют около 10 августа, вторым чекпоинтом выложат Qwen3.8-27B. Поднять такого гиганта у себя дёшево не выйдет: Jamin Ball оценивает разумную раздачу минимум в 8 ускорителей H100 или B200, а оптимальную в 64 и больше. Окно контекста 1 млн токенов, вход мультимодальный, квоты API держат 2 млн токенов и 15 тысяч запросов в минуту.
Веса обещаны около 10 августа, тогда и появятся первые сторонние замеры на своём железе.
Первоисточник