./новости · 6 августа 2026 г.
новость
Alibaba впервые откроет веса модели класса Max: Qwen3.8 обещают выложить около 10 августа
источник: @artificialanlys · X·
машинная выжимка · сверена с источником

Artificial Analysis
@artificialanlys
Qwen3.8 Max от Alibaba набирает 56 в Artificial Analysis Intelligence Index при цене $1,14 за задачу, но лидер среди open weights Kimi K3 остаётся на балл впереди и на 25% дешевле по цене задачи ($0,86) @Alibaba_Qwen выпустила Qwen3.8 Max. По словам Alibaba, это MoE на 2,4T общих параметров с активацией 95B на один проход. Alibaba объявила, что планирует выложить веса на следующей неделе, и это смена стратегии: класс Max компания обычно держала проприетарным. После открытия Qwen3.8 Max окажется примерно в 6 раз больше, чем самый крупный open weights релиз Alibaba (Qwen3.5 397B), и станет второй по размеру открытой моделью после Kimi K3 (2.8T) Уточнение: раньше мы публиковали результаты, где Qwen3.8 Max набирала 53 в Artificial Analysis Intelligence Index. Те прогоны задели периодические сбои на endpoint, который мы замеряли, и мы перезапустили все замеры на публичном API-endpoint Alibaba Главное: ➤ Qwen3.8 Max набирает 56 в Artificial Analysis Intelligence Index, на 10 пунктов больше Qwen3.7 Max (46). Это вровень с Claude Opus 4.8 (max, 56) и второе место среди лабораторий из Китая: впереди GLM-5.2 (max, 51), позади Kimi K3 (max, 57) ➤ Qwen3.8 Max набирает 1739 Elo на GDPval-AA, прибавка 468 Elo к Qwen3.7 Max. Это выше Kimi K3 (1685), фактически вровень с Claude Fable 5 (1743) и GPT-5.6 Sol (max, 1730), и уступает только Claude Opus 5 (max, 1852) ➤ Прибавка к Qwen3.7 Max идёт по агентным замерам, научным рассуждениям и коду: Terminal-Bench v2.1 +6 пунктов, CritPt +7, SciCode +4, HLE +3, GPQA без изменений. AA-LCR (-2 пункта) и AA-Omniscience (-10 пунктов) просели, причина второго - рост доли галлюцинаций с 23% до 40% ➤ Задача Intelligence Index на Qwen3.8 Max стоит $1,14, больше чем вдвое против Qwen3.7 Max ($0,53), примерно в 1,3 раза дороже Kimi K3 (max, $0,86) и вдвое дороже GLM-5.2 (max, $0,57). Цену отчасти гонят лишние ходы на агентных замерах: входные токены на GDPval-AA выросли примерно в 15 раз к Qwen3.7 Max, а расход выходных токенов поднялся на 45%, до 145M ➤ Результат на 𝜏³-Bench Banking (42%) выглядит выбросом. Это +32 пункта к Qwen3.7 Max, и Qwen3.8 Max оказывается выше моделей, которые обходят её на других замерах Ключевые детали модели: ➤ Размер: 2,4T общих параметров, около 95B активных на проход (MoE) ➤ Окно контекста: 1M токенов ➤ Мультимодальность: вход - текст, изображение и видео, выход - текст ➤ Цены: $2,00/$6,00 за 1M входных/выходных токенов на первопартийном API @alibaba_cloud, попадание в кеш - $0,25. Это дешевле Qwen3.7 Max по всем позициям ($2,50/$7,50, попадание в кеш $0,50) ➤ Доступность: первопартийный API Alibaba Cloud. Alibaba заявляет, что веса выложат на следующей неделе

· 12,9 тыс. просмотров
Qwen3.8 Max набрала 56 баллов в индексе Artificial Analysis (06.08) и встала вровень с Claude Opus 4.8. У открытого лидера Kimi K3 на балл больше, и задача на нём обходится на четверть дешевле. Alibaba обещает выложить веса Qwen3.8 Max примерно 10 августа, модель класса Max компания открывает впервые.
Скачок за поколение. Qwen3.7 Max набирала 46 баллов, новая версия берёт 56. Прибавка легла на агентные задачи и науку: Terminal-Bench v2.1 плюс 6 пунктов, SciCode плюс 4. На AA-Omniscience модель просела на 10 пунктов, доля выдуманных ответов выросла с 23% до 40%: отвечает вместо отказа чаще, чем прошлая версия.
Тарифы Alibaba снизила. Миллион входных токенов стоит $2,00 и миллион выходных $6,00, у Qwen3.7 Max было $2,50 и $7,50. Одна задача индекса при этом обходится в $1,14 вместо $0,53. Дороже её делают лишние ходы в агентных прогонах, расход выходных токенов вырос на 45%.
Как включить сегодня. Модель отвечает по OpenAI-совместимому endpoint DashScope, base URL https://dashscope-intl.aliyuncs.com/compatible-mode/v1. В Claude Code хватает трёх строк в ~/.claude/settings.json: ANTHROPIC_BASE_URL на https://token-plan.ap-southeast-1.maas.aliyuncs.com/apps/anthropic, ANTHROPIC_MODEL=qwen3.8-max и ключ Token Plan в ANTHROPIC_AUTH_TOKEN. Для Codex в ~/.codex/config.toml идут model = qwen3.8-max и wire_api = responses. Превью-идентификатор qwen3.8-max-preview в новые интеграции не берут.
Веса откроют около 10 августа, вторым чекпоинтом выложат Qwen3.8-27B. Поднять такого гиганта у себя дёшево не выйдет: Jamin Ball оценивает разумную раздачу минимум в 8 ускорителей H100 или B200, а оптимальную в 64 и больше. Окно контекста 1 млн токенов, вход мультимодальный, квоты API держат 2 млн токенов и 15 тысяч запросов в минуту.
Веса обещаны около 10 августа, тогда и появятся первые сторонние замеры на своём железе.
первоисточник