15 сентября 2026 г.
Локальные ИИ-агенты получат больше памяти: Qualcomm добавила 50% в Hexagon NPU
Qualcomm увеличила общую локальную память Hexagon NPU на 50% (блог компании, 10.09.2026). Новый Element Accelerator работает с моделями-трансформерами вместе со scalar, vector и matrix extensions. Qualcomm заявляет поддержку MoE-моделей до 30 млрд параметров, из которых на каждом шаге активны примерно 3 млрд.

У Hexagon NPU уже были scalar, vector и matrix extensions. Теперь Qualcomm добавила Element Accelerator для моделей-трансформеров, а память хранит ближе к ускорителям состояние модели, активации и промежуточные тензоры. Компания связывает новую архитектуру с длинным контекстом, мультимодальными моделями и несколькими одновременно работающими ИИ-агентами.
Для практики. Для INT4-моделей Qualcomm заявляет до 50% более высокую производительность на этапе prefill, когда модель разбирает входной контекст, и более высокую скорость декодирования (блог компании, 10.09.2026). Поддерживаются INT2, INT4, INT8, FP8 и FP16.
Разработчикам компания предлагает Hexagon NPU SDK и Qualcomm AI Hub. В AI Hub можно выбрать оптимизированную модель или загрузить свою, а скачивание SDK требует входа в Qualcomm ID (Qualcomm Developer, 15.09.2026).
Qualcomm пока описывает NPU как часть next-generation premium mobile platform, а конкретный Snapdragon не называет.
Конкретный Snapdragon станет следующей точкой, от которой будет зависеть появление нового NPU в устройствах.
Первоисточник
