25 августа 2026 г.
Локальные модели на Mac быстрее читают промпт: Apple обещает до 4 раз против M3 Ultra
Mac Studio на M5 Ultra стартует с $5 499, а обработка промпта в LM Studio ускоряется до 4 раз против M3 Ultra.

Mac Studio берёт до 512 ГБ памяти под одну модель. Это не серверная стойка, а коробка на столе.
Apple собрала M5 Ultra для тех, кто гоняет модели у себя, а не в облаке: до 36 ядер CPU, до 80 ядер GPU и 1,2 ТБ/с пропускной способности памяти, на 50% больше прошлого поколения.
Ускорился разгон, не выдача. В замерах Apple на фреймворке MLX новый чип берёт промпт в работу в 3,5–4 раза быстрее M4, на моделях Qwen от 1,7 до 30 миллиардов параметров. Сами токены при этом идут быстрее всего на 19–27%.
На практике это значит вот что. Ждать первого слова после длинного промпта приходится вчетверо меньше, а дальше модель печатает примерно как раньше. В LM Studio Apple насчитала до 4 раз к M3 Ultra и до 9,8 раза к M1 Ultra. Замеры компания проводила сама в июле 2026.
Запуск занимает две команды. Apple раздаёт MLX открыто: pip install mlx-lm ставит пакет, mlx_lm.chat поднимает чат с моделью. Ускорители в ядрах GPU включаются начиная с macOS 26.2.
Ценник растёт быстрее конфигурации. Mac Studio на M5 Ultra стартует с $5 499, но 36 ядер CPU и 80 ядер GPU в базу не входят: за них просят ещё $1 300. Память с 96 до 256 ГБ добавляет $4 000, а потолок с 16 ТБ SSD выходит в $18 299.
Кому $5 499 много, есть Mac Studio на M5 Max от $2 499: 18 ядер CPU, до 40 ядер GPU и до 128 ГБ памяти. Тем же анонсом вышел Mac mini от $899 на чипе M6 — первом двухнанометровом у Apple.
Предзаказ открылся 25 августа 2026, отгрузка начинается 22 сентября.
Конфигурация на 512 ГБ памяти выходит в конце октября 2026, и цену на неё Apple пока не назвала.
Первоисточник