27 августа 2026 г.
Meta учит рекомендации на своём чипе вместо GPU: обмен данными быстрее в 3,9 раза
MTIA 300 несёт 12 сетевых адаптеров по 800 Гбит/с прямо на кристалле: пересылки больше не отнимают время у вычислений.

MTIA 300 уже учит рекомендации Meta в продакшене. 24 августа компания показала, чем её чип обходит GPU.
Обучение рекомендаций Meta увела с чужих ускорителей на своё железо. В замере компании продакшен-модель на 150 млрд параметров разложили на 40 ускорителей: обмен данными занял в 3,9 раза меньше времени, чем на равном GPU-кластере.
Мешает не счёт, а пересылка. В рекомендательных моделях таблицы эмбеддингов держат свыше 99% параметров. Такую модель режут на сотни ускорителей, и те без остановки перекидывают друг другу куски. На GPU эти пересылки дерутся за то же железо, что и вычисления.
Сеть переехала на кристалл. Раньше ускоритель ходил в сеть через отдельную плату и шину PCIe. В MTIA 300 стоят 12 собственных адаптеров по 800 Гбит/с двумя сетевыми чиплетами, и это 1,2 ТБ/с ввода-вывода мимо PCIe.
Пересылками занимаются отдельные 16 движков, пока ядра считают. Меньше 0,5% вычислительной пропускной способности теряется, когда счёт и обмен идут одновременно. У обычных GPU в том же режиме уходит больше 20%.
MTIA 300 в роадмапе Meta стоит точкой отсчёта. MTIA 400 уже разворачивается в ЦОД и держит 72 узла в одном домене против 16, а MTIA 500 обещает в 25 раз больше вычислительной мощности.
MTIA 450 Meta обещает развернуть массово в начале 2027.
Первоисточник