2 сентября 2026 г.
Чипы для ИИ обновляются вдвое чаще: Google выпускает два TPU в год
За прошедший год Google выпустила два TPU вместо одного, и Вахдат обещает ускорить темп ещё.

Амин Вахдат вышел на сцену Semicon Taiwan в Тайбэе и назвал новый темп: два ИИ-чипа в год.
Раньше TPU выходил раз в два года. Потом Google перешла на ежегодный цикл, а за прошедший год выпустила сразу два чипа. Вахдат говорит, что и это не потолок: частота обновлений кастомного кремния может вырасти.
Два чипа вместо одного. На Google Cloud Next 22 апреля 2026 компания показала TPU 8t для обучения и TPU 8i для инференса. До этого каждое поколение было одним универсальным ускорителем. Теперь две задачи разведены по разным чипам.
В одном superpod TPU 8t стоит 9600 чипов, они дают 121 экзафлопс и 2 ПБ общей памяти. Это почти втрое больше вычислений на под, чем у прошлого поколения. У TPU 8i своя арифметика: 288 ГБ HBM, утроенная до 384 МБ SRAM и на 80% больше производительности на доллар в инференсе.
Взять их сегодня нельзя. General availability обещана позже в 2026 году, пока Google собирает заявки через форму интереса Cloud. В проде доступно седьмое поколение, Ironwood: в GA с 31 марта 2026, а с 1 июня 2026 машины с ним создаются обычными API Compute Engine и managed instance group.
Гонка упирается в память. Никхил Чериан из Google Cloud на той же конференции назвал цифру: память съедает больше 75% стоимости ИИ-сервера. Ответ Google называется TurboQuant, он сжимает KV cache с 32 бит до 3, то есть в шесть раз.
Под ускоренный цикл компания расширяет свою исследовательскую площадку на Тайване на 60%.
General availability TPU 8t и TPU 8i Google обещает позже в 2026 году.
Первоисточник