18 августа 2026 г.
Токены дешевеют, а агенты дорожают: Gartner насчитал пятикратный рост к 2028
Дешёвый токен бюджет не спасает: агент тратит их в 5-30 раз больше чат-бота, а продвинутый reasoning-агент доходит до 150 раз.

Токен к 2030 году подешевеет на 95%. Счёт за агентов за это время только вырастет.
Аналитик Gartner Уилл Соммер зовёт это «token-deflation illusion»: скорость инноваций обгоняет кривую цены. Экономия на одном токене уходит в расход самих агентов.
Арифметика простая. Агент тратит в 5-30 раз больше токенов, чем чат-бот, на ту же задачу (Computerworld, 17.08.2026). Продвинутые reasoning-агенты доходят до 150-кратной разницы на одном задании.
Раньше расход считали по одному ответу модели. Теперь Gartner меряет agentic workflow целиком: одна задача, отправленная в reasoning-модель вместо простого чат-бота, стоит минимум впятеро дороже, и дальше растёт по мере усложнения. Отсюда и прогноз: цена инференса на один agentic workflow вырастет более чем в 5 раз к 2028 году (пресс-релиз Gartner, 17.08.2026).
Дорожает и вход. Железо для обучения средних agentic-моделей с продвинутым reasoning обходится в 2,5 раза дороже, чем для простых чат-бот-моделей.
Что делать со счётом. Первый рецепт Gartner называется inference tiering. Каждая задача уходит в самую дешёвую модель, которая её тянет, а самые умные модели закрывают для простых запросов.
Второй рецепт — обязательный цикл обновления моделей. Gartner советует считать вышедшую модель активом, который дешевеет с первого дня, как новая машина из салона, и мерить каждую AI-фичу пользой на результат.
Смежный прогноз Gartner из того же отчёта: 40% организаций урежут в правах или отключат своих агентов, а минимум половина генеративных проектов вылезет за бюджет.
Первоисточник