Счёт за токены решает сборка, а не модель: в разборе Linux Foundation разница в 34 раза
источник: reddit.com·
машинная выжимка · сверена с источником

Саммари десяти документов стоит $3,04 или $0,09: разница не в модели, а в том, как собран запрос. Этот разбор лежит в первой работе Tokenomics Foundation, вендор-нейтрального органа, который Linux Foundation формально запустил 4 августа 2026 в Сан-Франциско. В основателях около 30 организаций, среди них IBM, Oracle и JPMorganChase.
Раньше цену ИИ узнавали из счёта в конце месяца. Теперь Дэн Нефф из Adobe предлагает считать её до запуска: его нотация T(n · k · a) перемножает число запросов, вызовы модели на каждый запрос и глубину, на которую агенты зовут друг друга.
Класс решает счёт. Кеш попадает в T(1), модель не вызывается вовсе. RAG идёт как T(log n). Агентные системы садятся в T(n·k·a), их называют «the O(n²) of AI»: множитель к стоимости 10-20 раз. Последний класс T(∞) - это цикл без ограничителя.
Экономия считается токенами. Клинический набор данных в работе ужимают с 240 000 токенов до 19 000, минус 92%. При корпусе в миллион токенов в контекст уходят несколько сотен, а стабильное окно держится на 250-350 токенах при любом размере источника.
Рецепты названы цифрами. Батч простых операций кодогенерации экономит около 80% токенов, одиночная операция - примерно треть. Таблица вместо многословного текста съедает вдвое меньше. Выходные токены стоят в несколько раз дороже входных, поэтому схему выгоднее собрать обычным кодом, а не моделью.
Частному разработчику в фонд не вступить: членство только организационное, ему остаётся рассылка. Саму работу Big-T выложили открыто, читать можно без регистрации.
Черновики проектов фонда покажут на tokenomicon вместе с FinOps X 22-23 сентября 2026 в Амстердаме.
первоисточник