8 сентября 2026 г.
Счёт за агента решает обвязка, а не модель: та же GLM сожгла в 9 раз больше токенов
Одна и та же GLM 5.3 Flash Max сожгла на OpenCode 4,4 млн токенов, а на Codex уложилась в 475 тысяч. Задача обеим ставилась одна.

Один промпт, десять связок модель плюс обвязка: собрать на Three.js ангар с дронами, туманом и кинематографичной камерой.
Разошлись не модели, а оболочки, в которых они работают. Раньше практик выбирал модель и считал расход по её прайсу, теперь к счёту добавился множитель обвязки.
Девятикратный счёт. GLM 5.3 Flash Max на OpenCode сделала 67 обращений к инструментам и сожгла 4,4 млн токенов за 20 минут 29 секунд. Та же модель на Codex обошлась 14 обращениями и 475 тысячами токенов, уложившись в 9 минут.
Быстрее всех задачу закрыл Qwen 3.8 27B x-high на OpenCode: 8 минут 48 секунд, 707 тысяч токенов, ноль ошибок инструментов. Дольше всех работала Astra 6.0 Max на Codex, 37 минут 30 секунд и 1,34 млн токенов, в 4,3 раза дольше самой быстрой связки.
Три прогона из десяти свой результат в браузере так и не открыли: SOL 5.6 Max и Qwen на DSH смотреть не стали, GLM на Codex браузер не пустил. Автор считает, что с проверкой глазами Astra и SOL выступили бы лучше.
Ошибки инструментов легли по тому же шву. На OpenCode и OMP их ноль во всех прогонах, а SOL на Codex, Astra на Codex и Qwen на DSH собрали по пять.
Повторить можно самому. Автор выложил транскрипты всех десяти прогонов и готовые HTML-файлы в открытый репозиторий alvins82/hangar-harness-model-tests, а на странице теста каждая строка таблицы открывает живой результат кнопкой Open.
Обвязку OMP он собирает из oh-my-pi и OpenChamber через свой мост omp-openchamber-server: нужны omp в PATH, установленные OpenChamber и Bun, дальше bun install и bun run start, OpenChamber цепляется на 127.0.0.1:4096.
Повторных прогонов автор делал только на Qwen 3.8 27B, остальные девять связок ждут второго замера.
Первоисточник
