15 сентября 2026 г.
Платить за закрытую ИИ-модель приходится за фору: открытые догоняют её за 4 месяца
Закрытые модели дают фору примерно на 4 месяца, а стоят за неё примерно в 5 раз дороже (отчёт Mozilla, 14.09.2026). Kimi K3 отстаёт от Opus 5 на 3 пункта индекса, но стоит $3/$15 против $5/$25 за 1 млн входных/выходных токенов. От Fable 5 он отстаёт на 2,1 пункта при $3/$15 против $10/$50.

Закрытые модели справлялись с задачами длительностью 8–12 часов сразу. Открытые модели доходят до этого уровня примерно за 4 месяца, поэтому переплата около 5× окупается только внутри этого окна.
Рынок. В августе 2026 года 8 из 10 моделей с наибольшим объёмом токенов в OpenRouter были open-weight, 7 из них разработали китайские компании, а DeepSeek V4 Flash 0731 занял первое место с 45,1 трлн токенов за месяц. Открытые модели используют 79% разработчиков, но в рабочую эксплуатацию вывели 51% против 63% для закрытых моделей.
Своё железо. PwC дообучила небольшую открытую модель на финансовом языке и использует её для сотен клиентов без оплаты за каждый токен. Inkling-Small запускается на одном NVIDIA B300 в режиме W4A4 при 180 ГБ VRAM, на двух H200 в W4A16 или минимум на 600 ГБ VRAM в BF16.
Карточка Kimi K3 от 27.07 даёт команды `pip install vllm` и `vllm serve "moonshotai/Kimi-K3"`. Рецепт vLLM от 10.09 требует минимум 8×GB300, CUDA 13 и драйвер NVIDIA r580+, а для рабочей нагрузки нужна конфигурация на нескольких узлах.
Посттренировочный проход DeepSeek от 31 июля уже поднял V4-Flash на 21 пункт в Terminal-Bench и на 10 пунктов в индексе Artificial Analysis без изменения архитектуры.
Первоисточник
