19 августа 2026 г.
Своё железо под большую LLM подорожало втрое: минимальный набор GPU в РФ стоит 38,8 млн рублей
За год минимальный набор ускорителей Nvidia под ведущие LLM подорожал с 13,7 до 38,8 млн рублей, в 2,8 раза.

Год назад под ведущую открытую модель хватало 13,7 млн рублей на ускорители. Сейчас нужно 38,8 млн.
Модели растут быстрее, чем дешевеет железо, показало исследование MWS Cloud от 19.08.2026. Kimi K2 на триллион параметров поднимался на восьми H200 примерно за 35 млн рублей. Версии K3 на 2,8 трлн параметров нужно восемь B300 и около 80 млн.
Не хотите разбираться сами? Внедряем ИИ в ваш бизнес: задачи без лимита, одна цена в месяц, отмена в любой момент.
Компактные держат цену. Gemma 3 27B работала на двух H100 примерно за 7,5 млн рублей, Gemma 4 31B требует те же две карты и ту же сумму. Cotype Pro 2 32B и Cotype Pro 3 27B обходятся одной A100 за 3 млн.
Гендиректор MWS Cloud Павел Воронин говорит прямо: «Если покупка оборудования перестаёт окупаться, компании выбирают более компактные модели».
Второй путь. Вместо покупки карт модель берут по API в MWS GPT Model Hub, в каталоге 17 моделей. Цены с 01.08.2026 за 1 млн токенов, вход и выход:
- GPT-oss-120b — 13,42/54,90 ₽ - Qwen3.6-35b-a3b — 70,76/283,04 ₽ - Qwen3-coder-480b-a35b — 104,92/419,68 ₽ - GLM-5.2 — 178,12/746,64 ₽
Аренда тоже дорожает. С 1 августа GPT-oss-120b подорожал вчетверо, до 13,42/54,90 ₽ за миллион токенов, раньше было 3,40/13,50. GLM-5.2 поднялся со 115/463 до 178,12/746,64. Kimi-k2.6 наоборот подешевел, со 183/732 до 157,38/652,70.
Как подключить. В консоли MWS Cloud Platform создаётся деплоймент модели, затем сервисный аккаунт sa-inferencer с ролью gpt.inferencer и API-ключ. Эндпоинт OpenAI-совместимый, менять клиент не нужно. Новым пользователям дают грант: 3000 ₽ физлицам и 10 000 ₽ юрлицам с ИП.
У тех, кто всё же берёт железо, появился запасной вариант: Huawei Ascend 910B закрывает 5 моделей из 7 в выборке 2026 года против 3 из 6 годом раньше и стоит 50–67% от Nvidia, но карт нужно в среднем 13,6.
Российские компании уже голосуют деньгами. Потребление китайских LLM на площадках MWS за первое полугодие 2026 превысило весь 2025 год более чем в 11 раз.
Дальнейшего роста цен на GPU в ближайшие 12 месяцев ждут 47% опрошенных MWS Cloud.
Первоисточник