19 августа 2026 г.
Своё железо под большую LLM подорожало втрое: минимальный набор GPU в РФ стоит 38,8 млн рублей
За год минимальный набор ускорителей Nvidia под ведущие LLM подорожал с 13,7 до 38,8 млн рублей, в 2,8 раза.

Год назад под ведущую открытую модель хватало 13,7 млн рублей на ускорители. Сейчас нужно 38,8 млн.
Модели растут быстрее, чем дешевеет железо, показало исследование MWS Cloud от 19.08.2026. Kimi K2 на триллион параметров поднимался на восьми H200 примерно за 35 млн рублей. Версии K3 на 2,8 трлн параметров нужно восемь B300 и около 80 млн.
Компактные держат цену. Gemma 3 27B работала на двух H100 примерно за 7,5 млн рублей, Gemma 4 31B требует те же две карты и ту же сумму. Cotype Pro 2 32B и Cotype Pro 3 27B обходятся одной A100 за 3 млн.
Гендиректор MWS Cloud Павел Воронин говорит прямо: «Если покупка оборудования перестаёт окупаться, компании выбирают более компактные модели».
Второй путь. Вместо покупки карт модель берут по API в MWS GPT Model Hub, в каталоге 17 моделей. Цены с 01.08.2026 за 1 млн токенов, вход и выход:
- GPT-oss-120b — 13,42/54,90 ₽ - Qwen3.6-35b-a3b — 70,76/283,04 ₽ - Qwen3-coder-480b-a35b — 104,92/419,68 ₽ - GLM-5.2 — 178,12/746,64 ₽
Аренда тоже дорожает. С 1 августа GPT-oss-120b подорожал вчетверо, до 13,42/54,90 ₽ за миллион токенов, раньше было 3,40/13,50. GLM-5.2 поднялся со 115/463 до 178,12/746,64. Kimi-k2.6 наоборот подешевел, со 183/732 до 157,38/652,70.
Как подключить. В консоли MWS Cloud Platform создаётся деплоймент модели, затем сервисный аккаунт sa-inferencer с ролью gpt.inferencer и API-ключ. Эндпоинт OpenAI-совместимый, менять клиент не нужно. Новым пользователям дают грант: 3000 ₽ физлицам и 10 000 ₽ юрлицам с ИП.
Первоисточник