Новости · 13 августа 2026 г.
Компании в РФ распробовали китайские модели: потребление выросло в 11,3 раза
За полгода 2026 компании в РФ прогнали через китайские LLM на MWS свыше 400 млрд токенов: за весь 2025 год набралось 39,1 млрд.
Qwen один съел 261,1 млрд токенов за полгода. Все китайские модели на MWS за весь 2025 год набрали 39,1 млрд.
Остальную нагрузку разобрали GLM с 91,2 млрд токенов и Kimi с 81,4 млрд. Счёт идёт по клиентам MWS GPT за первое полугодие 2026 года.
Не только MWS. На Yandex AI Studio за то же полугодие израсходовали 597 млрд токенов, в 18 раз больше прошлогоднего. Модели Яндекса держат там 54% нагрузки, Qwen забирает 21,2%, DeepSeek 13,5%.
Весь рынок LLM в РФ MWS Cloud оценивает в 19,6 млрд руб по итогам 2026 года, на 35% больше прошлогоднего. Продажи моделей по API дают внутри этой суммы почти 1,5 млрд руб. «Турбо Облако» считает рынок скромнее, 10-12 млрд руб.
Как подключиться. В консоли MWS Cloud Platform включаешь GPT Model Hub, создаёшь сервисный аккаунт с ролью gpt.inferencer и API-ключ, поднимаешь деплоймент модели. Дальше запрос уходит на OpenAI-совместимый эндпоинт, то есть подойдёт любой клиент, который умеет говорить с OpenAI API.
Для кода у MWS лежит готовая инструкция. Ассистент Cline в VS Code садится на деплоймент qwen3-coder-480b-a35b, окно в примере 128 000 токенов, ключ проверяется одним запросом curl. С 17 июля каталог хаба вырос почти вдвое, до 17 моделей, и все вычисления идут на GPU внутри контура MWS в РФ.
Кодовый qwen3-coder-480b-a35b стоит 104,92 ₽ за миллион входящих токенов и 419,68 ₽ за выход, с НДС. Новым пользователям MWS Cloud Platform дают стартовый грант: 3 000 ₽ физлицам, 10 000 ₽ юрлицам и ИП.
Цены при этом двигаются. С 1 августа glm-5.2 подорожал со 115 до 178,12 ₽ за миллион входящих токенов, а kimi-k2.6 в тот же день подешевел.
первоисточник