8 октября 2026 г.
Подключать модели к приложению можно без аренды GPU: Selectel берёт оплату за токены
В Token Factory платят в рублях за использованные токены, а в Dedicated Inference арендуют выделенные ресурсы.

Selectel объединил в ИИ-платформе два способа запускать нейросети для приложений. Token Factory работает без отдельной аренды GPU-сервера.
Для чат-бота или помощника внутри приложения можно подключить модель через API и платить за запросы. Для работы на выделенных ресурсах Selectel предлагает Dedicated Inference с оплатой за время использования оборудования.
Не хотите разбираться сами? Внедряем ИИ в ваш бизнес: задачи без лимита, одна цена в месяц, отмена в любой момент.
24 августа Selectel уже расширил Foundation Models Catalog. Компания добавила приватный доступ, регион ru-6 с тремя независимыми зонами доступности и модели Qwen в NVFP4 с контекстом до 262 тысяч токенов. В платформе, представленной 8 октября, рядом с каталогом выделенных моделей работает Token Factory с оплатой по расходу токенов.
Оплата за запросы. В Token Factory нет пакетов и подписок. API совместим с OpenAI, поэтому сервис можно подключить к приложению, которое использует этот формат запросов к нейросетям.
Цены Token Factory на 8 октября 2026 года указаны в рублях за миллион токенов. Вход оплачивает текст запроса, выход — ответ модели.
| Модель | Вход | Выход | Чтение кеша | Контекст | | --- | --- | --- | --- | --- | | Qwen-3.8-Flash-Next | 20,85 ₽ | 61,30 ₽ | — | 262 144 токена | | Kimi-K2.7-Code | 157,20 ₽ | 628,70 ₽ | 15,72 ₽ | 262 144 токена |
Для подключения выберите модель в панели Selectel, выпустите API-ключ и задайте срок его действия. Затем подключите ключ к приложению.
Выделенные ресурсы. В Dedicated Inference доступны свыше 30 моделей с собственным OpenAI-совместимым endpoint, адресом для запросов приложения. Selectel считает время использования CPU, GPU, памяти и дисков вместо количества токенов.
Минимальные почасовые цены Dedicated Inference на 8 октября 2026 года:
| Модель | Цена | | --- | --- | | qwen3-coder-30b-a3b-instruct | От 273,74 ₽/час | | qwen3-coder-next | От 1 228,20 ₽/час | | qwen3-coder-next-fp8 | От 886,80 ₽/час |
Dedicated Inference запускается в разделе «Продукты → Foundation Models Catalog». Выберите модель, размер контекста и конфигурацию ресурсов. Для масштабирования можно задать фиксированное число инстансов или диапазон, в котором сервис меняет их число автоматически.
По инструкции Selectel от 1 октября создание сервиса занимает около 15 минут. Локацию, конфигурацию и публичный либо приватный тип подключения выбирают при создании: после запуска их изменить нельзя.
После создания Dedicated Inference тестовый запрос доступен на вкладке «Быстрый старт».
Первоисточник