1 сентября 2026 г.
Модель в каталоге Selectel можно закрыть от интернета: эндпоинт уходит в приватную подсеть
Selectel добавил в каталог моделей приватный эндпоинт: модель отвечает только внутри своей подсети, снаружи её нет.
Тип подключения к модели выбирается один раз, при создании сервиса. Потом не поменять.
Каталог Foundation Models у Selectel даёт готовую модель без собственной инфраструктуры. Приватный режим снимает то, что закрывало дверь финансам, медицине и госсектору: запросы к модели не выходят в интернет.
Раньше и теперь. Раньше inference-сервис отвечал по эндпоинту из интернета. Теперь при создании можно выбрать private, и эндпоинт виден только из приватной подсети сервиса. Свой ЦОД подключается услугой Direct Connect.
В каталог добавили модели семейства Qwen с контекстом до 262 000 токенов и модели в квантизации NVFP4 под GPU поколения Blackwell: тяжёлая модель помещается в меньшую конфигурацию. Всего в каталоге 50+ преднастроенных моделей, от qwen3-8b и deepseek-r1 до whisper-large-v3 для распознавания речи.
Платишь за часы, не за токены. Счёт идёт почасовой за ресурсы: GPU, vCPU, RAM и диск. Сколько токенов сожгли запросы, на сумму не влияет, а в public preview токены в стоимость не входят вовсе.
Запуск занимает около 15 минут. Выбираешь локацию (её потом не сменить), тип KV-кеша и длину контекста, конфигурацию с автоскейлингом и режим доступа. Запросы идут в выделенный эндпоинт, совместимый с OpenAI API, ключ у каждого сервиса свой.
Новый регион ru-6 стоит на трёх независимых зонах доступности, дублирующие сервисы разводятся по зонам. Свою модель в каталог загрузить нельзя, on-premises-развёртывания нет, работает только синхронный режим.
Дальше в каталог обещаны модели в FP8 и NVFP4.
Первоисточник