Selectel расширяет платформу для запуска и развития ИИ-проектов

Selectel обновил платформу для разработки и эксплуатации ИИ-сервисов. В её состав войдут два новых продукта для инференса: Token Factory уже анонсирован для работы с популярными open source-моделями, а Custom Inference планируют запустить до конца 2026 года.
Обновление расширяет набор сценариев для компаний — от быстрого подключения внешних языковых моделей до развёртывания собственных нейросетей в изолированной облачной среде. В платформу также входят ИИ-роутер, ИИ-маркетплейс и Dedicated Inference.
Token Factory для доступа к open source-моделям
Token Factory предоставит доступ к моделям, размещённым в дата-центрах Selectel. На старте пользователям будут доступны GLM5.3-Flash, DeepSeek-V4-Flash, Qwen-3.8-Flash-Next и Qwen-3.8-27B. Подключение выполняется через единый API, совместимый с форматом OpenAI.
Стоимость сервиса будет рассчитываться в рублях в зависимости от количества использованных токенов. По заявлению компании, данные обрабатываются в инфраструктуре Selectel без трансграничной передачи, что позволяет учитывать требования российского законодательства, включая 152-ФЗ. Запросы пользователей и ответы моделей не логируются и не применяются для дообучения нейросетей.
Custom Inference для собственных моделей
Сервис Custom Inference предназначен для клиентов, которым необходимо запускать собственные модели, включая дообученные и кастомные версии. Пользователь сможет выбрать модель из доступного набора или загрузить её самостоятельно, после чего развернуть на инфраструктуре Selectel.
Для больших языковых моделей предусмотрят готовые конфигурации, оптимизированные под инференс. Кроме того, сервис позволит настраивать параметры запуска с учётом конкретного сценария и профиля нагрузки. Это должно упростить работу с моделями, требования которых отличаются по производительности, объёму памяти и интенсивности запросов.
Другие компоненты ИИ-платформы
ИИ-роутер предоставляет единый интерфейс для обращения к большим языковым моделям зарубежных провайдеров, включая OpenAI и Anthropic. Такой вариант подходит компаниям, которым важны быстрый запуск продукта и стабильный доступ к внешним моделям.
ИИ-маркетплейс работает как каталог готовых образов для виртуальных серверов. В них входят преднастроенные инструменты для разных задач: агенты Hermes и OpenClaw, конструкторы автоматизаций n8n и Dify, а также решения для построения RAG-систем. Образы рассчитаны на быстрый запуск и разворачиваются в один клик.
Dedicated Inference позволяет запускать в облаке Selectel приватные экземпляры LLM, моделей распознавания речи, эмбеддеров и реранкеров. В отличие от Token Factory, оплата здесь зависит не от числа токенов, а от потребляемых облачных ресурсов. Клиенты могут использовать оптимизированные конфигурации и подключаться к инференсу через приватные сети без выхода в публичный интернет.
Таким образом, платформа объединяет несколько вариантов работы с ИИ. ИИ-роутер открывает доступ к зарубежным проприетарным моделям, Token Factory — к open source-моделям с оплатой по токенам, Dedicated Inference обеспечивает приватное размещение, а Custom Inference должен дать возможность гибко запускать собственные модели. Для быстрого старта пользователям доступны готовые решения из ИИ-маркетплейса.


