
Selectel анонсировал обновление ИИ-платформы. Решение дополнят два новых продукта для инференса: Token Factory и Custom Inference.
Token Factory предоставляет доступ к популярным open source-моделям, которые развернуты в доверенных дата-центрах Selectel. Пользователям станут доступны GLM5.3-Flash, DeepSeek-V4-Flash, Qwen-3.8-Flash-Next и Qwen-3.8-27B с единым OpenAI-совместимым API. Оплата будет рассчитываться в рублях в зависимости от объема использованных токенов.
Важная особенность сервиса — соответствие требованиям законодательства, включая 152-ФЗ, за счет размещения и обработки данных без трансграничной передачи. Кроме того, запросы к моделям и ответы не логируются и не используются для дообучения нейросетей.
Второе решение — Custom Inference — компания планирует выпустить до конца 2026 года. Сервис позволит клиентам выбирать из уже существующих или загружать собственные модели, в том числе дообученные и кастомные версии, и разворачивать их на инфраструктуре Selectel. Для запуска LLM будут доступны готовые конфигурации, специально предназначенные для инференса. Также появится возможность гибкого управления параметрами запуска моделей под различные сценарии использования и профили нагрузки.
Помимо этого, ядро платформы составляют уже известные решения для инференса: ИИ-роутер, ИИ-маркетплейс и Dedicated Inference. ИИ-роутер предоставляет единый API-интерфейс для доступа к большим языковым моделям мировых провайдеров, например OpenAI или Anthropic. Он особенно полезен для компаний, которым важна скорость вывода продукта на рынок и стабильный доступ к зарубежным моделям.
ИИ-маркетплейс представляет собой витрину готовых образов для виртуальных серверов с преднастроенным набором инструментов. Здесь представлены решения для быстрого старта и различных сценариев работы с ИИ:
-
агенты Hermes, OpenClaw для решения сложных и рутинных задач;
-
конструкторы агентских сценариев n8n и Dify для автоматизации процессов;
-
также инструменты для RAG и многое другое.
Dedicated Inference позволяет разворачивать приватные инстансы нейросетей (LLM, ASR, эмбеддеры, реранкеры) в облаке Selectel. Оплата выполняется не за токены, а за использование ресурсов облака. Это позволяет контролировать затраты без привязки к объему и количеству запросов. А оптимизированные конфигурации и возможность подключаться к инференсу по приватным сетям без выхода в публичный интернет обеспечивают высокий уровень изоляции данных клиента.
В этом году мы предоставляем клиентам все возможные типы инференса. ИИ-роутер открывает доступ к зарубежным проприетарным моделям. Token Factory дает возможность использовать популярные open-weight модели с оплатой по токенам. Dedicated Inference позволяет запустить приватный инференс в изолированной среде, а Custom Inference — работать с собственными моделями на оптимизированной под ИИ инфраструктуре с гибкими настройками. Для быстрого старта мы предлагаем готовые образы из ИИ-маркетплейса, это наиболее распространенные и востребованные open source-решения, которые разворачиваются в один клик и поддерживают перечисленные выше типы инференса
Антон Малышев
Менеджер продуктов ИИ-платформы Selectel
Источник: habr.com