Token Factory и Custom Inference — разбираемся, для каких задач подойдет каждый
✅ Token Factory предоставляет доступ к популярным open-source моделям, развернутым в доверенных дата-центрах Selectel. При этом оплата происходит по токенам.
В доступе пользователей — популярные open-source модели glm5.3-flash, deepseek-v4-flash,Qwen-3.8-flash-next, Qwen-3.8-27b с единым OpenAI-совместимым API. Сервис соответствует законодательству, включая требования 152-ФЗ, за счет размещения и обработки данных без передачи во внешний контур. Кроме того, запросы к моделям и ответы не логируются и не используются для дообучения нейросетей.
✅ Custom Inference позволит клиентам работать с собственными моделями на инфраструктуре, оптимизированной под ИИ-задачи. Вы сможете выбирать из уже существующих моделей или загружать собственные, в том числе дообученные и кастомные версии, и разворачивать их на инфраструктуре Selectel. Сервис появится в панели управления до конца 2026 года.
Для запуска LLM будут доступны готовые конфигурации железа, предназначенные для инференса. Это упростит запуск моделей и позволит гибко управлять их параметрами под различные задачи и профили нагрузки.
В ядре платформы продолжат работать уже известные сервисы: ИИ-роутер, Dedicated Inference и ИИ-маркетплейс.
Подберите подходящее решение для ИИ-задач в обновленной платформе ➡️