▶️ Selectel обновил ИИ-платформу.
И представил два сервиса для инференса: Token Factory и Custom Inference (появится до конца года). Компания охватывает сценарии от разовых запросов к моделям до работы на выделенных мощностях.
Token Factory дает доступ к open-weight моделям через единый стандартный API. В списке GLM-5.3-Flash, DeepSeek-V4-Flash, Qwen3.8-Flash-Next, Qwen3.8-27b и другие. Модели работают на инфраструктуре Selectel. Платить нужно в рублях за токены, то есть за фактически использованные вычисления. Арендовать и обслуживать серверы не надо. Данные хранятся и обрабатываются в России на инфраструктуре, которая соответствует 152-ФЗ. Трансграничной передачи нет.
Custom Inference рассчитан на тех, кому не хватает готового каталога. Компания может взять модель из каталога или загрузить свою, в том числе дообученную на корпоративных данных. Модель запускается на выделенных мощностях с готовыми настройками, которые оптимизированы под скорость. Свой вычислительный кластер для ИИ строить не придется.
В платформу также входят:
• ИИ-роутер дает доступ к более чем 400 зарубежным языковым моделям, в том числе проприетарным, через один API. Оплата идет в руб. за токены. Есть контроль расходов, управление ключами и лимитами, метрики использования. Действует политика нулевого хранения: запросы и ответы не сохраняются и не используются для обучения моделей.
• Dedicated Inference разворачивает модель из каталога как приватный сервис с выделенными ресурсами и изолированным эндпоинтом, совместимым с OpenAI API.
• ИИ-маркетплейс с агентами Hermes и OpenClaw, конструкторы сценариев n8n и Dify и инструменты для RAG.
Спрос на ИИ в России растет. По данным исследования Selectel, 55% компаний проводят пилоты и запускают точечные проекты, а 23% вышли на промышленную эксплуатацию. Александр Тугов, директор ИИ-вертикали Selectel, отметил, что вопросы у бизнеса повторяются: где взять готовые модели, как выполнить требования информационной безопасности и где получить вычислительные мощности. По его словам, компании теперь сами выбирают формат работы с ИИ и масштабируют его по мере роста задач.
С точки зрения экономики выбор простой. На старте можно платить только за потребление. Когда нагрузка стабилизируется, можно перейти на приватную инфраструктуру с выделенными ресурсами. Работа в контуре российского законодательства снижает юридические риски, а в технической части нужен лишь API, совместимый с привычными инструментами.
☎️ Телекоммуналка в Telegram | в MAX
Post #9337
4.87K
