🌨 Новинка в MWS Cloud
Запускаем Inference Valve — платформу для внедрения и эксплуатации моделей ИИ. Она позволяет выводить в продакшн любые обученные ML-модели, большие языковые модели (LLM) и модели компьютерного зрения (CV), а также существенно сокращать время их интеграции в бизнес-процессы.
Возможности платформы:
1️⃣ Управление через API
Интеграция с CI/CD- и MLOps-инструментами. Функционал платформы доступен через простые команды
2️⃣ Создание образов из файлов моделей
Пользователь подгружает файл модели — и платформа сама делает образ (контейнер)
3️⃣ Мониторинг модели в проде
Следим за скоростью и качеством инференса: performance-метрики, data drift, profile мониторинг
4️⃣ Инференс на CPU и GPU
Можно легко переключать модели между CPU/GPU (по потребностям скорости инференса или мониторинга)
В результате:
➡️ на 70% снижает нагрузку на ML‑команду
➡️ на 30% автоматизирует CI/CD
➡️ на 15% снижает затраты на GPU
✳️ Платформа доступна на инфраструктуре MWS Cloud, on-prem на серверах заказчика, а также в составе ПАК в закрытом контуре, включая режимы с ограниченным доступом к внешним сетям.
Протестируйте Inference Valve в числе первых 🚀
Post #1940
3.4K

- ❤ 15
- 🔥 8
- ❤🔥 5