📱 Что происходит с GPU, пока никто не смотрит на метрики?
В Adobe столкнулись с проблемой: метрики GPU собирались централизованно, но дать командам прямой доступ к Prometheus было нельзя — вместе со своими данными они могли увидеть чужие.
Решение собрали без нового стека метрик. Перед Prometheus поставили мультитенантный прокси, который отдает каждой команде только ее данные. Доступ настраивается через объект MetricAccess в Kubernetes.
На карточках — четыре интересных детали, а в статье — весь разбор архитектуры, изоляции метрик и способов, которые помогут находить неэффективные GPU.
📃 Читайте статью на Хабре →
📬 Мы в MAX
Post #598
512





- ❤ 4
- 🔥 3
- 👏 3