Как строить мониторинг и алертинг, чтобы быстро находить причины аварий? Это вопрос на миллион, а то и намного больше. Особенно если речь идёт о финтехе.
В сегодняшней статье о том, как несколько разных команд разработки Райффайзен Онлайн объединили общим Observability и начали исключительно с помощью технических метрик отслеживать здоровье бизнес-процессов и быстро находить root cause во время сбоя, если он все-таки произошёл: https://habr.com/ru/companies/oleg-bunin/articles/865690/
Post #1244
1.05K
- 🔥 3
- ❤ 1
- 👍 1