Что такое Site Reliability Engineering: откуда взялся этот подход и чем занимаются SRE-специалисты
«Например, мы хотим, чтобы запросы к нашему сервису обрабатывались за 50 миллисекунд в 99 % случаев. Нужно учитывать некоторые погрешности целевых показателей — 100 % Service Level Objectives достичь нереально, ожидать абсолютной стабильности сервиса бессмысленно».
Марцин Дерило, Site Reliability Engineer в DataArt — о принципах SRE, понятии надежности и жертвах, необходимых для ее повышения, бюджете на ошибки, рутине и творчестве в работе SRE-специалиста.
Post #543
1.53K