Staff Site Reliability Engineer в Garner Health
🤩 Удалённо
🔔 Опубликовано менее 24 часов назад
📸 Платформа для выбора высокоэффективных врачей на основе клинических данных
🤩 Помогла более 2,5 млн человек получить более качественную медицинскую помощь
🤩 Сэкономила $1 млрд на расходах на здравоохранение за пять лет работы
Задачи:
• Формирование стратегии надёжности cloud-инфраструктуры для продуктов и AI/ML-нагрузок;
• Проектирование SLO, incident response и стандартов автоматизации для всех инженерных команд;
• Развитие observability-платформы: мониторинг, алертинг и раннее обнаружение проблем;
• Удалённая работа с периодическими поездками в штаб-квартиру в Нью-Йорке.
🕸 Требования:
• 7+ лет эксплуатации production cloud-инфраструктуры в SRE, DevOps или Platform Engineering;
• Глубокие знания Kubernetes и Terraform, предпочтительно в AWS;
• Опыт построения SLO, observability и incident response практик;
• Python или Go для автоматизации инфраструктуры.
Откликнуться: тут
🚀 Offer Inside
#devops #staff #engineer
Post #2437
1.67K
