Ведущий SRE-инженер в продуктовые команды. Фокус на развитии практик надежности, настройке мониторинга и оптимизации микросервисной платформы в Kubernetes.
что делать
Определение и внедрение SLA, SLO и SLI
Развитие мониторинга, алертинга и observability-систем
Расследование инцидентов, проведение RCA и Postmortem
Настройка масштабирования и отказоустойчивости в Kubernetes
Оптимизация CI/CD и автоматизация рутинных операций
требования
Опыт работы в роли SRE, Production или DevOps-инженера
Глубокое понимание SLA, SLO, SLI
Опыт эксплуатации Kubernetes в продакшене
Владение инструментами observability: Prometheus, Grafana, ELK, OpenTelemetry