Site Reliability Engineer (SRE)
Обеспечение надёжности, масштабируемости и производительности production-систем
Уровень:
Observability и мониторинг
11 навыков · 55 требований| Навык | Junior | Middle | Senior | Lead | Principal |
|---|---|---|---|---|---|
| Логирование | |||||
| Структурированное логирование | Awareness | Working | Advanced | Expert | Expert |
| ELK Stack | Awareness | Working | Advanced | Expert | Expert |
| Grafana Loki | Awareness | Working | Advanced | Expert | Expert |
| Метрики и мониторинг | |||||
| Prometheus и Grafana | Awareness | Working | Advanced | Expert | Expert |
| Бизнес-метрики | Awareness | Working | Advanced | Expert | Expert |
| Distributed Tracing | |||||
| OpenTelemetry | Awareness | Working | Advanced | Expert | Expert |
| Jaeger / Grafana Tempo | Awareness | Working | Advanced | Expert | Expert |
| Профилирование | |||||
| Continuous Profiling | Awareness | Working | Advanced | Expert | Expert |
| APM-инструменты | Awareness | Working | Advanced | Expert | Expert |
| Алертинг и on-call | |||||
| SLI / SLO / SLA | Awareness | Working | Advanced | Expert | Expert |
| Управление инцидентами | |||||
| Управление дежурствами | Awareness | Working | Advanced | Expert | Expert |