Site Reliability Engineer (SRE)
Mission principale
Garantit la fiabilité et la disponibilité des services à l'échelle.
5 responsabilités clés
- Définir et tenir les objectifs de fiabilité (SLO, error budgets).
- Concevoir les systèmes pour la panne : redondance, dégradation, chaos.
- Gérer les incidents majeurs et conduire les post-mortems sans blâme.
- Automatiser l'exploitation pour éliminer le toil.
- Équilibrer vélocité des équipes et stabilité de la production.
Compétences clés
Systèmes distribués, Kubernetes, observabilité, gestion d'incident, programmation.
Ce qui est attendu
Une fiabilité chiffrée et tenue : le SRE transforme la stabilité en discipline d'ingénierie.
Évolutions possibles
Staff SRE, Architecte plateforme, Head of Infrastructure.
Offres en ce moment
Aucune offre pour ce métier en ce moment.
Soyez alerté dès qu’un poste de Site Reliability Engineer (SRE) est publié.
Créer une alerte emploi →