📄️ Contenu
Cours Site Reliability Engineering d'après les pratiques de Google : SLI, SLO et SLA, budget d'erreur comme outil de décision, réduction du toil, gestion des incidents, post-mortem sans blâme, release engineering et planification de capacité.
📄️ Introduction au SRE
Découvrez les origines et principes du Site Reliability Engineering
📄️ SLIs, SLOs et SLAs
Définissez des objectifs de fiabilité mesurables
📄️ Error Budget
Gérez votre budget d'erreur pour équilibrer fiabilité et innovation
📄️ Élimination du Toil
Identifiez et éliminez le travail répétitif manuel
📄️ Gestion des Incidents
Répondez efficacement aux incidents de production
📄️ Post-mortems
Apprenez de vos incidents avec des post-mortems blameless
📄️ Capacity Planning
Planifiez la capacité de vos systèmes pour la croissance
📄️ Release Engineering
Déployez en toute sécurité avec les pratiques Release Engineering
📄️ Bonnes pratiques SRE
Adoptez les meilleures pratiques pour votre organisation SRE
📄️ Exercices et Projets
Mettez en pratique vos connaissances SRE