Schulungsübersicht
SRE-Anti-Pattern
- Identifizierung kontraproduktiver Praktiken
- Anerkennung der Auswirkungen von Anti-Patterns auf die Zuverlässigkeit
- Best Practices und korrigierende Alternativen
SLO als Stellvertreter für die Kundenzufriedenheit
- Definition von Service Level Indicators (SLIs) und Service Level Objectives (SLOs)
- Verwaltung von Fehlerbudgets und Balance zwischen Innovation und Zuverlässigkeit
- Verständnis der Grenzen verteilter Systeme
Aufbau sicherer und zuverlässiger Systeme
- Gestaltung für Fehlertoleranz und Resilienz
- Integration von Sicherheit in die Reliability Engineering
- Strategien für Skalierbarkeit und Datenschutz
Ganzheitliche Beobachtbarkeit (Full-Stack-Observability)
- Instrumentierung und Metrik-Erfassung
- Verteiltes Tracing und synthetisches Monitoring
- Beobachtbarkeitsgetriebene Entwicklung
Plattformengineering und AIOps
- Plattformzentrierte Engineering-Ansätze
- Automatisierung und Orchestrierung in SRE
- Nutzung von DataOps und operativer Intelligenz
Incident-Management in SRE
- Rollen und Verantwortlichkeiten im Incident Response
- Anwendung von Frameworks wie OODA
- Automatisierte Fehlerbehebung und KI-/ML-gestützte Lösungsfähigkeit
Chaos Engineering
- Prinzipien und Strategien für Resilienz-Tests
- Planung und Durchführung von „Game Day“-Übungen
- Lernen aus kontrollierten Versagen-Experimenten
SRE als reine Form von DevOps
- Integration von SRE in DevOps-Workflows
- Kulturelle Ausrichtung und Kollaborationspraktiken
- Organisationale Transformation durch SRE vorantreiben
Übungen nach dem Kurs
- Fallstudien zum Systemdesign im großen Maßstab
- Fortgeschrittene Instrumentierungs- und Monitoring-Szenarien
- Lösung realer Zuverlässigkeitsprobleme
Wiederholung und Prüfungsvorbereitung
- Abschließende Wiederholung des Lehrplans für die DevOps Institute SRE Practitioner Zertifizierung
- Beispielfragen und Übungstests
- Strategien und Empfehlungen für die Prüfung
Zusammenfassung und nächste Schritte
Voraussetzungen
- Verständnis der Kernprinzipien des Site Reliability Engineering
- Erfahrung mit DevOps-Praktiken und den dazugehörigen Tools
- Vertrautheit mit Systemüberwachung, Incident-Management und Automatisierung
Zielgruppe
- SRE-Profis, die die DevOps Institute SRE Practitioner Zertifizierung anstreben
- DevOps-Ingenieure, die ihre Kompetenzen in Richtung Zuverlässigkeit erweitern möchten
- Operations-Leiter, die für die Strategie und Ausführung der Systemzuverlässigkeit verantwortlich sind
Erfahrungsberichte (2)
Craig war extrem engagiert im Training und hat stets darauf geachtet, dass wir aufmerksam sind. Er passte die Beispiele an unsere täglichen Aktivitäten an und gab immer eine Antwort, wenn danach gefragt wurde, auch wenn die Information nicht im Präsentationsmaterial enthalten war.
Ecaterina Ioana Nicoale - BOOKING HOLDINGS ROMANIA SRL
Kurs - DevOps Foundation®
Maschinelle Übersetzung
Hoher Einsatz und Fachwissen des Trainers
Jacek - Softsystem
Kurs - DevOps Engineering Foundation (DOEF)®
Maschinelle Übersetzung