Komplexe Störungen werden lösbar, wenn Symptom, Auswirkung, letzte Änderung und technische Schichten konsequent getrennt werden. Der Kurs trainiert einen evidenzbasierten Diagnose- und Kommunikationsprozess.
Inhaltsverzeichnis
- Lernziele
- Zielgruppe
- Voraussetzungen
- Schrittweise Seminarinhalte
- Praxisübungen
- Methodik
Lernziele
- Incidents nach Wirkung und Dringlichkeit korrekt priorisieren
- Metriken, Logs, Clusterzustand und Anwendungssignale korrelieren
- Query-, Tablet-, Replikations-, Netzwerk- und Storage-Probleme abgrenzen
- Sofortmaßnahmen risikoarm durchführen und nachprüfen
- RCA mit Belegen, Kausalität und Präventionsmaßnahmen erstellen
- Runbooks aus wiederkehrenden Fehlerbildern ableiten
Zielgruppe
SRE, Datenbankadministration, Plattformbetrieb, DevOps, technische Anwendungsbetreuung und Incident Manager.
Voraussetzungen
Gute YugabyteDB-Grundlagen, sichere Linux- und Netzwerkkenntnisse sowie Erfahrung mit Monitoring und Logs.
Schrittweise Seminarinhalte
- Schritt 1: Triage und Incident-Rollen festlegen
Auswirkung, Umfang, Priorität, Incident Lead, Kommunikation, Beweissicherung und nächste Prüfschritte werden in den ersten Minuten strukturiert.
- Schritt 2: Zeitachse und letzte Änderungen erfassen
Deployments, Konfiguration, Skalierung, Wartung, Last und externe Abhängigkeiten werden mit dem Beginn des Symptoms abgeglichen.
- Schritt 3: Cluster-Health analysieren
Nodes, Master, TServer, Tablets, Leader, Replikation und laufende Aufgaben werden auf auffällige Zustände geprüft.
- Schritt 4: Query- und Transaktionsprobleme untersuchen
Langsame Abfragen, Pläne, Konflikte, Timeouts, Retries und Pooling werden von Infrastrukturursachen getrennt.
- Schritt 5: Tablet- und Replikationsfehler diagnostizieren
Unterreplikation, Leaderbewegung, Rebalancing, Lag und ungleichmäßige Verteilung werden systematisch bewertet.
- Schritt 6: Ressourcen und Storage prüfen
CPU, Speicher, Datenträgerlatenz, Kapazität, Compaction und I/O-Sättigung werden mit dem Workload korreliert.
- Schritt 7: Netzwerk und Sicherheit abgrenzen
DNS, Erreichbarkeit, TLS, Zertifikate, Firewalls, Latenz und Paketverlust werden mit gezielten Tests geprüft.
- Schritt 8: Sofortmaßnahme und Wiederherstellung steuern
Lastreduktion, Failover, Skalierung, Konfigurationsrücknahme oder Wiederanlauf werden hinsichtlich Risiko und Erfolgskriterium entschieden.
- Schritt 9: Root Cause Analysis erstellen
Befunde, direkte Ursache, begünstigende Faktoren, Wirkung, Erkennungslücke und Belege werden kausal dokumentiert.
- Schritt 10: Prävention und Runbook ableiten
Dauerhafte Korrektur, Monitoring, Test, Automatisierung, Eigentümer und Frist werden in einen überprüfbaren Maßnahmenplan überführt.
Praxisübungen
- Latenzincident mit Metriken, Logs und Query-Daten triagieren
- Unterreplikation und Node-Ausfall diagnostizieren
- TLS- oder Netzwerkfehler von Datenbankfehlern abgrenzen
- RCA-Bericht mit Sofortmaßnahme und Prävention erstellen
- Runbook für ein wiederkehrendes Fehlerbild testen
Methodik
Die Schulung ist als Incident-Labor gestaltet. Fehlerbilder werden schrittweise freigegeben; Entscheidungen müssen mit Messwerten und Logbelegen begründet werden.
Fachbereichsleitung und Trainerteam
-

Lucas Beich
Telefon: + 49 (221) 74740055
E-Mail: lucas.beich@seminar-experts.de
Seminardetails
| Dauer: | 3 Tage ca. 6 h/Tag, Beginn 1. Tag: 10:00 Uhr, weitere Tage: 09:00 Uhr |
| Preis: |
Öffentlich oder Live Stream: € 1.797 zzgl. MwSt. Inhaus: € 5.100 zzgl. MwSt. |
| Teilnehmeranzahl: | min. 2 - max. 8 |
| Teilnehmer: | SRE, Datenbankadministration, Plattformbetrieb, DevOps, technische Anwendungsbetreuung und Incident Manager. |
| Voraussetzungen: | Gute YugabyteDB-Grundlagen, sichere Linux- und Netzwerkkenntnisse sowie Erfahrung mit Monitoring und Logs. |
| Standorte: | Stream Live, Inhaus/Firmenseminar, Berlin, Bremen, Darmstadt, Dresden, Erfurt, Essen, Flensburg, Frankfurt, Freiburg, Friedrichshafen, Hamburg, Hamm, Hannover, Jena, Kassel, Köln, Konstanz, Leipzig, Luxemburg, Magdeburg, Mainz, München, Münster, Nürnberg, Paderborn, Potsdam, Regensburg, Rostock, Stuttgart, Trier, Ulm, Wuppertal, Würzburg |
| Methoden: | Fachimpulse, Demonstrationen, praktische Übungen am System, strukturierte Reviews und dokumentierte Prüfpunkte |
| Seminararten: | Öffentliches Seminar, Webinar, Inhouse-Seminar und Workshop; Durchführung mit Trainerteam, Webinar nach Vereinbarung |
| Durchführungsgarantie: | ja, ab 2 Teilnehmenden |
| Sprache: | Deutsch; bei Firmenseminaren auch Englisch möglich |
| Seminarunterlage: | Dokumentation als Download |
| Teilnahmezertifikat: | ja |
| Verpflegung: | Kalt- und Warmgetränke sowie Mittagessen, vegetarische Auswahl |
| Support: | 3 Supportanfragen im Seminarpreis enthalten |
| Barrierefreier Zugang: | an den meisten Standorten verfügbar |
| Weitere Informationen unter + 49 (221) 74740055 |
Seminartermine
Die Ergebnissliste kann durch Anklicken der Überschrift neu sortiert werden.
