Seminar SCS Betrieb: Monitoring, Wartung und Troubleshooting

Seminarbeschreibung

Ein grüner Einzelstatus sagt wenig darüber aus, ob ein Cloud-Dienst für Anwendungen tatsächlich funktioniert. Das Seminar verbindet technische Zustandsüberwachung mit servicebezogenen Prüfungen. Ein vorbereiteter Monitoring-Stack mit Prometheus, Alertmanager und Grafana dient als Übungswerkzeug für die beteiligten Infrastrukturkomponenten.

Die Diagnose folgt einem wiederholbaren Ablauf: Auswirkung bestimmen, Beobachtungen sammeln, Hypothese prüfen und die Wirkung einer Maßnahme kontrollieren. Wartung, Sicherungen und Wiederanlauf werden in diesen Ablauf eingebunden. Neben der technischen Bearbeitung wird ein knappes, belastbares Betriebsprotokoll erstellt, das die nächste Schicht oder ein eskaliertes Fachteam übernehmen kann.

Seminarinhalte

Dienstsicht und Betriebsverantwortung

  • Infrastrukturzustand, API-Verfügbarkeit und nutzbare Anwendungsfunktion getrennt bewerten.
  • Serviceziele, Prüfpunkte und Zuständigkeiten für IaaS und KaaS festlegen.
  • Abhängigkeiten von DNS, Zeitdiensten, Zertifikaten und Identitätsdiensten in die Diagnose aufnehmen.

Metriken und Dashboards

  • Relevante Messwerte für Hosts, Compute, Storage, Netzwerk und Kubernetes im Labormonitoring zuordnen.
  • Kapazität, Fehlerrate, Latenz und Sättigung als unterschiedliche Beobachtungen nutzen.
  • Ein Grafana-Dashboard auf einen konkreten Störungsfall ausrichten und irreführende Einzelwerte erkennen.

Alarmierung und Serviceprüfungen

  • Prometheus-Regeln und Alertmanager-Zuordnung in der vorbereiteten Konfiguration nachvollziehen.
  • Schwellenwerte, Dauerbedingungen, Zusammenfassung und Wartungsunterdrückung begründet festlegen.
  • Einen Alarm mit Auswirkung, erstem Prüfschritt und notwendiger Eskalationsinformation versehen.

Protokolle und Fehlerkorrelation

  • Zeitstempel, Request-IDs und Dienstprotokolle zur Verbindung mehrerer Beobachtungen nutzen.
  • Berechtigungs-, Ressourcen-, Netzwerk- und Storage-Fehler mit einer Hypothesenliste eingrenzen.
  • Für die Fehlersuche erforderliche Daten mit möglichst geringen zusätzlichen Zugriffen erfassen.

Wartung und Wiederanlauf

  • Wartungsfenster, freie Kapazität und aktuelle Sicherungen vor einer Änderung prüfen.
  • Vorher-/Nachher-Tests und Abbruchkriterien für einen begrenzten Wartungsfall festlegen.
  • Wiederanlaufprüfungen für Cloud-APIs und einen Beispielworkload dokumentieren.

Störungsbearbeitung und Betriebsdokumentation

  • Eine Störung nach Dienstbeeinträchtigung priorisieren und geeignete Fachzuständigkeiten bestimmen.
  • Ein Runbook mit Beobachtung, Prüfschritten, erlaubten Maßnahmen und Eskalation erstellen.
  • Nach der Behebung Funktionsnachweise, verbleibende Risiken und Folgeaufgaben festhalten.

Praxisübungen

Überwachung verbessern

Ein vorbereitetes Dashboard auswerten, eine passende Alarmregel ergänzen, einen Testalarm auslösen und die Zustellung im Labor kontrollieren.

Störung bearbeiten

Eine fehlgeschlagene Cloud-Funktion reproduzieren, Metriken und Logs korrelieren, die Ursache eingrenzen, eine freigegebene Maßnahme durchführen und das Runbook vervollständigen.

Schulungsumgebung

Die Schulungsumgebung wird kundenseitig bereitgestellt. Benötigt werden eine vorbereitete Cloud, Prometheus, Alertmanager und Grafana, geeignete Dienstprotokolle sowie freigegebene Störungsszenarien in einer isolierten Testumgebung. Alarmempfänger werden ausschließlich als Testziele eingerichtet.

Fachbereichsleiter / Leiter der Trainer / Ihre Ansprechpartner

Dauer: 2 Tage ca. 6 h/Tag, Beginn 1. Tag: 10:00 Uhr, weitere Tage 09:00 Uhr
Preis: Öffentlich oder Live Stream: € 1.198 zzgl. MwSt.
Inhaus: € 3.400 zzgl. MwSt.
Teilnehmeranzahl: min. 2 - max. 8
Teilnehmer: Cloud-Betriebsteams, Systemadministratoren, technische Supportteams und Mitarbeitende im Bereitschaftsdienst
Voraussetzungen: Praktische OpenStack-Administration, Linux-Kenntnisse und Grundverständnis von Kubernetes; Erfahrung mit Metriken und Protokollen hilfreich
Standorte: Stream Live, Inhaus/Firmenseminar, Berlin, Bremen, Darmstadt, Dresden, Erfurt, Essen, Flensburg, Frankfurt, Freiburg, Friedrichshafen, Hamburg, Hamm, Hannover, Jena, Kassel, Köln, Konstanz, Leipzig, Luxemburg, Magdeburg, Mainz, München, Münster, Nürnberg, Paderborn, Potsdam, Regensburg, Rostock, Stuttgart, Trier, Ulm, Wuppertal, Würzburg
Methoden: Vortrag, Demonstrationen, praktische Übungen am System
Seminararten: Öffentlich, Webinar, Inhaus, Workshop - Alle Seminare mit Trainer vor Ort, Webinar nur wenn ausdrücklich gewünscht
Durchführungsgarantie: ja, ab 2 Teilnehmern
Sprache: Deutsch - bei Firmenseminaren ist auch Englisch möglich
Seminarunterlage: Dokumentation auf Datenträger oder als Download
Teilnahmezertifikat: ja, selbstverständlich
Verpflegung: Kalt- / Warmgetränke, Mittagessen (wahlweise vegetarisch)
Support: 3 Anrufe im Seminarpreis enthalten
Barrierefreier Zugang: an den meisten Standorten verfügbar
  Weitere Informationen unter + 49 (221) 74740055

Seminartermine

Die Ergebnissliste kann durch Anklicken der Überschrift neu sortiert werden.

Seminar Startdatum Enddatum Ort Dauer
Dresden 2 Tage
Luxemburg 2 Tage
Hannover 2 Tage
Stuttgart 2 Tage
Trier 2 Tage
Madgeburg 2 Tage
Regensburg 2 Tage
Jena 2 Tage
Ulm 2 Tage
München 2 Tage
Friedrichshafen 2 Tage
Kassel 2 Tage
Köln 2 Tage
Wuppertal 2 Tage
Münster 2 Tage
Nürnberg 2 Tage
Erfurt 2 Tage
Bremen 2 Tage
Berlin 2 Tage
Mainz 2 Tage
Essen 2 Tage
Darmstadt 2 Tage
Frankfurt 2 Tage
Paderborn 2 Tage
Flensburg 2 Tage
Konstanz 2 Tage
Freiburg 2 Tage
Potsdam 2 Tage
Hamburg 2 Tage
Leipzig 2 Tage
Hamm 2 Tage
Rostock 2 Tage
Nach oben
Seminare als Stream SRI zertifiziert
© 2026 www.seminar-experts.de All rights reserved. | Kontakt | Impressum | Cookie-Einstellungen | Nach oben