Seminar StackHPC Private Cloud – Monitoring, Logging und SRE

Das Seminar entwickelt eine durchgängige Observability- und SRE-Praxis für Infrastruktur, OpenStack-Dienste und Mandantenpfade.

Ziel ist ein signalorientiertes Überwachungssystem mit klaren Servicezielen, wirksamen Alarmen, korrelierbaren Protokollen und ausführbaren Runbooks.

Inhaltsübersicht

  1. Serviceziele und Messmodell
  2. Infrastrukturmetriken
  3. OpenStack-Serviceüberwachung
  4. Alarmdesign
  5. Zentrales Logging
  6. Dashboards und Lagebild
  7. Runbooks und Incident Response
  8. SRE-Weiterentwicklung
  9. Praxislabor und betriebliche Einordnung

Zielsetzung

Ziel ist ein signalorientiertes Überwachungssystem mit klaren Servicezielen, wirksamen Alarmen, korrelierbaren Protokollen und ausführbaren Runbooks. Die Arbeitsweise verbindet fachliche Einordnung, Demonstrationen und unmittelbar nachvollziehbare Übungen an einer praxisnahen Umgebung.

Zielgruppe

Cloud-Administratoren, SRE-Teams, Monitoring-Spezialisten und Betriebsverantwortliche.

Voraussetzungen

Linux-, Netzwerk- und OpenStack-Betriebserfahrung.

Seminarinhalte

Modul 1: Serviceziele und Messmodell

  1. Schritt 1: kritische Dienste und Nutzerpfade identifizieren.
  2. Schritt 2: SLIs, SLOs und Fehlerbudgets definieren.
  3. Schritt 3: Messlücken und Verantwortlichkeiten dokumentieren.

Modul 2: Infrastrukturmetriken

  1. Schritt 1: Host-, Netzwerk-, Storage- und Containerwerte auswählen.
  2. Schritt 2: Label und Aggregationen konsistent gestalten.
  3. Schritt 3: Baseline und Kapazitätsgrenzen bestimmen.

Modul 3: OpenStack-Serviceüberwachung

  1. Schritt 1: API, Scheduler, Datenbanken und Messaging überwachen.
  2. Schritt 2: synthetische End-to-End-Checks erstellen.
  3. Schritt 3: Dienststatus und Nutzerwirkung gemeinsam bewerten.

Modul 4: Alarmdesign

  1. Schritt 1: Symptome statt bloßer Ursachen priorisieren.
  2. Schritt 2: Schwellwerte, Zeitfenster und Unterdrückung festlegen.
  3. Schritt 3: Alarmketten mit Testereignissen verifizieren.

Modul 5: Zentrales Logging

  1. Schritt 1: Logquellen, Formate und Aufbewahrung standardisieren.
  2. Schritt 2: Request-IDs und Zeitbezug für Korrelation nutzen.
  3. Schritt 3: Suchmuster für häufige Fehlerbilder erstellen.

Modul 6: Dashboards und Lagebild

  1. Schritt 1: Zielgruppen und Entscheidungsfragen pro Dashboard festlegen.
  2. Schritt 2: Service-, Kapazitäts- und Fehleransichten trennen.
  3. Schritt 3: Darstellung auf Handlungsrelevanz prüfen.

Modul 7: Runbooks und Incident Response

  1. Schritt 1: Alarme mit Diagnoseschritten und Eskalation verknüpfen.
  2. Schritt 2: Incident-Kommunikation und Rollen festlegen.
  3. Schritt 3: Nachbereitung und Verbesserungsmaßnahmen standardisieren.

Modul 8: SRE-Weiterentwicklung

  1. Schritt 1: Toil und wiederkehrende Störungen messen.
  2. Schritt 2: Automatisierung nach Risiko und Wirkung priorisieren.
  3. Schritt 3: SLOs und Alarmqualität regelmäßig überprüfen.

Praxislabor

  1. Aufgabe 1: Definition eines SLO für einen Instanzbereitstellungspfad.
  2. Aufgabe 2: Aufbau eines Alarm- und Runbook-Sets.
  3. Aufgabe 3: Korrelation eines simulierten Fehlers über Metriken und Logs.

Praxisnutzen

Nach Abschluss können die behandelten Verfahren für Serviceziele und Messmodell, Infrastrukturmetriken, OpenStack-Serviceüberwachung, Alarmdesign strukturiert geplant, ausgeführt, geprüft und dokumentiert werden. Technische Entscheidungen lassen sich anhand definierter Anforderungen, Messwerte und kontrollierter Arbeitsschritte begründen.

Fachbereichsleiter / Leiter der Trainer / Ihre Ansprechpartner

Seminardetails

   
Dauer: 3 Tage ca. 6 h/Tag, Beginn 1. Tag: 10:00 Uhr, weitere Tage 09:00 Uhr
Preis: Öffentlich oder Live Stream: € 1.797 zzgl. MwSt.
Inhaus: € 5.100 zzgl. MwSt.
Teilnehmeranzahl: min. 2 - max. 8
Teilnehmer: Cloud-Administratoren, SRE-Teams, Monitoring-Spezialisten und Betriebsverantwortliche
Voraussetzungen: Linux-, Netzwerk- und OpenStack-Betriebserfahrung
Standorte: Stream Live, Inhaus/Firmenseminar, Berlin, Bremen, Darmstadt, Dresden, Erfurt, Essen, Flensburg, Frankfurt, Freiburg, Friedrichshafen, Hamburg, Hamm, Hannover, Jena, Kassel, Köln, Konstanz, Leipzig, Luxemburg, Magdeburg, Mainz, München, Münster, Nürnberg, Paderborn, Potsdam, Regensburg, Rostock, Stuttgart, Trier, Ulm, Wuppertal, Würzburg
Methoden: Vortrag, Demonstrationen, schrittweise praktische Übungen am System
Seminararten: Öffentlich, Webinar, Inhaus, Workshop - Alle Seminare mit Trainer vor Ort, Webinar nur wenn ausdrücklich gewünscht
Durchführungsgarantie: ja, ab 2 Teilnehmern
Sprache: Deutsch - bei Firmenseminaren ist auch Englisch möglich
Seminarunterlage: Digitale Dokumentation als Download
Teilnahmezertifikat: ja, selbstverständlich
Verpflegung: Kalt- / Warmgetränke, Mittagessen (wahlweise vegetarisch)
Support: 3 Anrufe im Seminarpreis enthalten
Barrierefreier Zugang: an den meisten Standorten verfügbar
  Weitere Informationen unter + 49 (221) 74740055

Seminartermine

Die Ergebnissliste kann durch Anklicken der Überschrift neu sortiert werden.

Seminar Startdatum Enddatum Ort Dauer
Luxemburg 3 Tage
Hannover 3 Tage
Stuttgart 3 Tage
Dresden 3 Tage
Madgeburg 3 Tage
Regensburg 3 Tage
Jena 3 Tage
Trier 3 Tage
München 3 Tage
Friedrichshafen 3 Tage
Kassel 3 Tage
Ulm 3 Tage
Münster 3 Tage
Nürnberg 3 Tage
Köln 3 Tage
Wuppertal 3 Tage
Berlin 3 Tage
Mainz 3 Tage
Erfurt 3 Tage
Bremen 3 Tage
Darmstadt 3 Tage
Frankfurt 3 Tage
Paderborn 3 Tage
Essen 3 Tage
Konstanz 3 Tage
Freiburg 3 Tage
Potsdam 3 Tage
Flensburg 3 Tage
Leipzig 3 Tage
Hamm 3 Tage
Rostock 3 Tage
Hamburg 3 Tage
Luxemburg 3 Tage
Hannover 3 Tage
Stuttgart 3 Tage
Dresden 3 Tage
Madgeburg 3 Tage
Regensburg 3 Tage
Jena 3 Tage
Trier 3 Tage
Nach oben
Seminare als Stream SRI zertifiziert
© 2026 www.seminar-experts.de All rights reserved. | Kontakt | Impressum | Nach oben