Das Seminar erschließt den Themenbereich Hochverfügbarkeit und Fault Management innerhalb einer StarlingX-Plattform. Behandelt werden Redundanzmodelle, Fehlererkennung, Host- und Dienstwiederherstellung, Alarmbearbeitung und kontrollierte Tests für hochverfügbare StarlingX-Installationen.
Die Bearbeitung folgt einer durchgängigen technischen Reihenfolge: Ausgangslage erfassen, Komponenten und Abhängigkeiten einordnen, Konfiguration kontrolliert umsetzen, Zustand prüfen und typische Abweichungen systematisch eingrenzen. Demonstrationen und Laborübungen orientieren sich an realistischen Betriebs- und Integrationsaufgaben.
Inhaltsübersicht
- Verfügbarkeitsarchitektur
- Maintenance- und Fault-Management-Dienste
- Controller- und Dienstfailover
- Worker- und Workload-Verfügbarkeit
- Storage- und Netzwerkfehler
- Testplanung und Betriebsnachweis
Zielgruppe
Plattformadministration, SRE, Systemarchitektur, Betriebsverantwortung und Teams für Verfügbarkeits- oder Notfallmanagement.
Voraussetzungen
StarlingX-Grundadministration, Linux, Kubernetes und Grundverständnis redundanter Systeme.
Seminarziele
- Fehlerdomänen und Redundanzmechanismen der Plattform erklären.
- Fault-Management-Informationen korrekt bewerten.
- Failover und Wiederherstellung ohne unnötige Folgeausfälle testen.
- Verfügbarkeitsprüfungen in Betrieb und Abnahme verankern.
Seminarinhalte
1. Verfügbarkeitsarchitektur
- Simplex-, Duplex- und Standard-Topologien hinsichtlich Ausfallverhalten vergleichen.
- Controller-, Netzwerk-, Storage- und Workload-Redundanz getrennt bewerten.
- Single Points of Failure außerhalb der Plattform in das Gesamtbild aufnehmen.
2. Maintenance- und Fault-Management-Dienste
- Hostüberwachung, Heartbeats, Zustandswechsel und Wiederherstellungsaktionen einordnen.
- Alarme, Ereignisse und administrative Zustände konsistent interpretieren.
- Automatische Aktionen von manuellen Betriebsentscheidungen abgrenzen.
3. Controller- und Dienstfailover
- Aktive und standby Rollen sowie abhängige Plattformdienste identifizieren.
- Failover kontrolliert auslösen und Beobachtungspunkte vorab definieren.
- Dienstverfügbarkeit, Datenkonsistenz und Rückkehr in den Normalzustand prüfen.
4. Worker- und Workload-Verfügbarkeit
- Podverteilung, Anti-Affinität, Replikate und Disruption Budgets bewerten.
- Hostverlust, Eviction und Rescheduling anhand eines Testfalls nachvollziehen.
- Nicht verschiebbare oder gerätegebundene Workloads gesondert absichern.
5. Storage- und Netzwerkfehler
- Redundante Links, Bonds und Pfade bei Einzel- und Mehrfachfehlern untersuchen.
- Ceph-Degradierung, Wiederaufbau und Kapazitätsgrenzen in die Verfügbarkeitsbewertung einbeziehen.
- Kaskadeneffekte durch Zeitüberschreitungen und Ressourcenknappheit erkennen.
6. Testplanung und Betriebsnachweis
- Fehlerszenarien, Sicherheitsgrenzen und Akzeptanzkriterien dokumentieren.
- Tests mit Messpunkten, Abbruchbedingungen und Wiederherstellungsplan durchführen.
- Feststellungen in Architektur, Monitoring und Runbooks zurückführen.
Praktische Übungen
- Durchführung eines kontrollierten Controller-Failovers.
- Simulation eines Worker-Ausfalls mit Beobachtung des Workload-Verhaltens.
- Entwurf eines wiederholbaren Verfügbarkeitstests für Netzwerk und Storage.
Geeignete Einsatzszenarien
- Abnahme hochverfügbarer Edge-Standorte.
- Überprüfung bestehender Redundanz- und Wiederherstellungsmechanismen.
- Vorbereitung von Betriebs- und Notfallübungen.
-

Lucas Beich
Telefon: + 49 (221) 74740055
E-Mail: lucas.beich@seminar-experts.de -

Paul Goldschmidt
Telefon: + 49 (221) 74740055
E-Mail: paul.goldschmidt@seminar-experts.de
Seminardetails
| Dauer: | 2 Tage ca. 6 h/Tag, Beginn 1. Tag: 10:00 Uhr, weitere Tage 09:00 Uhr |
| Preis: |
Öffentlich oder Live Stream: € 1.198 zzgl. MwSt. Inhaus: € 3.400 zzgl. MwSt. |
| Teilnehmeranzahl: | min. 2 - max. 8 |
| Teilnehmer: | Plattformadministration, SRE, Systemarchitektur, Betriebsverantwortung und Teams für Verfügbarkeits- oder Notfallmanagement. |
| Voraussetzungen: | StarlingX-Grundadministration, Linux, Kubernetes und Grundverständnis redundanter Systeme. |
| Standorte: | Stream Live, Inhaus/Firmenseminar, Berlin, Bremen, Darmstadt, Dresden, Erfurt, Essen, Flensburg, Frankfurt, Freiburg, Friedrichshafen, Hamburg, Hamm, Hannover, Jena, Kassel, Köln, Konstanz, Leipzig, Luxemburg, Magdeburg, Mainz, München, Münster, Nürnberg, Paderborn, Potsdam, Regensburg, Rostock, Stuttgart, Trier, Ulm, Wuppertal, Würzburg |
| Methoden: | Vortrag, Demonstrationen, praktische Übungen am System |
| Seminararten: | Öffentlich, Webinar, Inhaus, Workshop - Alle Seminare mit Trainer vor Ort, Webinar nur wenn ausdrücklich gewünscht |
| Durchführungsgarantie: | ja, ab 2 Teilnehmern |
| Sprache: | Deutsch - bei Firmenseminaren ist auch Englisch möglich |
| Seminarunterlage: | Dokumentation auf Datenträger oder als Download |
| Teilnahmezertifikat: | ja, selbstverständlich |
| Verpflegung: | Kalt- / Warmgetränke, Mittagessen (wahlweise vegetarisch) |
| Support: | 3 Anrufe im Seminarpreis enthalten |
| Barrierefreier Zugang: | an den meisten Standorten verfügbar |
| Weitere Informationen unter + 49 (221) 74740055 |
Seminartermine
Die Ergebnissliste kann durch Anklicken der Überschrift neu sortiert werden.
