Inhaltsverzeichnis
- Seminarüberblick
- Einordnung und Praxisbezug
- Schrittweise Seminarinhalte
- Praxisübungen
- Zielgruppe und Voraussetzungen
Seminarüberblick
Crossplane-Fehler können im Core, in einer Function, im Provider, im Kubernetes-API-Server oder im externen System entstehen. Das Seminar verhindert blindes Log-Suchen durch eine feste Diagnosekette vom konsumierten API-Objekt bis zur externen Ressource.
Prometheus-Metriken, Conditions, Events und strukturierte Logs werden in Serviceindikatoren und Alerts überführt. Vorbereitete Störungen zeigen, wie Authentisierung, Abhängigkeiten, API-Limits, Paketfehler und fehlerhafte Compositions voneinander unterschieden werden.
Einordnung und Praxisbezug
- Wiederholbare Diagnosekette für Composite und Managed Resources.
- Aussagekräftige Dashboards und Alerts statt reiner Pod-Überwachung.
- SLOs für Plattform-APIs und Reconciliation-Zeiten.
- Runbooks mit klaren Eskalationsdaten und sicheren Eingriffen.
Schrittweise Seminarinhalte
Schritt 1: Observability-Modell definieren
- Nutzerperspektive, Plattform-API, Controller und externen Provider verbinden.
- Signale nach Symptom, Ursache und Verantwortungsbereich ordnen.
Schritt 2: Conditions und Status lesen
- Synced, Ready und providerspezifische Conditions auswerten.
- Composite, composed und Managed Resources entlang ihrer Beziehungen verfolgen.
Schritt 3: Events gezielt verwenden
- Zeitliche Abfolge von Reconciliation und Fehlern rekonstruieren.
- Event-Rauschen von belastbaren Diagnosehinweisen unterscheiden.
Schritt 4: Logs strukturieren und korrelieren
- Core-, Function- und Provider-Logs mit Ressourcenbezug filtern.
- Debug-Modus zeitlich begrenzt und ohne unnötige Secret-Ausgabe einsetzen.
Schritt 5: Crossplane-Metriken erfassen
- Prometheus-Endpunkte, Reconcile-Dauer, Fehler und Queue-Verhalten überwachen.
- Standard-Go-Metriken von fachlich relevanten Crossplane-Metriken trennen.
Schritt 6: Dashboards und Alerts entwickeln
- Paketgesundheit, Providerverfügbarkeit und Ressourcenbereitschaft darstellen.
- Alertschwellen mit Fehlerraten, Dauer und Nutzerwirkung kombinieren.
Schritt 7: SLOs für Plattformdienste festlegen
- Bereitstellungszeit, Erfolgsquote und Aktualisierungsdauer messen.
- Externe Providerlatenz und kontrollierte Wartezeiten berücksichtigen.
Schritt 8: Composition-Fehler analysieren
- Pipeline-Schritte, Function Results und gewünschte Ressourcen prüfen.
- Schema-, Datenfluss-, Readiness- und Revisionsfehler unterscheiden.
Schritt 9: Provider- und Cloud-Fehler analysieren
- Credentials, Quotas, API-Throttling und asynchrone Operationen erkennen.
- Kubernetes-Status mit externem Ressourcenstatus abgleichen.
Schritt 10: Performanceengpässe lokalisieren
- API-Server-Last, CRD-Menge, Polling und Providerparallelität untersuchen.
- Safe-Start, Ressourcenlimits und Paketzuschnitt als Maßnahmen bewerten.
Schritt 11: Sichere Störungsmaßnahmen festlegen
- Pause, Rollback, Paketneustart und manuelle Korrektur einordnen.
- Unkontrollierte Löschung oder doppelte externe Ressourcen vermeiden.
Schritt 12: Runbooks testen
- Erstdiagnose, Beweissicherung und Eskalation standardisieren.
- Game-Day-Szenarien für wiederkehrende Fehlerklassen durchführen.
Praxisübungen
- Aufbau eines Crossplane-Dashboards mit zentralen Metriken.
- Analyse einer fehlerhaften Function-Pipeline.
- Diagnose eines Credential- und eines Quota-Fehlers.
- Untersuchung eines Reconciliation-Backlogs.
- Erstellung und Test eines Störungs-Runbooks.
Zielgruppe und Voraussetzungen
Zielgruppe: Site Reliability Engineers, Platform Engineers, Crossplane-Administratoren, Kubernetes-Administratoren und Supportverantwortliche.
Voraussetzungen: Praktische Crossplane- und Kubernetes-Erfahrung sowie Grundlagen in Prometheus, Logging und technischer Störungsanalyse.
Fachbereichsleiter / Leiter der Trainer / Ihre Ansprechpartner
-

Lucas Beich
Telefon: + 49 (221) 74740055
E-Mail: lucas.beich@seminar-experts.de -

Paul Goldschmidt
Telefon: + 49 (221) 74740055
E-Mail: paul.goldschmidt@seminar-experts.de
Seminardetails
| Dauer: | 2 Tage ca. 6 h/Tag, Beginn 1. Tag: 10:00 Uhr, weitere Tage 09:00 Uhr |
| Preis: |
Öffentlich oder Live Stream: € 1.198 zzgl. MwSt. Inhaus: € 3.400 zzgl. MwSt. |
| Teilnehmeranzahl: | min. 2 - max. 8 |
| Teilnehmer: | Site Reliability Engineers, Platform Engineers, Crossplane-Administratoren, Kubernetes-Administratoren und Supportverantwortliche |
| Voraussetzungen: | Praktische Crossplane- und Kubernetes-Erfahrung sowie Grundlagen in Prometheus, Logging und technischer Störungsanalyse |
| Standorte: | Stream Live, Inhaus/Firmenseminar, Berlin, Bremen, Darmstadt, Dresden, Erfurt, Essen, Flensburg, Frankfurt, Freiburg, Friedrichshafen, Hamburg, Hamm, Hannover, Jena, Kassel, Köln, Konstanz, Leipzig, Luxemburg, Magdeburg, Mainz, München, Münster, Nürnberg, Paderborn, Potsdam, Regensburg, Rostock, Stuttgart, Trier, Ulm, Wuppertal, Würzburg |
| Methoden: | Vortrag, Demonstrationen, praktische Übungen am System |
| Seminararten: | Öffentlich, Webinar, Inhaus, Workshop - Alle Seminare mit Trainer vor Ort, Webinar nur wenn ausdrücklich gewünscht |
| Durchführungsgarantie: | ja, ab 2 Teilnehmern |
| Sprache: | Deutsch - bei Firmenseminaren ist auch Englisch möglich |
| Seminarunterlage: | Dokumentation auf Datenträger oder als Download |
| Teilnahmezertifikat: | ja, selbstverständlich |
| Verpflegung: | Kalt- / Warmgetränke, Mittagessen (wahlweise vegetarisch) |
| Support: | 3 Anrufe im Seminarpreis enthalten |
| Barrierefreier Zugang: | an den meisten Standorten verfügbar |
| Weitere Informationen unter + 49 (221) 74740055 |
Seminartermine
Die Ergebnissliste kann durch Anklicken der Überschrift neu sortiert werden.
