Seminar / Training
Beschleunigte Workloads reagieren empfindlich auf Topologie, Treiber, NUMA, Netzwerk und Ressourcenteilung. Der Kurs baut deshalb einen durchgängigen Pfad von der Hardwareprüfung bis zur überwachten Bereitstellung auf.
Inhaltsübersicht
- Zielsetzung
- Zielgruppe
- Voraussetzungen
- Seminarinhalte
- Praxisübungen
- Methodik
Zielsetzung
- GPU- und HPC-Anforderungen in Host-, Netzwerk- und Storage-Profile übersetzen
- PCI-Passthrough, vGPU und MIG nach Isolation und Auslastung auswählen
- NUMA, CPU-Pinning, NVLink- und Fabric-Anforderungen in Templates abbilden
- Telemetrie, Kapazitätsplanung und sichere Bereitstellung von KI-Services organisieren
Zielgruppe
Cloud- und HPC-Administratoren, AI-Plattformteams, Infrastrukturarchitekten, DevOps und technische Projektleitung.
Voraussetzungen
Gute Kenntnisse in Linux, KVM, PCIe, Netzwerk und OpenNebula. Grundlagen zu NVIDIA-Treibern, CUDA und Container- oder VM-Workloads sind hilfreich.
Seminarinhalte
- Schritt 1: Workload- und Hardwareprofil erstellen
Modellgröße, Speicherbedarf, Interconnect, Datenpfad, Latenz, Parallelität und Isolation werden in technische Mindestanforderungen überführt.
- Schritt 2: IOMMU und PCI-Geräte prüfen
BIOS-Optionen, Kernelparameter, IOMMU-Gruppen, Treiberbindung und Gerätezustand werden vor der Cloud-Integration validiert.
- Schritt 3: PCI-Passthrough konfigurieren
Geräte werden inventarisiert, Hostklassen zugeordnet, in Templates referenziert und mit Start-, Stop- und Migrationseinschränkungen getestet.
- Schritt 4: vGPU und MIG einplanen
Teilbarkeit, Profile, Speichergrenzen, Scheduling, Mandantentrennung und Fragmentierung werden gegenüber dedizierten GPUs bewertet.
- Schritt 5: CPU- und NUMA-Topologie abstimmen
CPU-Pinning, HugePages, NUMA-Nähe und Gerätezuordnung werden so kombiniert, dass unnötige Cross-Socket-Zugriffe vermieden werden.
- Schritt 6: GPU-Fabric und Hochleistungsnetz einordnen
NVLink, NVSwitch, Fabric Manager, InfiniBand, SR-IOV und Spectrum-X werden nach Workload- und Skalierungsbedarf bewertet.
- Schritt 7: Templates für beschleunigte Workloads bauen
GPU, CPU, RAM, Disks, Netzwerke, Kontextualisierung, Treiberanforderungen und Platzierungsregeln werden reproduzierbar abgebildet.
- Schritt 8: Telemetrie und Forecasting aufsetzen
GPU-Auslastung, Speicher, Temperatur, Fehler, Bandbreite und Kapazitätsprognosen werden in Monitoring und Alarmierung integriert.
- Schritt 9: KI-Service bereitstellen und prüfen
Ein modellbasierter Inferenzdienst wird mit definiertem Ressourcenprofil, Netzwerkzugang, Lasttest und Rückbau bereitgestellt.
Praxisübungen
- GPU-Host auf IOMMU-, Treiber- und Topologievoraussetzungen prüfen
- Template mit dediziertem PCI-Passthrough erstellen und starten
- MIG- oder vGPU-Profile hinsichtlich Auslastung und Isolation vergleichen
- NUMA- und CPU-Pinning-Konfiguration für einen Beispielworkload optimieren
- GPU-Telemetrie auswerten und Kapazitätsbedarf ableiten
Methodik
Hardwareprüfung, Template-Arbeit und Lasttests werden eng verbunden. Jede Konfiguration wird gegen Isolation, Performance, Wiederholbarkeit und betriebliche Einschränkungen geprüft.
Fachbereichsleiter / Leiter der Trainer / Ihre Ansprechpartner
-

Lucas Beich
Telefon: + 49 (221) 74740055
E-Mail: lucas.beich@seminar-experts.de -

Paul Goldschmidt
Telefon: + 49 (221) 74740055
E-Mail: paul.goldschmidt@seminar-experts.de
Seminardetails
| Dauer: | 3 Tage ca. 6 h/Tag, Beginn 1. Tag: 10:00 Uhr, weitere Tage 09:00 Uhr |
| Preis: |
Öffentlich oder Live Stream: € 1.797 zzgl. MwSt. Inhaus: € 5.100 zzgl. MwSt. |
| Teilnehmeranzahl: | min. 2 - max. 8 |
| Teilnehmer: | Cloud- und HPC-Administratoren, AI-Plattformteams, Infrastrukturarchitekten, DevOps und technische Projektleitung. |
| Voraussetzungen: | Gute Kenntnisse in Linux, KVM, PCIe, Netzwerk und OpenNebula. Grundlagen zu NVIDIA-Treibern, CUDA und Container- oder VM-Workloads sind hilfreich. |
| Standorte: | Stream Live, Inhaus/Firmenseminar, Berlin, Bremen, Darmstadt, Dresden, Erfurt, Essen, Flensburg, Frankfurt, Freiburg, Friedrichshafen, Hamburg, Hamm, Hannover, Jena, Kassel, Köln, Konstanz, Leipzig, Luxemburg, Magdeburg, Mainz, München, Münster, Nürnberg, Paderborn, Potsdam, Regensburg, Rostock, Stuttgart, Trier, Ulm, Wuppertal, Würzburg |
| Methoden: | Vortrag, Demonstrationen, praktische Übungen am System |
| Seminararten: | Öffentlich, Webinar, Inhaus, Workshop - Alle Seminare mit Trainer vor Ort, Webinar nur wenn ausdrücklich gewünscht |
| Durchführungsgarantie: | ja, ab 2 Teilnehmern |
| Sprache: | Deutsch - bei Firmenseminaren ist auch Englisch möglich |
| Seminarunterlage: | Dokumentation auf Datenträger oder als Download |
| Teilnahmezertifikat: | ja, selbstverständlich |
| Verpflegung: | Kalt- / Warmgetränke, Mittagessen (wahlweise vegetarisch) |
| Support: | 3 Anrufe im Seminarpreis enthalten |
| Barrierefreier Zugang: | an den meisten Standorten verfügbar |
| Weitere Informationen unter + 49 (221) 74740055 |
Seminartermine
Die Ergebnissliste kann durch Anklicken der Überschrift neu sortiert werden.
