Ceph im HPC-Umfeld: Architekturfallen, Betriebserfahrungen und Skalierung in die Petabyte
Ceph gilt als flexible Open-Source-Lösung für verteilten Storage; Im HPC-Umfeld mit hunderten Compute-Nodes, Mixed-Media-Clustern und High-Speed-Netzwerken bis 400 GbE offenbart sich schnell, wo Standard-Deployments an ihre Grenzen stoßen.
Dieser Vortrag teilt praxiserprobte Erfahrungen aus dem Betrieb von PB-Clustern: Von OSD-Layout-Entscheidungen bei gemischten HDD/NVMe-Clustern, über Single-MDS-Cases und deren Nachwirkungen, bis hin zu Netzwerkdesign für maximalen Durchsatz; Mit Blick auf wachsende KI-Workloads.
Vorkenntnisse
Grundlegendes Verständnis von Cluster-Storage-Konzepten ist hilfreich, aber keine Voraussetzung.
Lernziele
Teilnehmende kennen nach dem Vortrag die kritischen Stellschrauben bei Ceph-Deployments im HPC-Kontext:
- Welche Designentscheidungen haben langfristige Auswirkungen?
- Wo lauern typische Betriebsfallen?
- Wie skaliert Ceph auf PB mit hunderten Compute-Nodes (Ohne böse Überraschungen?)
- Und warum es jeder auch daheim mal im kleinen Angehen sollte.