SONDA
DYNE Group
SRE – OPENSTACK / PRIVATE CLOUD OPERATIONS
PythonKubernetesGo
Automatische Übersetzung. Prüfe das Original.
Über die Rolle
Wir suchen einen SRE mit starker Erfahrung in OpenStack und Private-Cloud-Umgebungen.
Die Rolle konzentriert sich auf Produktionsunterstützung, Fehlerbehebung und Plattformzuverlässigkeit.
Erfordert praktische Expertise in Linux, Netzwerken und Speicher.
Umfasst die enge Zusammenarbeit mit Entwicklungsteams und Kundeninteraktion.
Hauptverantwortlichkeiten
- Behebung komplexer Probleme in Linux- und OpenStack-Umgebungen
- Verwaltung und Unterstützung von OpenStack-Diensten wie Nova, Neutron, Cinder und Keystone
- Durchführung von Ursachenanalysen (RCA) und Förderung langfristiger Lösungen
- Teilnahme am Incident Management und Bereitschaftsdiensten
- Überwachung der Systemleistung, Verfügbarkeit und Zuverlässigkeit
- Zusammenarbeit mit Entwicklungsteams an Korrekturen und Verbesserungen
- Effektive Kommunikation mit Kunden per Anruf und schriftlich
- Systemoptimierung und Performance-Tuning
Anforderungen
Linux, Netzwerk- & Speicher-Grundlagen
- Starkes Verständnis der Linux-Interna und der Systemleistung
- Erfahrung mit Kernel-Tuning und Fehlerbehebung
- Praktische Erfahrung mit Dateisystemen und Festplattenverwaltung
- Kenntnisse über Partitionen und systemweite Fehlerbehebung
- Erfahrung mit LVM und SCSI Multipath
- Grundlegendes Verständnis von Ceph
- Fähigkeit zur Fehlerbehebung bei I/O- und Leistungsproblemen
- Kenntnisse in DHCP, DNS, VLANs und Netzwerk-Bonding
- Verständnis grundlegender Routing-Konzepte
OpenStack-Betrieb & Fehlerbehebung
- Praktische Erfahrung mit OpenStack-Diensten wie Nova, Neutron, Cinder und Keystone
- Erfahrung in der Verwaltung von Produktionsumgebungen
- Starke Fähigkeiten in Fehlerbehebung und Debugging
- Fähigkeit, kundenorientierte technische Probleme zu lösen
- Erfahrung in der Durchführung von Ursachenanalysen
Wünschenswerte Fähigkeiten
- Grundlegendes Verständnis von Kubernetes-Konzepten
- Erfahrung mit Monitoring-Tools wie Prometheus und Grafana
- Kenntnisse von Metriken, Logging und Alerting-Systemen
- Grundlegende Skripting-Kenntnisse in Python oder Go
- Erfahrung mit Automatisierungs- und Observability-Praktiken
Soft Skills
- Starke Problemlösungs- und analytische Denkfähigkeiten
- Fähigkeit, in produktionskritischen Umgebungen unter Druck zu arbeiten
- Klare und effektive Kommunikationsfähigkeiten
- Proaktive Einstellung zur Vermeidung von Problemen
- Komfortable Arbeit in verteilten Remote-Teams
