Nscale

Senior Infrastructure Engineer (OpenStack Ironic Specialist)

Python
Automatische Übersetzung. Prüfe das Original.

ÜBER NSCALE

Nscale ist die GPU-Cloud, die für KI entwickelt wurde. Wir bieten kostengünstige, leistungsstarke Infrastruktur für KI-Start-ups und große Unternehmenskunden. Nscale ermöglicht KI-fokussierten Unternehmen, überlegene Ergebnisse zu erzielen, indem die Komplexität der KI-Entwicklung reduziert wird. Unsere GPU-Cloud stärkt die technischen Fähigkeiten und unterstützt direkt strategische Geschäftsergebnisse, einschließlich Kostenmanagement, schneller Innovation und Umweltverantwortung.

Wir leben eine Kultur unermüdlicher Innovation, Eigenverantwortung und Rechenschaftspflicht, in der jedes Teammitglied stolz auf seine Arbeit ist und diese mit Exzellenz und Dringlichkeit vorantreibt. Als Nscaler bauen Sie Vertrauen durch Offenheit und Transparenz auf, wo jeder inspiriert ist, sein Bestes zu geben. Wenn Sie unserem Team beitreten, tragen Sie zum Aufbau der Technologie bei, die die Zukunft antreibt.

ÜBER DIE ROLLE

Wir suchen einen Infrastructure Engineer (OpenStack Ironic Specialist), der die Bare-Metal-Provisionierungsplattformen entwirft, betreibt und kontinuierlich verbessert, die die Infrastruktur von Nscale untermauern.

Diese Rolle ist Teil des Infrastructure Engineering Teams, das für das Design, die Implementierung, den Betrieb und die kontinuierliche Verbesserung des Infrastruktur-Stacks verantwortlich ist, der sowohl interne als auch kundenorientierte Dienste unterstützt.

Sie arbeiten eng mit Netzwerk-, Compute-, Rechenzentrums-, Support- und Pre-Sales-Teams zusammen und fungieren als spezialisierter Eskalationspunkt für fortgeschrittene Provisionierungs- und Hardwareprobleme.

Dies ist eine Rolle mit hoher Wirkung, die sich auf OpenStack Ironic, automatisiertes Hardware-Lifecycle-Management und den zuverlässigen Betrieb von physischer Infrastruktur im großen Maßstab konzentriert. Sie werden auch dazu beitragen, Nscale mit der breiteren Upstream-OpenStack-Community zu verbinden und sicherzustellen, dass sich unsere Bare-Metal-Plattformen im Einklang mit realen Betriebsanforderungen und der Branchenausrichtung weiterentwickeln.

WAS SIE TUN WERDEN

Bare-Metal-Provisionierung und Lifecycle-Management

  1. Entwerfen skalierbarer und ausfallsicherer Bare-Metal-Provisionierungsplattformen mit starkem Fokus auf OpenStack Ironic.
  1. Verantwortlich für den gesamten Lebenszyklus der physischen Infrastruktur, einschließlich Erkennung, Registrierung, Provisionierung, Bereinigung, Stilllegung und Verwaltung des Hardwarezustands.
  1. Erstellen und Pflegen von Provisionierungsworkflows für eine breite Palette von Hardwareprofilen, einschließlich GPU-fähiger und Hochleistungs-Serverplattformen.
  1. Unterstützung von Plattform-Upgrades, Lifecycle-Management und betrieblichen Verbesserungen über Ironic und seine Abhängigkeiten hinweg.

Automatisierung und Plattformintegration

  1. Verwalten und Verbessern von Integrationen zwischen Ironic und verwandten OpenStack-Diensten wie Nova, Neutron, Glance, Keystone und Placement.
  1. Vorantreiben der Automatisierung für Hardware-Onboarding, Firmware- und BIOS-Konfiguration, Deployment-Workflows, Validierung und Wiederherstellung.
  1. Implementieren von Infrastrukturautomatisierung mithilfe von Infrastructure-as-Code- und Konfigurationsmanagement-Ansätzen.
  1. Sicherstellen, dass Provisionierungsplattformen und Betriebsprozesse mit Sicherheits-, Compliance- und Betriebsstandards übereinstimmen.

Fehlerbehebung, Zuverlässigkeit und operativer Support

  1. Beheben komplexer Probleme in Provisionierungs-Pipelines, PXE/iPXE, BMC-Schnittstellen, Out-of-Band-Management, Image-Deployment, Netzwerk-Boot und Hardwarekompatibilität.
  1. Als 3- oder 4-stufiger Eskalationspunkt für fortgeschrittene Bare-Metal- und Provisionierungsereignisse fungieren.
  1. Durchführen von Ursachenanalysen und Implementieren langfristiger Korrekturen zur Verbesserung der Plattformzuverlässigkeit und Wiederholbarkeit.
  1. Teilnahme an Bereitschaftsdiensten und Incident-Response-Aktivitäten für kritische Infrastrukturdienste.

Funktionsübergreifende Zusammenarbeit und Community-Engagement

  1. Zusammenarbeit mit Netzwerk-, Compute-, Rechenzentrums- und Support-Teams zur Bereitstellung zuverlässiger physischer Infrastrukturdienste.
  1. Bereitstellen von Fachwissen für die Planung der Infrastruktur-Roadmap, Kapazitätserweiterung, Standard-Builds und Qualifizierung von Hardwareplattformen.
  1. Unterstützung von Pre-Sales- und Lösungsdesign-Bemühungen mit fachkundiger Anleitung zu Bare-Metal-Fähigkeiten, Betriebsmodellen und Deployment-Beschränkungen.
  1. Beitrag zu Upstream-OpenStack-Bare-Metal-Communities durch Bug-Reports, Tests, Reviews, Design-Diskussionen und gegebenenfalls Code-Beiträge.
  1. Verfolgen von Upstream-Roadmaps und Release-Änderungen, um die Bare-Metal-Strategie, Upgrade-Planung und Plattformstandards von Nscale mitzugestalten.

KPIs

  1. Zuverlässigkeit der automatisierten Provisionierung und des Hardware-Onboardings
  1. Behebung von Bare-Metal-Vorfällen und Abschluss von Ursachenanalysen
  1. Bereitstellung von Plattform-Upgrades und Lebenszyklen über Ironic-Abhängigkeiten hinweg
  1. Beitrag zur Upstream-OpenStack-Ironic-Community und Ausrichtung auf die Akzeptanz

ÜBER SIE

  1. Umfangreiche Erfahrung im Betrieb von Linux-Systemen und in der Fehlerbehebung von Produktionsinfrastrukturen
  1. Umfassende Spezialkenntnisse in OpenStack Ironic und dem umgebenden Provisionierungs-Ökosystem
  1. Gutes Verständnis von Bare-Metal-Provisionierungskonzepten, einschließlich PXE/iPXE, DHCP, TFTP/HTTP-Boot, BMC-Technologien, RAID-Konfiguration, Firmware-Management, Disk-Imaging und Node-Lifecycle-Status
  1. Umfangreiche Erfahrung mit Out-of-Band-Management-Technologien wie Redfish, IPMI oder herstellerspezifischen Management-Schnittstellen
  1. Umfangreiche Erfahrung im Entwurf und Aufbau von Automatisierung für physische und virtuelle Infrastrukturen mit Tools wie Ansible
  1. Starke Skripting-Kenntnisse in Python und Bash
  1. Erfahrung in der Fehlerbehebung komplexer Provisionierungs- und Hardwareintegrationsprobleme über Server-, Netzwerk- und Management-Ebenen hinweg
  1. Erfahrung im Betrieb von Infrastrukturen im großen Maßstab mit Fokus auf Zuverlässigkeit, Wiederholbarkeit und Betriebssicherheit
  1. Fähigkeit zur Zusammenarbeit mit Infrastruktur-, Support- und Architekturteams zur Lösung komplexer technischer Probleme
  1. Erfahrung in der Mitarbeit oder engen Zusammenarbeit mit Upstream-Open-Source-Communities, insbesondere OpenStack, Ironic, Metal3 oder verwandten Infrastrukturprojekten, ist sehr wünschenswert

WAS WIR IHNEN BIETEN KÖNNEN

Bei Nscale finden Sie ein kollaboratives, unterstützendes und innovatives Umfeld, in dem Ihre Beiträge echten Einfluss haben. Wir bauen etwas Außergewöhnliches auf, und Sie stehen im Mittelpunkt.

Hochkompetitives US-Vergütungspaket (Basisgehalt + Bonus + Aktienoptionen) mit Leistungsüberprüfungen alle 12 Monate. 🚀

Treten Sie einem der am schnellsten wachsenden KI-Infrastrukturunternehmen bei – Ihre Chance, direkt zu gestalten, wie die globale KI-Kapazität geplant und bereitgestellt wird. ✨

Erwarten Sie einen dynamischen Fortschrittsplan, der auf Ihre Ambitionen zugeschnitten ist. Wachsen Sie, indem Sie kritische funktionsübergreifende Initiativen leiten und die Kapitalstrategie gestalten – immer mit unserer vollen Unterstützung.

Human-First-Flexibilität: Wir behandeln Sie zuerst als Menschen. 🫶🏽 Unser flexibler Arbeitsplatz vertraut Nscalern, Ergebnisse zu liefern, und gibt Ihnen die Autonomie, Ihren Tag um die Momente des Lebens zu gestalten.

ERKLÄRUNG ZU GLEICHEN CHANCEN

Wir ermutigen ausdrücklich Bewerbungen von Menschen of Colour, der LGBTQ+-Community, Menschen mit Behinderungen, neurodivergenten Menschen, Eltern, Betreuern und Menschen aus sozioökonomisch benachteiligten Verhältnissen.

Wenn es etwas gibt, das wir tun können, um Ihre spezifische Situation zu berücksichtigen, lassen Sie es uns bitte wissen.

Die in dieser Stellenbeschreibung aufgeführten Verantwortlichkeiten sind nicht abschließend und dienen dazu, einen allgemeinen Überblick über die Position zu geben. Der Mitarbeiter kann aufgefordert werden, zusätzliche Aufgaben, Tätigkeiten und Verantwortlichkeiten zu übernehmen, wie vom Management zugewiesen, im Einklang mit den für die Rolle erforderlichen Fähigkeiten und Qualifikationen.

Informationen darüber, wie Nscale personenbezogene Daten von Kandidaten verarbeitet, finden Sie in unserer Mitteilung zum Datenschutz für Mitarbeiter und Kandidaten: Hier.

Informationen darüber, wie Nscale personenbezogene Daten von Kandidaten verarbeitet, finden Sie in unserer Mitteilung zum Datenschutz für Mitarbeiter und Kandidaten: Hier.

GEHALTSBANDBREITE

Die nachstehende Spanne spiegelt das Grundgehalt für die Position wider. Die tatsächliche Vergütung kann je nach berufsbezogenen Faktoren wie Fähigkeiten, Erfahrung, Ausbildung und Standort variieren. Zusätzlich zum Grundgehalt kann diese Rolle für Bonus-, Aktienoptions- und/oder Provisionsprogramme in Frage kommen. Nscale kann ein wettbewerbsfähiges Leistungspaket anbieten, einschließlich Kranken-, Zahn- und Sehkrankenversicherung, flexible bezahlte Urlaubszeit, Elternzeit und Teilnahme an einem Altersvorsorgeplan.

Informationen darüber, wie Nscale personenbezogene Daten von Kandidaten verarbeitet, finden Sie in unserer Mitteilung zum Datenschutz für Mitarbeiter und Kandidaten: Hier. drive.google.com/file/d/1QK5Yg04WHD9K9IAtJgQWubJZC9oLvatK/view?usp=sharing

Nscale akzeptiert keine unaufgeforderten Kandidatenvorschläge von Personalvermittlungsagenturen.

Mehr Möglichkeiten mit einem Profil

Für mehr Stellen berücksichtigt werden, ohne den ganzen Prozess zu wiederholen? Erstellen Sie Ihr Profil, damit Unternehmen auf Nort Sie finden.

Profil erstellen

Dein nächster Jobsucht schon nach dir.

Nort

Reverse-Recruiting- Plattform für Entwickler

RechtlichesNutzungsbedingungenDatenschutznortjobs © 2026