NVIDIA

Principal Systems Software Engineer, LPU

KubernetesRust
Automatische Übersetzung. Prüfe das Original.

Über die Stelle

Wir suchen ab sofort einen Principal Software Engineer für LPX System Software!

Das LPX System Software Team von NVIDIA entwickelt die grundlegende Software, die eine neuartige deterministische Computing-Architektur in eine Plattform verwandelt, auf die sich Compiler-Teams und Rechenzentrumsbetreiber verlassen können. Wir verlagern Komplexität aus Silizium in Software: die Hardware-Abstraktionsschichten, Kernsystembibliotheken, Treiber und Laufzeitkomponenten, über die Workloads auf die Plattform gelangen. Wir bauen diesen Stack in Rust. Für Systemsoftware, die an der Grenze zwischen Hardware und allem darüber liegenden liegt, betrachten wir Speichersicherheit, explizites Eigentum und die Langzeitstabilität von API als Grundlage, nicht als Ziel – die Basis, die es uns ermöglicht, unser Urteilsvermögen auf die harten Probleme zu konzentrieren, anstatt auf Fehlerklassen, die nicht existieren sollten.

Was Sie tun werden

Als einer der leitenden Ingenieure in diesem Stack legen Sie die technische Richtung für die von Ihnen verantworteten Schnittstellen fest und gestalten die Gesamtarchitektur zusammen mit Ihren Kollegen. Entwerfen Sie die HAL, Laufzeitschnittstellen und Datenbewegungs-Pipelines, auf die sich der Rest der Plattform stützt; treiben Sie die schwierigsten Zuverlässigkeits- und Inbetriebnahme-Probleme zur Ursachenanalyse; und erhöhen Sie den Durchsatz der gesamten Organisation, indem Sie die Abstraktionen, Muster und Werkzeuge kodifizieren, auf denen andere aufbauen. Sie werden auch helfen zu definieren, wie wir entwickeln. Wir betrachten KI-Codierungsagenten als Hauptbestandteil des Workflows, und wir erwarten von unseren erfahrensten Ingenieuren, dass sie diese effektiv steuern können – Systeme entwerfen, die sowohl für Menschen als auch für Agenten lesbar sind, und hart erarbeitetes Urteilsvermögen in Hebelwirkung für das gesamte Team umwandeln.

  1. Gestalten Sie die Architektur der Hardware-Abstraktionsschichten und Kernsystembibliotheken und verantworten Sie die API-Verträge für die von Ihnen geführten Komponenten.
  1. Entwerfen und implementieren Sie Treiber, Laufzeitsysteme sowie Datenbewegungs- und Aggregations-Pipelines, die Workloads auf neuartiger Hardware ausführen.
  1. Erstellen Sie Laufzeitschnittstellen für das Starten, Überwachen und Verwalten von Workloads in Produktionsumgebungen.
  1. Treiben Sie die Triage der schwierigsten Sequenzierungs-, Initialisierungs- und plattformübergreifenden Laufzeitfehler voran und erstellen Sie Ursachenanalysen, die die Art und Weise ändern, wie das System aufgebaut ist.
  1. Leiten Sie die Inbetriebnahme neuer Plattformen und NPIs für neue Boards und Siliziumchips in enger Zusammenarbeit mit dem Hardware-Engineering, den Compiler-Teams und dem Rechenzentrumsbetrieb.
  1. Multiplizieren Sie das Team – etablieren Sie die KI-gestützten Entwicklungspraktiken, wiederverwendbaren Abstraktionen, Diagnosen und Dokumentationen, die es jedem ermöglichen, schneller voranzukommen, ohne die Plattform zu destabilisieren.
  1. Kommunizieren Sie Architektur- und Design-Trade-offs klar und deutlich, schriftlich und in Diagrammen, an Zielgruppen, die von einzelnen Ingenieuren bis hin zu Führungskräften reichen.

Was wir sehen müssen

  1. MS in CS, CE, EE oder einem verwandten MINT-Fach oder gleichwertige Erfahrung und 12+ Jahre Erfahrung in der Entwicklung von Produktionssystemsoftware.
  1. Tiefgreifende Systemprogrammierkenntnisse, wobei Rust Ihre bevorzugte Sprache für Low-Level-Arbeiten ist. Sie haben Produktions-Rust an der Hardware- oder Kernel-Grenze ausgeliefert – Treiber, Firmware, Laufzeitsysteme oder Ähnliches – und Sie können aus Erfahrung darlegen, wo Rust seine Stärken in der Systemsoftware ausspielt und wo es Sie kostet. Wir arbeiten vom ersten Tag an in Rust; Komfort ist nicht genug, wir wollen Überzeugung.
  1. Eine nachgewiesene Erfolgsbilanz im Entwurf und der Weiterentwicklung von Bibliotheken und APIs, die über Jahre hinweg unterstützt werden sollen, einschließlich ABI- und Kompatibilitätsdisziplin.
  1. Fließende Kenntnisse in großen Codebasen mit mehreren Repositories und geschichteten Abhängigkeiten.
  1. Nachgewiesene Führungsqualitäten bei der Triage schwieriger Zuverlässigkeitsprobleme bis hin zu klaren, schriftlichen Ursachenanalysen.
  1. Low-Level-Plattformerfahrung: Firmware und Boot-Flows, RTOS, BMCs/MCUs, RISC-V oder eng verwandte Systemsoftware.
  1. Linux-Treiber- oder Kernel-nahe Erfahrung (z. B. VFIO oder ähnliche Subsysteme).
  1. Erfahrung mit Hardware-Inbetriebnahme und System-Triage: Fehleranalyse, Diagnostik und Validierung in Laborumgebungen.
  1. Eine etablierte Gewohnheit: Entwicklung mit KI-Codierungsagenten – nicht als Neuheit, sondern als Methode, mit der Sie bereits ausliefern und Ihre Hebelwirkung erhöhen. Sie können darlegen, wie Sie Arbeit agentenfreundlich gestalten und wo Sie Menschen einbeziehen.

Wege, sich abzuheben

  1. Erfahrung in der Entwicklung von Rust-Systemsoftware im Maßstab eines Hyperscalers oder eines Rust-nativen Hardwareunternehmens – der Art von Umfeld, in dem Rust die Produktionssprache für Low-Level-Arbeiten ist, kein Experiment.
  1. Erfahrung mit verteilten Systemen: gRPC und RPC-Frameworks, Koordinations- und Telemetriemuster, MPI. Erfahrung mit Inferenzsystemen und Token Serving (vLLM oder ähnliche Serving- und Laufzeit-Stacks) ist ein großer Pluspunkt.
  1. Erfahrung in der Auslieferung und Unterstützung kundenorientierter SDKs, einschließlich Dokumentation und ABI-Kompatibilitätspraktiken.
  1. Produktionsbereitschaft und Liefertiefe: CI/CD- und Release-Workflows, Monitoring- und Alerting-Praktiken, Kubernetes und operative Workflows für Rechenzentren.

Als einer der begehrtesten Arbeitgeber der Technologiebranche beschäftigt NVIDIA einige der fortschrittlichsten und fleißigsten Menschen der Welt, die mit uns die Zukunft gestalten. Sind Sie eine kreative und kollaborative Software-Führungskraft, die neue Herausforderungen sucht? Dann möchten wir von Ihnen hören! Kommen Sie zu uns und helfen Sie beim Aufbau der kosteneffizienten Echtzeit-KI-Inferenz- und Computing-Plattform, die unseren Erfolg in diesem spannenden und schnell wachsenden Bereich vorantreibt.

Ihr Grundgehalt wird basierend auf Ihrem Standort, Ihrer Erfahrung und der Bezahlung von Mitarbeitern in ähnlichen Positionen festgelegt. Die Gehaltsspanne für das Grundgehalt beträgt 272,000 USD - 431,250 USD.

Sie haben außerdem Anspruch auf Aktienoptionen und Zusatzleistungen nvidia.com/en-us/benefits/.

Bewerbungen für diese Stelle werden bis mindestens zum Juli 4, 2026 angenommen.

Diese Ausschreibung bezieht sich auf eine bestehende Stelle.

NVIDIA nutzt KI-Tools in seinen Rekrutierungsprozessen.

NVIDIA setzt sich für die Förderung eines integrativen Arbeitsumfelds ein und ist stolz darauf, ein Arbeitgeber der Chancengleichheit zu sein. Da wir die Vielfalt unserer aktuellen und zukünftigen Mitarbeiter sehr schätzen, diskriminieren wir nicht (einschließlich unserer Einstellungs- und Beförderungspraktiken) aufgrund von Rasse, Religion, Hautfarbe, nationaler Herkunft, Geschlecht, Geschlechtsausdruck, sexueller Orientierung, Alter, Familienstand, Veteranenstatus, Behinderungsstatus oder anderen gesetzlich geschützten Merkmalen.

Mehr Möglichkeiten mit einem Profil

Für mehr Stellen berücksichtigt werden, ohne den ganzen Prozess zu wiederholen? Erstellen Sie Ihr Profil, damit Unternehmen auf Nort Sie finden.

Profil erstellen

Dein nächster Jobsucht schon nach dir.

Nort

Reverse-Recruiting- Plattform für Entwickler

RechtlichesNutzungsbedingungenDatenschutznortjobs © 2026