NVIDIA

Senior GPU Supercomputer Scheduler Engineer

PythonDockerC++Go
Automatische Übersetzung. Prüfe das Original.

Über die Stelle

NVIDIA ist ein Pionier im Bereich des beschleunigten Rechnens, bekannt für die Erfindung der GPU und bahnbrechende Fortschritte in den Bereichen Gaming, Computergrafik, High-Performance Computing und künstliche Intelligenz. Unsere Technologie treibt alles an, von generativer KI bis hin zu autonomen Systemen, und wir gestalten weiterhin die Zukunft des Rechnens durch Innovation und Zusammenarbeit.

Im Rahmen dieser Mission baut und skaliert unser Team, Managed AI Research Superclusters (MARS), die Infrastruktur, Plattformen und Tools, die es Forschern und Ingenieuren ermöglichen, die nächste Generation von KI/ML-Systemen zu entwickeln. Wenn Sie zu uns kommen, helfen Sie dabei, Lösungen zu entwerfen, die einige der weltweit fortschrittlichsten Rechen-Workloads antreiben.

Als Mitglied des Scheduling-Teams wirken Sie an der Konzeption und Implementierung bahnbrechender GPU-Rechencluster mit, die anspruchsvolle deep learning, High-Performance Computing und rechenintensive Workloads ausführen. Wir suchen Ingenieure mit fundierter technischer Expertise, um architektonische Richtungen und neue Ansätze für die Planung von KI-Workloads zu identifizieren, um viele gleichzeitige und große Multi-Node-GPU-Workloads mit komplexen Anforderungen und Abhängigkeiten zu bedienen. Diese Rolle bietet Ihnen eine hervorragende Gelegenheit, produktionsreife Lösungen bereitzustellen, praktische Erfahrungen mit bahnbrechender Technologie zu sammeln und eng mit technischen Führungskräften zusammenzuarbeiten, um einige der größten Herausforderungen in den Bereichen machine learning, Cloud Computing und System-Co-Design zu lösen.

Ihre Aufgaben

  1. Konzeption und Entwicklung neuer Scheduling-Funktionen und Zusatzdienste zur Verbesserung von GPU-Rechenclustern in vielen Dimensionen, wie z. B. Fairness bei der Ressourcennutzung, GPU-Auslastung, GPU-Verschwendung, Anwendungsresilienz, Anwendungsleistung und Energieverbrauch.
  1. Konzeption und Entwicklung von Diensten für das Batch-Workload-Management und die Orchestrierung.
  1. Unterstützung von Mitarbeitern und Endbenutzern bei der Lösung von Problemen mit dem Batch-Scheduler.
  1. Aufbau und Verbesserung unseres Ökosystems rund um GPU-beschleunigtes Rechnen.
  1. Leistungsanalyse und Optimierungen von deep learning-Workflows.
  1. Entwicklung von Automatisierungslösungen im großen Maßstab.
  1. Ursachenanalyse und Vorschläge für Korrekturmaßnahmen bei Problemen in kleinen und großen Maßstäben.
  1. Identifizierung und Behebung von Problemen, bevor sie auftreten.

Was wir erwarten

  1. Abgeschlossenes Bachelorstudium in Informatik, Elektrotechnik oder einem verwandten Fachbereich oder eine vergleichbare Qualifikation.
  1. 5+ Jahre Berufserfahrung.
  1. Fundiertes Verständnis von Batch-Scheduling, vorzugsweise mit Erfahrung in Schedulern wie SLURM oder K8s Batch-Schedulern (Kueue, Volcano, etc.).
  1. Signifikante Erfahrung in Systemprogrammiersprachen wie C/C++ & Go sowie Skriptsprachen wie Python und Bash.
  1. Nachgewiesene Erfahrung mit dem Linux-Betriebssystem, der Umgebung und den Tools.
  1. Erfahrung in der Analyse und Leistungsoptimierung für eine Vielzahl von KI-Workloads.
  1. Tiefgreifendes Verständnis von Container-Technologien wie Docker, Singularity, Podman.
  1. Flexibilität und Anpassungsfähigkeit für die Arbeit in einem dynamischen Umfeld mit unterschiedlichen Frameworks und Anforderungen.
  1. Ausgezeichnete Kommunikations-, zwischenmenschliche und Kundenbetreuungsfähigkeiten.

Damit heben Sie sich ab

  1. Kenntnisse im High-Performance Computing.
  1. Beiträge zu Open-Source-Software.
  1. Erfahrung mit deep learning-Frameworks wie PyTorch und TensorFlow.
  1. Leidenschaft für Softwareentwicklungsprozesse.

Ihr Grundgehalt wird basierend auf Ihrem Standort, Ihrer Erfahrung und der Vergütung von Mitarbeitern in ähnlichen Positionen festgelegt. Die Grundgehaltsspanne liegt bei 152,000 USD - 241,500 USD für Level 3 und bei 184,000 USD - 287,500 USD für Level 4.

Bewerbungen für diese Stelle werden mindestens bis zum 17. August 2026 entgegengenommen.

Diese Ausschreibung bezieht sich auf eine bestehende Vakanz.

NVIDIA verwendet KI-Tools in seinen Rekrutierungsprozessen.

NVIDIA engagiert sich für die Förderung eines inklusiven Arbeitsumfelds und ist stolz darauf, ein Arbeitgeber zu sein, der Chancengleichheit bietet. Da wir Vielfalt bei unseren aktuellen und zukünftigen Mitarbeitern sehr schätzen, diskriminieren wir nicht (auch nicht bei unseren Einstellungs- und Beförderungspraktiken) aufgrund von Rasse, Religion, Hautfarbe, nationaler Herkunft, Geschlecht, Geschlechtsausdruck, sexueller Orientierung, Alter, Familienstand, Veteranenstatus, Behinderung oder anderen gesetzlich geschützten Merkmalen.

Sie haben zudem Anspruch auf Aktienbeteiligung und Sozialleistungen nvidia.com/en-us/benefits/.

Mehr Möglichkeiten mit einem Profil

Für mehr Stellen berücksichtigt werden, ohne den ganzen Prozess zu wiederholen? Erstellen Sie Ihr Profil, damit Unternehmen auf Nort Sie finden.

Profil erstellen

Dein nächster Jobsucht schon nach dir.

Nort

Reverse-Recruiting- Plattform für Entwickler

RechtlichesNutzungsbedingungenDatenschutznortjobs © 2026