Roku
NVIDIA
Senior Manager, Software Engineering - JAX
Über die Stelle
JAX ist das Framework der Wahl für die ambitionierteste KI-Forschung, und die Rechenzentren, auf denen es läuft, entwickeln sich rasant weiter. NVIDIA-Supercomputer werden immer heterogener und kombinieren GPUs, CPUs und LPUs, und JAX muss sich weiterentwickeln, um auf all diesen gut zu funktionieren. NVIDIA sucht einen Senior Engineering Manager, der die JAX-Strategie von NVIDIA definiert und vorantreibt, mehrere Teams und Arbeitsströme koordiniert, um sicherzustellen, dass JAX auf der gesamten Plattform Spitzenleistungen erbringt, von Single-Accelerator-Workloads bis hin zu Hunderttausenden von Geräten auf den größten jemals gebauten Supercomputern.
Ein wichtiger Teil dieser Rolle ist es, sicherzustellen, dass JAX ab dem ersten Tag auf Architekturen der nächsten Generation, einschließlich Rubin Ultra, LPUs und den CPUs, die sie antreiben, einsatzbereit ist. Dies erfordert, mit der Entwicklung der KI Schritt zu halten. Das bedeutet, aufkommende Bedürfnisse in den Bereichen Training, Post-Training, Inferenz und Robotik zu unterstützen und neue Hardwarefähigkeiten mit KI-Trends zu verbinden. Kommen Sie zu uns, um das Team und die Technologie hinter den nächsten KI-Durchbrüchen aufzubauen.
Was Sie tun werden
- Treiben Sie die Engineering-Beitragsstrategie für den gesamten JAX-Ökosystem-Stack voran – einschließlich JAX Core, XLA, Shardy, MPMD und Codebasen auf Anwendungsebene wie MaxText – und priorisieren Sie, wo die Beiträge von NVIDIA die größte Wirkung auf Leistung, Akzeptanz und Ökosystem-Einfluss erzielen.
- Fördern Sie die Teamarbeit über organisatorische Grenzen hinweg, um die KI-Plattform von NVIDIA über Compiler (XLA, TileIR, CUDA), Laufzeit-, Netzwerk- und Hardwareteams hinweg zu gestalten.
- Bauen Sie tiefe Partnerschaften mit wichtigen Open-Source-Projekten auf, insbesondere mit dem JAX-Team von Google – unterstützen Sie unsere Partner und vertreten Sie gleichzeitig die Interessen von NVIDIA bei der Gestaltung der Projektrichtung.
- Entwerfen Sie Prozesse und definieren Sie klare Erfolgskriterien, um die Teams auf die Ergebnisse auszurichten.
- Erstellen Sie Personalpläne, überprüfen Sie die Teamkapazität und treffen Sie strategische Einstellungsentscheidungen, um den aktuellen und zukünftigen Anforderungen gerecht zu werden.
- Leiten, entwickeln und fördern Sie eine leistungsstarke Engineering-Organisation – entwickeln Sie technische Führungskräfte und schaffen Sie Raum für Ihr Team, um zu experimentieren, Prototypen zu erstellen und innovative Systeme zu entwickeln, die Produkte und Prozesse verbessern.
Was wir sehen müssen
- Master-Abschluss oder Promotion in Informatik, Computertechnik oder einem verwandten Fachgebiet (oder gleichwertige Erfahrung).
- Mindestens 10 Jahre Softwareentwicklungs-Erfahrung, davon mindestens 4 Jahre in der technischen Leitung oder im Engineering Management.
- Starker technischer Hintergrund in Systemsoftware, Compilern, Hochleistungsrechnen oder KI-Frameworks.
- Nachgewiesene Erfahrung in der Leitung von domänenweiten Strategien und Projekten, die organisatorische Grenzen überschreiten, Konsensbildung, Einflussnahme ohne direkte Autorität und Anpassung der Kommunikation an das jeweilige Publikum, von Ingenieuren bis zu Führungskräften.
- Nachweisbare Erfolge bei der Verantwortung für Ergebnisse über mehrere Projekte und Teams hinweg, Abwägung von Kompromissen und Vorantreiben von Fortschritten bei unvollständigen Informationen.
- Erfahrung in der Identifizierung von Lücken im Entwicklungszyklus und der Definition von Arbeitsabläufen über Teams und Organisationen hinweg zur Verbesserung der Effizienz.
- Erfahrung in der Leitung von Teams, die zu groß angelegten Projekten mit externen Partnern beitragen.
Wege, sich von der Masse abzuheben
- Praktische Erfahrung mit JAX und seinen Systemen wie XLA, HLO, PJRT, Shardy oder dem Tracing- und Transformationssystem von JAX.
- Erfahrung in der Leitung von Teams, die an Compiler- oder Laufzeitinfrastrukturen für deep learning-Frameworks (JAX, PyTorch, TensorFlow oder gleichwertig) arbeiten.
- Vertrautheit mit den KI-Plattformkomponenten von NVIDIA: GPU-Programmierung, CUDA, cuDNN, NCCL, TensorRT, Transformer Engine und heterogenen Rechenzielen (GPU, CPU, LPU).
- Erfahrung in der Durchführung von Leistungsoptimierungsbemühungen für groß angelegte verteilte KI-Trainings-, Post-Training- (RLHF, Alignment), Inferenz- oder Robotik-Workloads (Multi-Node, Multi-GPU).
- Erfahrung in der Durchführung von Framework- oder Software-Bring-ups auf neuen Hardware-Architekturen, Koordination zwischen Silizium-, Treiber-, Compiler- und Framework-Teams.
Ihr Grundgehalt wird basierend auf Ihrem Standort, Ihrer Erfahrung und dem Gehalt von Mitarbeitern in ähnlichen Positionen festgelegt. Die Gehaltsspanne für das Grundgehalt beträgt 272,000 USD - 431,250 USD.
Sie haben außerdem Anspruch auf Aktienoptionen und Zusatzleistungen unter nvidia.com/en-us/benefits/.
Bewerbungen für diese Stelle werden mindestens bis zum 7. August 2026 entgegengenommen.
Diese Ausschreibung bezieht sich auf eine bestehende Stelle.
NVIDIA nutzt KI-Tools in seinen Rekrutierungsprozessen.
NVIDIA setzt sich für die Förderung eines integrativen Arbeitsumfelds ein und ist stolz darauf, ein Arbeitgeber zu sein, der Chancengleichheit bietet. Da wir die Vielfalt unserer aktuellen und zukünftigen Mitarbeiter sehr schätzen, diskriminieren wir nicht (auch nicht in unseren Einstellungs- und Beförderungspraktiken) aufgrund von Rasse, Religion, Hautfarbe, nationaler Herkunft, Geschlecht, Geschlechtsausdruck, sexueller Orientierung, Alter, Familienstand, Veteranenstatus, Behinderungsstatus oder anderen gesetzlich geschützten Merkmalen.
