Launch Legends
NVIDIA
Senior AI und Quant DevTech Engineer
Über die Stelle
Wir suchen einen Softwareentwickler mit starkem Hintergrund in paralleler Verarbeitung und GPU-Architektur, um die Leistungsgrenzen an der Schnittstelle von KI, Hochleistungsrechnen und Finanzmärkten zu verschieben. In dieser Rolle werden Sie tief in parallele Algorithmen, GPUs und hochentwickelte Systeme eintauchen, Engpässe identifizieren und beseitigen, um die volle Leistung der weltweit fortschrittlichsten Prozessoren freizusetzen.
Sie werden mit führenden Experten aus Industrie und Wissenschaft zusammenarbeiten, die nächste Generation von Plattformen beeinflussen und Ihre Erkenntnisse mit der globalen Entwickler-Community teilen. Haben Sie Freude daran, schwierige technische Probleme zu lösen, lieben Sie Performance-Tuning und möchten Sie, dass Ihre Arbeit sichtbare Auswirkungen auf eine ganze Branche hat? Wenn ja, würden wir uns freuen, wenn Sie diese Rolle in Betracht ziehen.
Was Sie tun werden
- Entwerfen und Entwickeln bahnbrechender Techniken zur Beschleunigung von Hochleistungs-Workloads an der Schnittstelle von KI, Mathematik und Finanz- systemen.
- Enge Zusammenarbeit mit führenden technischen Experten zur Analyse, Optimierung und Skalierung komplexer KI- und HPC-Workloads für moderne CPU- und GPU-Architekturen.
- Profiling und Beseitigung von Performance-Engpässen im gesamten Stack – von Algorithmen über Kernels bis hin zum Systemverhalten.
- Veröffentlichen und Präsentieren Ihrer Arbeit auf Konferenzen, in Vorträgen und Blogs, um die breitere Entwickler-Community zu informieren und zu inspirieren.
- Beeinflussen des Designs zukünftiger Hardware-Architekturen, Systemsoftware, Bibliotheken und Programmiermodelle durch enge Zusammenarbeit mit den NVIDIA-Teams für Forschung, Hardware, Compiler und Tools.
Mindestanforderungen
Was wir sehen müssen
- Umfangreiche praktische Erfahrung mit CUDA und paralleler Programmierung.
- Tiefes Verständnis der Grundlagen von CPU/GPU-Architekturen und deren Auswirkungen auf die Leistung.
- Master-Abschluss oder Promotion in Informatik, Computer Engineering, Elektrotechnik und Computertechnik oder einem verwandten Fachgebiet.
- Fließende Kenntnisse in C/C++ und eine solide Grundlage in Algorithmen und Software-Design.
- 5+ Jahre relevante Berufs- oder Forschungserfahrung.
- Nachgewiesene Erfahrung in der Verbesserung der Leistung von großskaligen Rechenanwendungen auf GPUs.
- Ausgezeichnetes Verständnis der linearen Algebra.
- Starke Kommunikations- und Organisationsfähigkeiten, mit einem logischen Ansatz zur Problemlösung und soliden Priorisierungsfähigkeiten.
Wege, sich von der Masse abzuheben
- Erfahrung mit Techniken zur Optimierung von Inferenz und dem Einsatz optimierter KI-Modelle in der Produktion.
- Erfahrung mit TensorRT, TensorRT-LLM und cuTile.
- Erfahrung in der Parallelisierung und Optimierung von machine learning-Methoden wie Entscheidungsbäumen, Zeitreihenmodellen und Monte-Carlo-Simulationen.
#LI-Hybrid
Bewerbungen für diese Stelle werden mindestens bis zum 9. August 2026 entgegengenommen.
Diese Ausschreibung bezieht sich auf eine bestehende Vakanz.
Ihr Grundgehalt wird basierend auf Ihrem Standort, Ihrer Erfahrung und dem Gehalt von Mitarbeitern in ähnlichen Positionen festgelegt. Die Gehaltsspanne für das Grundgehalt beträgt 152,000 USD - 241,500 USD für Level 3 und 184,000 USD - 287,500 USD für Level 4.
Sie haben außerdem Anspruch auf Aktienoptionen und Zusatzleistungen nvidia.com/en-us/benefits/.
NVIDIA setzt KI-Tools in seinen Rekrutierungsprozessen ein.
NVIDIA setzt sich für die Förderung eines integrativen Arbeitsumfelds ein und ist stolz darauf, Arbeitgeber der Chancengleichheit zu sein. Da wir die Vielfalt unserer aktuellen und zukünftigen Mitarbeiter sehr schätzen, diskriminieren wir nicht (auch nicht in unseren Einstellungs- und Beförderungspraktiken) aufgrund von Rasse, Religion, Hautfarbe, nationaler Herkunft, Geschlecht, Geschlechtsausdruck, sexueller Orientierung, Alter, Familienstand, Veteranenstatus, Behinderungsstatus oder anderen gesetzlich geschützten Merkmalen.
