Sustainable Talent

Site Reliability Engineer zur Unterstützung von Nvidia

PythonDockerKubernetesGoTerraform
Automatische Übersetzung. Prüfe das Original.

Über die Stelle

Sustainable Talent arbeitet mit Nvidia zusammen, einem weltweit führenden Unternehmen, das seit über 25 Jahren Computergrafik, PC-Gaming und beschleunigtes Computing transformiert. Wir suchen einen Site Reliability Engineer zur Unterstützung des Teams unseres Kunden mit Sitz in Santa Clara, Ca.

Wir suchen einen Site Reliability Engineer (Vertrag) für IPP (Infrastructure, Planning and Process). IPP ist eine globale Organisation innerhalb von NVIDIA. Diese Gruppe arbeitet mit verschiedenen anderen Gruppen innerhalb von NVIDIA Software zusammen, wie z. B. Grafikprozessoren, mobile Prozessoren, Deep Learning, künstliche Intelligenz und fahrerlose Autos, um deren Infrastrukturanforderungen zu erfüllen. Diese Cloud-Dienste stellen fast eine halbe Million automatisierte Jobs pro Tag auf Tausenden von Servern bereit und tragen zur Effizienz Tausender von NVIDIA-Softwareentwicklern weltweit bei.

Die Cloud beherbergt eine heterogene Mischung aus Maschinen und Geräten mit verschiedenen Betriebssystemen (Windows/Linux/Android), einer Vielzahl von Hardwareplattformen, sowohl NVIDIA GPUs als auch Tegra-Prozessoren. Sind Sie leidenschaftlich an Infrastruktur interessiert und suchen nach anspruchsvollen, relevanten Problemen, bereit, die nächste Generation von Cloud-Diensten aufzubauen, kreative Lösungen zu entwickeln, Daten zu durchforsten, um echte Probleme aufzudecken und sie zu beheben? Wir würden uns freuen, Sie an Bord zu haben.

Dies ist eine Vollzeitstelle (W-2) auf Vertragsbasis. Wir bieten eine wettbewerbsfähige Bezahlung von $65/Stunde - $85/Stunde, basierend auf Faktoren wie Erfahrung, Ausbildung, Standort usw., und bieten vollständige Sozialleistungen, PTO und eine fantastische Unternehmenskultur!

Was Sie tun werden

  1. Flottenüberwachung und Wiederherstellung von Assets in unserer Private-Cloud-Umgebung, die mehrere Compute-Server mit NVIDIA GPUs beherbergt.
  1. Spezifischer Fokus auf den Aufbau und die Stabilisierung unserer Virtualisierungsinfrastruktur von ESXi, KVM und Hyper-V.
  1. Bereitstellung und Wartung einer großen Farm von Maschinen unter Verwendung der neuesten Konfigurationsmanagement- und Infrastrukturautomatisierungstools (Chef, Ansible, Terraform).
  1. Teilnahme an Bereitschafts- und Rotationsdiensten (L1) für die rund um die Uhr Überwachung und Behebung von Infrastrukturproblemen (PagerDuty).
  1. Analyse und Debugging von Betriebssystem-, Netzwerk-, Konfigurations- und Leistungsproblemen.
  1. Unterstützung bei der Einführung und Bereitstellung von Infrastrukturkonfigurationen zur Unterstützung der neuesten NVIDIA-Hardware und -Technologien.
  1. Beitrag zur Entwicklung von Überwachungssystemen für einen schnellen, zuverlässigen und Echtzeit-Einblick in die verschiedenen Infrastruktursubsysteme (Zabbix, Big Panda, Grafana).

Was wir sehen müssen

  1. Bachelor- oder Master-Abschluss in Informatik oder Software Engineering oder gleichwertige Erfahrung.
  1. Erfahrung in der Arbeit mit großen Enterprise-Produktionssystemen. 5+ Jahre Berufserfahrung erforderlich.
  1. Fähigkeit zum Debuggen und Analysieren von Systemproblemen, Code zur Triage, Ursachenermittlung und Behebung von Problemen in der Infrastruktur. Enge Zusammenarbeit mit dem Plattform- Engineering-Team beim Verständnis von Hardware-Setups.
  1. Vertrautheit mit der Wartung und Einrichtung von Linux, Windows Hosts.
  1. Skripterfahrung mit Python, Go. Unix-Shell-Kenntnisse.
  1. Erfahrung mit Versionskontrollsystemen wie Perforce, GIT.

Wege, sich von der Masse abzuheben

  1. Erfahrung mit VM- und Hardware-Virtualisierungstechnologien wie VMware, KVM, Hyper-V, Docker und Kubernetes.
  1. Hintergrund in der Automatisierung von Bare-Metal- und VM-Provisionierung.
  1. Erfahrung mit der Unterstützung von GPUs, der Entwicklung von Embedded-Geräten, der Treiber- entwicklung und CUDA/TensorRT-Anwendungen.
  1. Entwicklungserfahrung in Chef, Ansible und Infrastruktur-Orchestrierung.

Sustainable Talent ist ein Arbeitgeber, der Chancengleichheit und positive Diskriminierung für Männer/Frauen, Behinderte und Veteranen fördert.

Mehr Möglichkeiten mit einem Profil

Für mehr Stellen berücksichtigt werden, ohne den ganzen Prozess zu wiederholen? Erstellen Sie Ihr Profil, damit Unternehmen auf Nort Sie finden.

Profil erstellen

Dein nächster Jobsucht schon nach dir.

Nort

Reverse-Recruiting- Plattform für Entwickler

RechtlichesNutzungsbedingungenDatenschutznortjobs © 2026