NVIDIA

Senior Network Reliability Engineer - DGX Cloud

PythonAWSGCP
Automatische Übersetzung. Prüfe das Original.

Über die Stelle

NVIDIA sucht einen Senior Network Reliability Engineer zur Unterstützung und Wartung unserer Cloud- und Rechenzentrums-Netzwerkinfrastrukturen. Dieses Netzwerk dient den Bedürfnissen des gesamten Software-Stacks von NVIDIA, von Grafiktreibern über autonome Fahrzeuge bis hin zur künstlichen Intelligenz.

Ihr Grundgehalt wird basierend auf Ihrem Standort, Ihrer Erfahrung und dem Gehalt von Mitarbeitern in ähnlichen Positionen ermittelt. Die Gehaltsspanne beträgt 136,000 USD - 224,250 USD für Level 3, und 168,000 USD - 264,500 USD für Level 4.

Bewerbungen für diese Stelle werden mindestens bis zum Oktober 2, 2026 angenommen.

Diese Ausschreibung gilt für eine bestehende Stelle.

NVIDIA nutzt KI-Tools in seinen Rekrutierungsprozessen.

NVIDIA setzt sich für die Förderung eines integrativen Arbeitsumfelds ein und ist stolz darauf, ein Arbeitgeber zu sein, der Chancengleichheit bietet. Da wir die Vielfalt unserer aktuellen und zukünftigen Mitarbeiter sehr schätzen, diskriminieren wir nicht (auch nicht in unseren Einstellungs- und Beförderungspraktiken) aufgrund von Rasse, Religion, Hautfarbe, nationaler Herkunft, Geschlecht, Geschlechtsausdruck, sexueller Orientierung, Alter, Familienstand, Veteranenstatus, Behinderungsstatus oder anderen gesetzlich geschützten Merkmalen.

Was Sie tun werden: *

In dieser Rolle wird der Senior Network Operations Engineer kritische Alarme innerhalb definierter SLAs beheben, produktionsbeeinträchtigende Netzwerkvorfälle untersuchen und mit internen Kunden bei netzwerkbezogenen Problemen interagieren. Er wird auch für die Zusammenarbeit mit externen Anbietern zur Behebung von Hard- und Softwareproblemen sowie für die Teilnahme an projektbezogenen Arbeiten wie Upgrades von Netzwerkgeräten und Kapazitätserweiterungen verantwortlich sein. Ein idealer Kandidat verfügt über ein breites Spektrum an Fähigkeiten, einschließlich der Überwachung und Behebung von Alarmen in großen Netzwerken und CSP-Umgebungen, hervorragende Fehlerbehebungsfähigkeiten, Verständnis von L3-Underlay-Netzwerken und Kenntnisse von Netzwerkprotokollen in großen Multi-Vendor-Infrastrukturen.

  1. Teilnahme an 24/7 globalen Schichtrotationen zur Fernunterstützung von Netzwerkreparaturen und -änderungen, während Sie teamübergreifend zusammenarbeiten und Kunden über Status und Ticketinformationen auf dem Laufenden halten. *
  1. Förderung operativer Verbesserungen im Change Management und im täglichen Betrieb durch Befolgung von Verfahren. *
  1. Verwaltung und Betrieb von groß angelegten IP-Netzwerktechnologien und -infrastrukturen. *
  1. Nutzen Sie Ihre Fähigkeiten in den Bereichen Peering und Datacenter Interconnect Technologien: PNI, Transit, Exchange, Passive DWDM, Wave Circuits. *
  1. Überwachung und Unterstützung der Netzwerkintegrität von On-Premises- und Cloud-Infrastrukturen. *
  1. Zusammenarbeit und Entwicklung von Workflow-Verbesserungen bei gleichzeitiger Dokumentation von Best Practices.

Was wir sehen müssen: *

  1. Tiefgreifende Kenntnisse und Erfahrung mit TCP/IP, BGP, OSPF, MPLS, IS-IS, VxLAN, EVPN, QoS, GRE, IPsec, DNS und MACsec. *
  1. 5+ Jahre Erfahrung im Netzwerkbetrieb. *
  1. Kompetenz in Netzwerk-Troubleshooting-Techniken und nachweisbare kreative Problemlösungsfähigkeiten. *
  1. Nachweisliche Erfolgsbilanz bei der Reaktion auf Alarme innerhalb definierter SLAs und Incident Management. *
  1. Erfahrung mit einer oder mehreren der folgenden CSP-Umgebungen: AWS, Azure, GCP, OCI. *
  1. Vertrautheit mit Arista, Fortinet und Juniper. *
  1. Praktische Erfahrung mit der Mitwirkung an Tools und Automatisierung für die Bereitstellung, Überwachung und Verwaltung komplexer Netzwerkinfrastrukturen. *
  1. Bachelor-Abschluss in Informatik, einem verwandten technischen Bereich oder gleichwertige Erfahrung. *
  1. Ausgezeichnete verbale und schriftliche Kommunikationsfähigkeiten.

Wege, sich von der Masse abzuheben: *

  1. Solides Verständnis von Mellanox/Cumulus OS und Infiniband-Technologie. *
  1. Kompetenz in der Systemadministration von Unix/Linux, mit der Fähigkeit, Python/Shell-Skripte zu schreiben und zu verstehen, um die Effizienz in Hyperscale-Umgebungen zu verbessern. *
  1. Vertrautheit mit der Nutzung von Tools wie Netbox/Nautobot, Prometheus, Grafana, Panoptes zur Überwachung und Verwaltung eines globalen Netzwerks. Leidenschaft für Innovation und Investitionen in bahnbrechende Technologien.

NVIDIA gilt weithin als einer der begehrtesten Arbeitgeber der Technologiebranche. Wir haben einige der fortschrittlichsten und fleißigsten Menschen der Welt bei uns. Sind Sie kreativ und autonom? Lieben Sie eine Herausforderung? Wenn ja, möchten wir von Ihnen hören. Die deep learning-Plattformen von NVIDIA haben in verschiedenen Bereichen große Auswirkungen erzielt und werden breit eingesetzt in führenden akademischen Einrichtungen, Start-ups und der Industrie, einschließlich der größten Internetunternehmen der Welt. Wir brauchen leidenschaftliche, fleißige und kreative Menschen, die uns helfen, mehr dieser herausragenden Möglichkeiten im Bereich deep learning Cloud-Lösungen zu nutzen.

Sie werden auch Anspruch auf Aktienoptionen und Leistungen haben nvidia.com/en-us/benefits/.

Mehr Möglichkeiten mit einem Profil

Für mehr Stellen berücksichtigt werden, ohne den ganzen Prozess zu wiederholen? Erstellen Sie Ihr Profil, damit Unternehmen auf Nort Sie finden.

Profil erstellen

Dein nächster Jobsucht schon nach dir.

Nort

Reverse-Recruiting- Plattform für Entwickler

RechtlichesNutzungsbedingungenDatenschutznortjobs © 2026