Groq

Sr./Staff Network Design Engineer, AI/HPC

PythonAWSGCP
Automatische Übersetzung. Prüfe das Original.

MISSION

Groq baut eine hochperformante KI-Infrastruktur auf, die darauf ausgelegt ist, Inferenz schnell, vorhersagbar und skalierbar zu machen. Unsere Infrastrukturteams entwerfen und betreiben die Systeme, die Compute, Daten und Dienste in erheblichem Umfang verbinden. Wir suchen einen Sr./Staff Network Engineer, AI/HPC, der uns bei der Architektur, dem Design, der Validierung und der Weiterentwicklung der Netzwerkinfrastruktur unterstützt, die die schnell wachsende KI-Compute-Umgebung von Groq trägt.

Als Sr./Staff Network Design Engineer sind Sie für die Netzwerkarchitektur und das Design in hochperformanten Rechenzentrums- und KI-Infrastrukturumgebungen verantwortlich. Sie übersetzen Kapazitäts-, Leistungs-, Zuverlässigkeits- und Geschäftsanforderungen in skalierbare Netzwerkdesigns, die konsistent bereitgestellt und betrieben werden können.

Diese Rolle erfordert tiefgreifende Expertise in Rechenzentrumsnetzwerken, Routing-Protokollen, Netzwerkarchitektur, Automatisierung und groß angelegter Infrastruktur. Sie arbeiten eng mit den Teams für Netzwerkbetrieb, Rechenzentrumstechnik, Compute, Plattform, Sicherheit und Infrastruktur zusammen, um Designs vom Konzept über die Validierung bis zur Produktionsbereitstellung zu bringen. Sie werden auch dazu beitragen, die Engineering-Standards, Designmuster, Werkzeuge und die technische Ausrichtung festzulegen, die es der Netzwerkinfrastruktur von Groq ermöglichen, zu skalieren.

In dieser Rolle bedeutet Erfolg, Netzwerkarchitekturen zu schaffen, die es der Infrastruktur von Groq ermöglichen zu wachsen, ohne Leistung, Zuverlässigkeit oder betriebliche Einfachheit zu beeinträchtigen. Sie erstellen wiederholbare Designs anstelle von Einzellösungen, automatisieren, wo immer es praktikabel ist, identifizieren Skalierungsgrenzen, bevor sie zu Produktionsproblemen werden, und machen das Netzwerk zu einer ermöglichenden Schicht für die Compute-Infrastruktur von Groq.

Sie kombinieren tiefgreifende Netzwerkinformationen mit einem System-Engineering-Ansatz – und berücksichtigen dabei nicht nur, ob ein Netzwerk funktioniert, sondern auch, wie es in großem Maßstab funktioniert, wie es ausfällt, wie es validiert wird und wie effizient es betrieben werden kann.

Vergütung

Standort: Diese Stelle wird in einem unserer drei Einstellungszentren angesiedelt sein: im Großraum Dallas, San Francisco oder New York City. Die für diese Stelle eingestellte Person muss in einem dieser drei Gebiete ansässig sein. Sie haben die Flexibilität, remote zu arbeiten, während wir unser lokales Groq-Büro einrichten, mit der Erwartung, dass diese Rolle nach Eröffnung des Büros vor Ort stattfindet.

Groq verpflichtet sich, eine wettbewerbsfähige Vergütung durch unsere Total Cash-Philosophie anzubieten, die den potenziellen Bonuswert direkt in das Grundgehalt integriert. Die Gehaltsspanne für diese Position, die den potenziellen Bonuswert einschließt, beträgt 270.400 $-401.600 $, wobei die individuelle Einstufung durch Ihren geografischen Standort, Ihre Erfahrung, Ihre Fähigkeiten und die Übereinstimmung mit internen Vergütungsstandards bestimmt wird. Diese Spanne gilt speziell für Kandidaten mit Sitz in den Vereinigten Staaten. Die Vergütung für internationale Kandidaten variiert je nach lokalen Marktdynamiken. Über die Barvergütung hinaus bietet Groq auch ein Long-Term Incentive (LTI)-Programm und ein robustes Paket an Mitarbeiterleistungen an.

VERANTWORTLICHKEITEN & MÖGLICHKEITEN IN DIESER ROLLE: *

  1. Verantwortung für den gesamten Netzwerkdesignprozess, die Übersetzung von Kunden-Compute-, Workload-, Skalierungs- und Mandantenanforderungen in produktionsreife Architekturen für KI-Training und -Inferenz. *
  1. Enge Zusammenarbeit mit Softwareteams, die Inferenz- und Trainingsstacks entwickeln, um die Netzwerktopologie mit der Stack-Architektur abzustimmen. *
  1. Entwicklung von Netzwerkarchitekturen, High-Level Designs (HLDs), Low-Level Designs (LLDs), Überprüfung von Stücklisten (BOMs) und Implementierungsstandards unter Nutzung von Branchen- und Anbieterreferenzarchitekturen. *
  1. Design von Spine-Leaf/Clos-Fabrics für Front-End-, Back-End- und Speichernetzwerke mit Fokus auf Leistung, Ausfallsicherheit, Skalierbarkeit und betriebliche Einfachheit. *
  1. Bewertung und Implementierung von Technologien wie BGP, EVPN, VXLAN, ECMP, IPv4/IPv6, QoS. *
  1. Entwicklung von Strategien für Rechenzentrum-Interconnect, WAN-Konnektivität, Internet-Edge, Cloud-Konnektivität und externe Peering. *
  1. Durchführung von Netzwerk-Kapazitätsplanung und Traffic Engineering für KI- und verteilte Compute-Workloads mit hoher Bandbreite. *
  1. Zusammenarbeit mit den Compute- und Infrastruktur-Engineering-Teams, um die Kommunikationsmuster von Workloads zu verstehen und diese in Netzwerkanforderungen zu übersetzen. *
  1. Festlegung von Standards für Netzwerk-Hardwareplattformen, Topologie, Adressierung, Routing-Richtlinien, Konfiguration und Lifecycle-Management. *
  1. Bewertung von Switches, Optiken, Verkabelungsarchitekturen, Netzwerkbetriebssystemen und aufkommenden Netzwerktechnologien. *
  1. Aufbau von Laborumgebungen, Proofs of Concept und Design-Validierungs-Frameworks, bevor neue Architekturen in die Produktion eingeführt werden. *
  1. Definition von Fehlerszenarien und Validierung des Netzwerkverhaltens bei Ausfällen von Verbindungen, Geräten, Steuerungsebenen und Standorten. *
  1. Förderung von Netzwerkautomatisierung und Infrastructure-as-Code-Praktiken unter Verwendung von Technologien wie Python, Ansible, Git, APIs und CI/CD-Pipelines. *
  1. Entwicklung von automatisierten Design-Validierungs-, Konfigurationsgenerierungs-, Compliance- und Testfähigkeiten. *
  1. Festlegung von Anforderungen an die Netzwerk-Observability, einschließlich Telemetrie, Leistungsmetriken, Alarmierung und Kapazitätsvisualisierung. *
  1. Leitung technischer Überprüfungen und Bereitstellung von Anleitungen zu komplexen Netzwerkarchitektur- und Designentscheidungen. *
  1. Fehlerbehebung bei komplexen Leistungs- und Zuverlässigkeitsproblemen, die Netzwerk, Compute, Hardware und verteilte Systeme umfassen. *
  1. Zusammenarbeit mit Betriebsteams, um sicherzustellen, dass Designs supportfähig, beobachtbar und sicher im großen Maßstab zu betreiben sind. *
  1. Mentoring von Ingenieuren und Anhebung des technischen Niveaus für Netzwerkarchitektur, Automatisierung, Dokumentation und Engineering-Praktiken.

IDEALE KANDIDATEN HABEN/SIND: *

  1. 8+ Jahre Erfahrung in Netzwerk-Engineering, Architektur oder Infrastruktur-Engineering, mit erheblicher Erfahrung im Design von Rechenzentrumsnetzwerken im großen Maßstab. *
  1. Tiefes Verständnis von TCP/IP, BGP und modernen Rechenzentrums-Routing-Architekturen. *
  1. Umfangreiche Erfahrung im Design von Leaf-Spine / Clos-Netzwerk-Fabrics. *
  1. Erfahrung mit EVPN/VXLAN und modernen Netzwerkvirtualisierungsarchitekturen. *
  1. Starkes Verständnis von ECMP, Routing-Konvergenz, Fehlerdomänen, Traffic Engineering und Netzwerkausfallsicherheit. *
  1. Erfahrung im Design von Netzwerken mit Ethernet-Plattformen mit hoher Bandbreite, einschließlich 100G, 400G oder höherer Schnittstellen. *
  1. Fundierte Kenntnisse der Grundlagen der optischen Netzwerke, Transceiver, Glasfaserinfrastruktur und Rechenzentrumverkabelung. *
  1. Erfahrung mit Netzwerkplattformen und Betriebssystemen von Anbietern wie Arista, Cisco, Juniper, NVIDIA oder gleichwertig. *
  1. Erfahrung mit Netzwerkautomatisierung und Softwareentwicklung unter Verwendung von Python und APIs. *
  1. Vertrautheit mit Infrastructure-as-Code, Quellcodeverwaltung, automatisierten Tests und CI/CD-Engineering-Praktiken. *
  1. Erfahrung mit Netzwerk-Telemetrie- und Observability-Technologien wie Streaming-Telemetrie, SNMP, Flow-Daten und Zeitreihenüberwachung. *
  1. Starkes Verständnis von Linux-Netzwerken und TCP/IP-Grundlagen. *
  1. Nachgewiesene Fähigkeit zur Entwicklung von Architekturdokumenten, Designstandards, Implementierungsplänen und technischen Spezifikationen. *
  1. Fähigkeit zur Analyse komplexer Systeme und zur fundierten Architekturentscheidung unter Berücksichtigung von Leistung, Zuverlässigkeit, Kosten und betrieblichen Kompromissen. *
  1. Starke Kommunikationsfähigkeiten und die Fähigkeit, technische Entscheidungen in Engineering-Organisationen zu beeinflussen. *
  1. Erfahrung im Design von Netzwerken für KI/ML-Cluster, HPC-Umgebungen, verteilte Computersysteme oder große GPU/Beschleuniger-Bereitstellungen. *
  1. Erfahrung mit sehr großen Ethernet-Fabrics und East-West-Verkehrsmustern mit hohem Durchsatz. *
  1. Kenntnisse von RDMA, Priority Flow Control (PFC), ECN, Congestion Management und verlustfreien oder nahezu verlustfreien Ethernet-Designs. *
  1. Erfahrung im Design von Netzwerken zur Unterstützung von verteiltem Training oder groß angelegter KI-Inferenz. *
  1. Vertrautheit mit SONiC oder anderen disaggregierten/offenen Netzwerkplattformen. *
  1. Erfahrung mit Multi-Site-Rechenzentrumarchitekturen und Rechenzentrum-Interconnect. *
  1. Erfahrung in der Arbeit mit Cloud-Netzwerkumgebungen wie AWS, GCP oder Azure. *
  1. Vertrautheit mit Netzwerk-Source-of-Truth- und Automatisierungsplattformen wie NetBox, Nautobot oder gleichwertigen Systemen. *
  1. Erfahrung im Design und Betrieb von Infrastrukturen bei Hyperscalern oder in schnell wachsenden Technologieumgebungen.
  1. Vertrautheit mit Backend-Technologien wie Infiniband/RoCE/Spectrum-X-Erfahrung stark bevorzugt *

Warum zu uns kommen: *

  • Purposeful Hiring: Sie sind nicht zufällig hier, und niemand sonst. Jedes Teammitglied wird bewusst handverlesen, denn mit wem wir zusammenarbeiten, ist wichtig. *
  • Builders Wanted: Sie reiten nicht nur auf der Rakete, Sie bauen sie. Ihre Arbeit prägt direkt die Flugbahn unseres Unternehmens. *
  • Missionsgetriebene Arbeit: Wir sind hier, um einen echten Einfluss zu erzielen. Unsere Mission treibt alles an, was wir tun. *
  • Harte Probleme angehen: Wenn Einfachheit nicht Ihr Ding ist, sind Sie hier genau richtig. Wir lösen einige der komplexesten und spannendsten Herausforderungen in unserem Bereich. *
  • Exzellenz ist der Standard: Hohe Leistung wird nicht nur gefördert, sie ist die Basis. Und sie ist ansteckend.

Mehr Möglichkeiten mit einem Profil

Für mehr Stellen berücksichtigt werden, ohne den ganzen Prozess zu wiederholen? Erstellen Sie Ihr Profil, damit Unternehmen auf Nort Sie finden.

Profil erstellen

Dein nächster Jobsucht schon nach dir.

Nort

Reverse-Recruiting- Plattform für Entwickler

RechtlichesNutzungsbedingungenDatenschutznortjobs © 2026