JFrog
Anthropic
Staff Software Engineer, Node Infra
ÜBER ANTHROPIC
Anthropics Mission ist es, zuverlässige, interpretierbare und steuerbare KI-Systeme zu entwickeln. Wir wollen, dass KI sicher und vorteilhaft für unsere Nutzer und die Gesellschaft als Ganzes ist. Unser Team ist eine schnell wachsende Gruppe engagierter Forscher, Ingenieure, Politikexperten und Wirtschaftsführer, die zusammenarbeiten, um vorteilhafte KI-Systeme zu entwickeln.
ÜBER DIE ROLLE
Anthropics Infrastrukturorganisation ist grundlegend für unsere Mission, KI-Systeme zu entwickeln, die zuverlässig, interpretierbar und steuerbar sind. Die von uns gebauten Systeme bestimmen, wie schnell wir neue Modelle trainieren können, wie zuverlässig wir Sicherheits-Experimente durchführen können und wie effektiv wir Claude für Millionen von Nutzern skalieren können – und zeigen damit, dass sichere, zuverlässige Infrastruktur und Spitzenfähigkeiten Hand in Hand gehen können.
Node Infra ist für den gesamten Lebenszyklus der Beschleunigerkapazität bei Anthropic verantwortlich. Wir nehmen Rechenleistung von allen großen Cloud-Anbietern und von speziell für Anthropic gebauten Rechenzentren auf und stellen sie bereit, richten die Cluster hinter einer der größten KI-Compute-Flotten der Branche ein und skalieren sie, und bauen die Automatisierung für Gesundheit, Diagnose und Reparatur, die jeden GPU-, TPU- und Trainium-Knoten in der Flotte nutzbar und bereit hält, die Spitzen-KI-Forschung von Anthropic anzutreiben.
WAS UNS UNTERSCHEIDET
Wir glauben, dass die wirkungsvollste KI-Forschung "Big Science" sein wird. Bei Anthropic arbeiten wir als ein einziges, zusammenhängendes Team an nur wenigen groß angelegten Forschungsbemühungen. Und wir schätzen Wirkung – die Förderung unserer langfristigen Ziele einer steuerbaren, vertrauenswürdigen KI – anstatt an kleineren und spezifischeren Problemen zu arbeiten. Wir betrachten KI-Forschung als eine empirische Wissenschaft, die ebenso viel mit Physik und Biologie gemeinsam hat wie mit traditionellen Ansätzen der Informatik. Wir sind eine äußerst kollaborative Gruppe und veranstalten häufig Forschungsdiskussionen, um sicherzustellen, dass wir zu jedem Zeitpunkt die wirkungsvollste Arbeit verfolgen. Daher schätzen wir Kommunikationsfähigkeiten sehr.
Der einfachste Weg, unsere Forschungsrichtungen zu verstehen, ist, unsere aktuelle Forschung zu lesen. Diese Forschung setzt viele der Richtungen fort, an denen unser Team vor Anthropic gearbeitet hat, darunter: GPT-3, Circuit-Based Interpretability, Multimodal Neurons, Scaling Laws, AI & Compute, Concrete Problems in AI Safety und Learning from Human Preferences.
HAUPTVERANTWORTLICHKEITEN
- Verantwortung für die technische Strategie und Roadmap für das Management des Knotenlebenszyklus – Aufnahme, Inbetriebnahme, Zustandsprüfung und automatisierte Reparatur
- Leitung teamübergreifender Initiativen zum Aufbau und zur Skalierung von KI-Clustern über mehrere Clouds und Beschleunigerfamilien hinweg
- Entwurf und Betrieb der Systeme, die fehlerhafte Hardware automatisch erkennen, isolieren und beheben, um die MTBI der Flotte zu erhöhen und gestrandete Kapazitäten zu minimieren
- Definition der Infrastrukturarchitektur, um sicherzustellen, dass die schwierigsten Probleme gelöst werden – sei es durch Sie direkt oder durch die Zusammenarbeit mit anderen
- Enge Zusammenarbeit mit Cloud-Anbietern und internen Forschungs-/Inferenz-/Produktteams, um die langfristige Strategie für Compute, Daten und Infrastruktur zu gestalten
- Etablierung und Weiterentwicklung von Praktiken für operative Exzellenz (Incident Response, Postmortem-Kultur, Bereitschaftsdienst)
- Unterstützung des Wachstums von Ingenieuren in Ihrem Umfeld durch technische Mentorschaft und Coaching
MINDESTQUALIFIKATIONEN
- Tiefgreifende Expertise in verteilten Systemen, Zuverlässigkeit und Cloud-Plattformen (z. B. Kubernetes, IaC, AWS/GCP/Azure)
- Starke Kenntnisse in mindestens einer Systemprogrammiersprache (z. B. Rust, Go oder Python), IaC-Kenntnisse mit Terraform.
- Praktische Erfahrung mit machine learning-Beschleunigern (GPUs, TPUs oder Trainium)
- Nachgewiesene Erfolgsbilanz bei der Leitung komplexer, mehrmonatiger technischer Initiativen, die mehrere Teams oder Systeme umfassen
- Fähigkeit, Einigkeit bei leitenden Stakeholdern zu schaffen und auf allen Ebenen effektiv zu kommunizieren
LOGISTIK
Mindestbildung: Bachelor-Abschluss oder eine gleichwertige Kombination aus Bildung, Schulung und/oder Erfahrung
Erforderlicher Studienbereich: Ein für die Rolle relevanter Bereich, nachgewiesen durch Kurse, Schulungen oder Berufserfahrung
Mindestjahre an Erfahrung: Die erforderliche Berufserfahrung korreliert mit den internen Anforderungen an die Jobebene für die Position
BEVORZUGTE QUALIFIKATIONEN
- 7+ Jahre Software-Engineering-Erfahrung, einschließlich Zeit als technischer Leiter, der die Richtung für ein Team vorgibt
- Erfahrung in der Verwaltung großer Compute-Infrastrukturen im Hyperscale-Bereich (10K+ Knoten), einschließlich Kapazitätsmanagement und Effizienz
- Tiefgreifende Kenntnisse in einem oder mehreren der folgenden Bereiche: Kubernetes-Interna (Scheduler, Autoscaler, Kubelet, Karpenter), Cluster-Orchestrierungssysteme (Mesos, Borg-ähnlich) oder Knotenbereitstellungs-Pipelines
- Low-Level-Systemerfahrung: Kernel, Virtualisierung, Gerätetreiber, Firmware oder Daemons für Hardware-Gesundheit/Diagnose
- Vertrautheit mit Hochleistungsnetzwerken (EFA, RDMA, InfiniBand) für verteilte ML-Workloads.
- Nachgewiesene Verantwortung für die Produktionszuverlässigkeit von Systemen mit hohem Durchsatz und latenzempfindlichen Systemen
- Beiträge zu relevanten Open-Source-Projekten (Kubernetes, Linux-Kernel, Container-Runtimes usw.)
- Fähigkeit, Systemdesign-Trade-offs schnell zu verstehen und sich schnell entwickelnde Softwaresysteme im Auge zu behalten
Die jährliche Vergütung für diese Rolle ist unten aufgeführt. Für Vertriebsrollen ist die angegebene Spanne die Zielverdienstspanne ("OTE") der Rolle, was bedeutet, dass die Spanne sowohl die Zielprovisionen/Verkaufsboni als auch das jährliche Grundgehalt für die Rolle beinhaltet.
Jahresgehalt: £325,000—£485,000 GBP
Standortbasierte Hybridrichtlinie: Derzeit erwarten wir von allen Mitarbeitern, dass sie mindestens 25% der Zeit in einem unserer Büros verbringen. Einige Rollen erfordern jedoch möglicherweise mehr Zeit in unseren Büros.
Visumsponsorship: Wir sponsern Visa! Wir können jedoch nicht für jede Rolle und jeden Kandidaten erfolgreich Visa sponsern. Aber wenn wir Ihnen ein Angebot machen, werden wir alle zumutbaren Anstrengungen unternehmen, um Ihnen ein Visum zu besorgen, und wir beauftragen einen Einwanderungsanwalt, um dabei zu helfen.
Wir ermutigen Sie, sich auch dann zu bewerben, wenn Sie nicht glauben, jede einzelne Qualifikation zu erfüllen. Nicht alle starken Kandidaten erfüllen jede einzelne aufgeführte Qualifikation. Forschungen zeigen, dass Menschen, die sich als Angehörige unterrepräsentierter Gruppen identifizieren, eher unter dem Impostor-Syndrom leiden und an ihrer Kandidatur zweifeln. Daher bitten wir Sie dringend, sich nicht vorzeitig auszuschließen und sich zu bewerben, wenn Sie an dieser Arbeit interessiert sind. Wir glauben, dass KI-Systeme wie die, die wir entwickeln, enorme soziale und ethische Auswirkungen haben. Wir glauben, dass dies die Repräsentation noch wichtiger macht, und wir bemühen uns, eine Vielfalt von Perspektiven in unserem Team zu vereinen.
Ihre Sicherheit ist uns wichtig. Um sich vor möglichen Betrugsversuchen zu schützen, denken Sie daran, dass Anthropic-Recruiter Sie nur von E-Mail-Adressen mit der Endung @anthropic.com kontaktieren. In einigen Fällen arbeiten wir möglicherweise mit geprüften Personalvermittlungsagenturen zusammen, die sich als im Auftrag von Anthropic arbeitend ausweisen. Seien Sie vorsichtig bei E-Mails von anderen Domains. Seriöse Anthropic-Recruiter werden Sie niemals vor Ihrem ersten Tag nach Geld, Gebühren oder Bankinformationen fragen. Wenn Sie sich jemals über eine Kommunikation unsicher sind, klicken Sie nicht auf Links – besuchen Sie anthropic.com/careers anthropic.com/careers direkt, um bestätigte Stellenangebote zu finden.
KOMMEN SIE ZU UNS!
Anthropic ist eine Public Benefit Corporation mit Hauptsitz in San Francisco. Wir bieten wettbewerbsfähige Vergütung und Leistungen, optionale Spenden von Aktienoptionen, großzügigen Urlaub und Elternzeit, flexible Arbeitszeiten und einen schönen Büroraum für die Zusammenarbeit mit Kollegen. Anleitung zur KI-Nutzung durch Bewerber: Erfahren Sie mehr über unsere Richtlinie anthropic.com/candidate-ai-guidance zur Nutzung von KI in unserem Bewerbungsprozess.
