Databricks

Principal Engineer, Compute Fleet Management

AWSGCP
Automatische Übersetzung. Prüfe das Original.

Über die Stelle

# P-725

Transparenz der Gehaltsspanne

Databricks verpflichtet sich zu fairen und gerechten Vergütungspraktiken. Die unten aufgeführten Gehaltsspannen für diese Rolle stellen die erwartete Gehaltsspanne für nicht- provisionspflichtige Positionen oder die Zielverdienste für provisionspflichtige Positionen dar. Die tatsächlichen Vergütungspakete basieren auf mehreren Faktoren, die für jeden Kandidaten einzigartig sind, einschließlich, aber nicht beschränkt auf berufsbezogene Fähigkeiten, Tiefe der Erfahrung, relevante Zertifizierungen und Schulungen sowie den spezifischen Arbeitsort. Basierend auf den oben genannten Faktoren geht Databricks davon aus, die volle Breite der Spanne zu nutzen. Das Gesamtvergütungspaket für diese Position kann auch die Berechtigung für einen jährlichen Leistungsbonus, Aktienoptionen und die oben aufgeführten Leistungen umfassen. Weitere Informationen darüber, in welcher Spanne Ihr Standort liegt, finden Sie hier databricks.com/sites/default/files/2024-08/us-pay-zone-mapping.pdf.

Lokale Gehaltsspanne $264,300—$322,300 USD

Unser Engagement für Vielfalt und Inklusion

Bei Databricks setzen wir uns für die Förderung einer vielfältigen und integrativen Kultur ein, in der jeder herausragende Leistungen erbringen kann. Wir achten sorgfältig darauf, unsere Einstellungspraktiken integrativ zu gestalten und die Standards für gleiche Beschäftigungsmöglichkeiten zu erfüllen. Bewerber bei Databricks werden unabhängig von Alter, Hautfarbe, Behinderung, ethnischer Zugehörigkeit, Familien- oder Familienstand, Geschlechtsidentität oder -ausdruck, Sprache, nationaler Herkunft, physischer und geistiger Fähigkeit, politischer Zugehörigkeit, Rasse, Religion, sexueller Orientierung, sozioökonomischem Status, Veteranenstatus und anderen geschützten Merkmalen berücksichtigt.

Compliance

Wenn der Zugang zu exportkontrollierter Technologie oder Quellcode für die Erfüllung der Arbeitsaufgaben erforderlich ist, liegt es im Ermessen des Arbeitgebers, ob er für solche Positionen eine US-Regierungslizenz beantragt, und der Arbeitgeber kann allein aus diesem Grund die Fortsetzung mit einem Bewerber ablehnen.

Bei Databricks sind wir leidenschaftlich daran interessiert, Datenteams zu befähigen, die weltweit schwierigsten Probleme zu lösen – von der Realisierung der nächsten Mobilitätsform bis zur Beschleunigung der Entwicklung medizinischer Durchbrüche. Dies tun wir, indem wir die weltweit beste Daten- und KI-Infrastrukturplattform aufbauen und betreiben, damit unsere Kunden tiefe Dateneinblicke nutzen können, um ihr Geschäft zu verbessern.

Über das Team

Treten Sie dem Kern der Databricks Infrastruktur bei Das Compute Infra Team ist die treibende Kraft hinter allen Databricks Produkten und Control Plane Services. Wir bauen und skalieren die grundlegende Compute- Infrastruktur, die jedem Databricks Kunden zum Erfolg verhilft, und betreiben eine der größten und dynamischsten Daten- und KI-Clouds der Welt.

Mission: Die Zukunft der Cloud Compute Effizienz und Skalierung definieren

Als Technischer Leiter für Compute Fleet Management werden Sie nicht nur eine Flotte verwalten – Sie werden den Standard dafür setzen, wie Databricks Compute über alle drei großen Clouds (AWS, Azure und GCP) nutzt und optimiert. Dies ist eine missionskritische Rolle mit direktem Einfluss auf unsere Bruttogewinnmarge und das Kundenerlebnis. Ihr Mandat umfasst:

Ergebnisse: Der Einfluss, den Sie erzielen werden

Diese Rolle ist für Ingenieure gedacht, die sich mit den herausforderndsten und wirkungsvollsten Ergebnissen beschäftigen:

  1. Pionierarbeit bei der Flottenoptimierung: Bereitstellung und Bündelung von O(Milliarden) Cloud-Ressourcen zur Erzielung von Spitzen-Workload-Leistung, branchenführender Effizienz und robuster Ressourcenisolierung.
  1. Bereitstellung von Hyper-Scale-Resilienz: Aufbau der Architektur, die horizontale Skalierung und Resilienz gegen Zonen- oder sogar Cloud-Konto- Ebene-Ausfälle garantiert und sicherstellt, dass Databricks immer verfügbar ist.
  1. Verantwortung für den kritischen Pfad: Leitung der Entwicklung der Systeme mit den geringsten Abhängigkeiten, die zur Initialisierung und Verwaltung unserer massiven Compute-Plattform erforderlich sind.
  1. Hohe Verfügbarkeit: Erreichen und Aufrechterhalten einer Verfügbarkeit von 99.99% für alle Batch- und Serving-Workloads.
  1. Hervorragende Effizienz: Steigerung der Auslastung auf 60% oder höher – eine entscheidende Metrik, die ein Gleichgewicht zwischen hoher Effizienz und unerschütterlicher Toleranz gegenüber Cloud-Ausfällen erfordert.
  1. Erstklassige Isolierung: Entwurf und Durchsetzung starker Sicherheits- und Leistungsisolierung über eine Vielzahl von Kunden-Workloads hinweg.

Mindestanforderungen

Anforderungen: Sind Sie bereit für diese Herausforderung?

Wir suchen einen erfahrenen Principal Engineer, der nicht nur große, missionskritische Infrastruktursysteme in der Produktion entwickelt, sondern diese auch erfolgreich betrieben hat. Sie müssen eine Erfolgsbilanz vorweisen können in Bezug auf:

  1. Leitung transformativer Projekte: Übernahme der Verantwortung für komplexe, teamübergreifende, schichtübergreifende und mehrquartalsübergreifende strategische Engineering-Initiativen vom Konzept bis zur Ausführung.
  1. Beherrschung verteilter Systeme: Tiefgreifende praktische Erfahrung in der Entwicklung und dem Betrieb von hochskalierbaren verteilten Systemen auf mindestens einer großen Public Cloud.
  1. Einfluss ohne Autorität: Nachgewiesene Fähigkeit, Konsens zu erzielen, technische Richtung vorzugeben und große technische Anstrengungen über organisatorische Grenzen hinweg zu leiten.
  1. Ausführungsdisziplin: Außergewöhnliche Stärke in der Planung, Verfolgung des Projektfortschritts und Verwaltung komplexer organisationsübergreifender Abhängigkeiten.

Der Vorteil: Hochwünschenswerte Erfahrung

  1. Erfahrung in der Verwaltung und Skalierung einer riesigen Flotte von GPUs für KI/ML-Workloads.
  1. Erfahrung in der Entwicklung und dem Betrieb von großskaligen verteilten Systemen über alle großen Clouds (AWS, Azure und GCP) hinweg.

Über Databricks

Databricks ist das Data and AI Unternehmen. Mehr als 20,000 Organisationen weltweit – darunter adidas, AT&T, Bayer, Block, Mastercard, Rivian, Unilever und 70% der Fortune 500 – verlassen sich auf die Databricks Data + AI Platform, um Daten- und KI-Anwendungen, Analysen und Agenten zu bauen und zu skalieren. Mit Hauptsitz in San Francisco und über 30 Büros weltweit bietet Databricks eine einheitliche Plattform, die Genie, Lakebase, Agent Bricks, Lakeflow, Lakehouse und Unity Catalog umfasst. Um mehr zu erfahren, folgen Sie Databricks auf LinkedIn linkedin.com/company/databricks, X x.com/databricks, YouTube youtube.com/@Databricks und Instagram instagram.com/databricksinc/?hl=en.

Leistungen

Bei Databricks bemühen wir uns, umfassende Leistungen und Vergünstigungen anzubieten, die den Bedürfnissen aller unserer Mitarbeiter entsprechen. Spezifische Details zu den in Ihrer Region angebotenen Leistungen finden Sie hier docs.google.com/document/d/154un3e8Xav4BceOSlcYFZRGEuQI54xMxVydRwQn54eQ/edit?usp=sharing.

Mehr Möglichkeiten mit einem Profil

Für mehr Stellen berücksichtigt werden, ohne den ganzen Prozess zu wiederholen? Erstellen Sie Ihr Profil, damit Unternehmen auf Nort Sie finden.

Profil erstellen

Dein nächster Jobsucht schon nach dir.

Nort

Reverse-Recruiting- Plattform für Entwickler

RechtlichesNutzungsbedingungenDatenschutznortjobs © 2026