Launch Legends
Databricks
Sr. Manager – Data & AI Support Engineering
Über die Stelle
P-1388
Als Sr. Manager des Data & AI Support Engineering Teams leiten und managen Sie ein Team von Technical Solutions Engineers, die für die tiefgreifende technische Lösung komplexer Kundenprobleme in den Bereichen Spark, AI/ML, Streaming und Lakehouse-Plattformen verantwortlich sind. Sie helfen Kunden, Geschäftswert aus den Databricks Ecosystem-Produkten durch starke technische Führung, KI-gestützte operative Innovation und kundenorientierte Ausführung zu realisieren.
Mission
Führen und skalieren Sie eine erstklassige, KI-gestützte Data & AI Support Engineering Organisation, die tiefes technisches Fachwissen, operative Exzellenz, intelligente Automatisierung und kundenorientierten Support kombiniert, um die Problemlösung zu beschleunigen, die Plattformzuverlässigkeit zu verbessern und außergewöhnliche Kundenergebnisse für unternehmensweite Data- und KI-Workloads zu erzielen.
ERGEBNISSE
- Entwickeln Sie KI-gestützte Support-Workflows und wiederverwendbare Automatisierungen, um die Lösungsgeschwindigkeit und die Supportqualität zu verbessern.
- Nutzen Sie Agentic AI-Systeme, Protokolle, Telemetrie, Beobachtbarkeitsplattformen und interne Systeme, um die Fehlerbehebung und die Ursachenanalyse sicher zu beschleunigen.
- Erstellen Sie wiederverwendbare Runbooks, Prompts und Agentic Workflows, die die operative Effizienz teamübergreifend skalieren.
- Gewährleisten Sie eine starke KI-Governance, Datensicherheit für Kunden, Validierungspraktiken, Auditierbarkeit und Human-in-the-Loop-Kontrollen.
- Arbeiten Sie mit Engineering- und Produktteams zusammen, um KI-gestützte Support-Innovation und operative Exzellenz voranzutreiben.
- Treiben Sie KI-gestützte Support-Transformationsinitiativen voran, die die Lösungsgeschwindigkeit, die Fallqualität, die operative Effizienz und das Kundenerlebnis verbessern.
- Arbeiten Sie mit Engineering- und Produktteams zusammen, um KI-gestützte Diagnostik, Beobachtbarkeits-Einblicke und intelligentes Eskalationsmanagement für Unternehmenskunden zu operationalisieren.
- Entwickeln und skalieren Sie wiederverwendbare KI-gestützte Workflows, Automatisierungen, Runbooks und operative Intelligenz-Frameworks in der gesamten Supportorganisation.
- Leiten und managen Sie Technical Solutions Engineers, Team Leads und Support Operations Personal über die AMER-Supportfunktionen am Standort Dallas.
- Übernehmen Sie die Verantwortung für und verbessern Sie operative KPIs, einschließlich Kundenzufriedenheit, Eskalationsmanagement, Backlog-Gesundheit, Effizienz der Problemlösung und Supportqualität.
- Agieren Sie als Eskalationspunkt für Kunden und interne Teams und treiben Sie gleichzeitig operative Exzellenz und Prozessoptimierung voran.
- Leiten Sie die Einstellung, das Onboarding, das Mentoring, die technischen Bewertungen, die Schulung und die Karriereentwicklung für Support-Ingenieure und technische Leiter.
- Führen Sie regelmäßige Einzelgespräche, Jahresgespräche und Karriereentwicklungsdiskussionen mit direkten Mitarbeitern.
- Seien Sie ein praxisorientierter technischer Leiter, der komplexe Probleme im Zusammenhang mit Spark Core, Spark SQL, Structured Streaming, Delta Lake, Lakehouse-Architektur und Databricks Runtime-Technologien unterstützt.
- Beraten Sie Kunden bei der Optimierung der Spark-Laufzeit, der Leistung verteilter Systeme und bewährten Praktiken für skalierbare Data- & AI-Workloads.
- Übernehmen Sie die Verantwortung für JIRA-Eskalationen und treiben Sie proaktiv schnellere Lösungen für vom Kunden gemeldete Produktprobleme voran.
- Pflegen Sie interne operative Dokumentationen, Runbooks und kundenorientierte Wissensdatenbank-Assets.
- Arbeiten Sie eng mit den Engineering- und Backline-Support-Engineering-Teams sowie den Customer Experience Intelligence-Teams zusammen, um Produktfehler effektiv zu identifizieren, zu reproduzieren und zu melden.
- Agieren Sie als starker Kundenanwalt und arbeiten Sie mit Cloud-Partnern zusammen, um den gemeinsamen Kundenerfolg zu unterstützen.
- Beteiligen Sie sich am Management von Großvorfällen, der Bearbeitung von Eskalationen, Bereitschaftsdiensten und kritischen Produktionssupportaktivitäten.
WAS WIR SUCHEN
- 10+ Jahre Erfahrung in der Konzeption, Entwicklung, Fehlerbehebung und dem Support von groß angelegten Data- & AI-Anwendungen mit Python, Java, Scala, Spark oder verwandten verteilten Technologien.
- Umfangreiche Arbeitserfahrung mit KI-gestützten Support-Workflows, Agentic AI-Systemen, Claude Skills Workflows, RAG-Architekturen, Vektordatenbanken und anderen operativen Automatisierungs-Frameworks.
- Erfahrung mit KI-Tools zur Fehlerbehebung, Ursachenanalyse, Beobachtbarkeitsanalyse und Beschleunigung von Support-Workflows.
- Starke praktische Expertise in Apache Spark, Spark SQL, Structured Streaming, Delta Lake und verteilten Datenverarbeitungssystemen.
- Erfahrung in der Leitung von Produktions-Workloads in den Bereichen Big Data, Hadoop, AI/ML, Kafka, Streaming, Data Science oder Analyseplattformen.
- Starke Erfahrung in der Fehlerbehebung und Leistungsoptimierung für Spark und JVM-basierte verteilte Systeme, einschließlich Speicherverwaltung, Garbage Collection, Heap-Analyse und Thread-Dump-Analyse.
- Praktische Erfahrung mit AWS, Azure oder GCP Cloud-Plattformen.
- Nachgewiesene Erfahrung im Management global verteilter technischer Teams und in der Bearbeitung von Kundeneskalationen mit hoher Priorität.
- Starke analytische Fähigkeiten, Debugging-, Problemlösungs- und Fehlerbehebungsfähigkeiten für verteilte Systeme.
- Ausgezeichnete schriftliche und mündliche Kommunikationsfähigkeiten mit starken kundenorientierten Führungsqualitäten.
- Starke organisatorische Fähigkeiten, Multitasking, Stakeholder-Management und operative Führungsfähigkeiten.
- Nachgewiesene Entwicklungs-/Liefererfahrung im Produktionsmaßstab in Databricks-Technologie-Stacks wie Model Serving, Lakehouse, Delta, DLT, Lakeflow, Lakebase-Plattformen ist ein großes Plus.
Über Databricks
Databricks ist das Data- und AI-Unternehmen. Mehr als 20,000 Organisationen weltweit – darunter adidas, AT&T, Bayer, Block, Mastercard, Rivian, Unilever und 70% der Fortune 500 – verlassen sich auf die Databricks Data + AI Platform, um Daten- und KI-Anwendungen, Analysen und Agenten zu entwickeln und zu skalieren. Mit Hauptsitz in San Francisco und über 30 Niederlassungen weltweit bietet Databricks eine einheitliche Plattform, die Genie, Lakebase, Agent Bricks, Lakeflow, Lakehouse und Unity Catalog umfasst. Um mehr zu erfahren, folgen Sie Databricks auf LinkedIn linkedin.com/company/databricks, X x.com/databricks, YouTube youtube.com/@Databricks und Instagram instagram.com/databricksinc/?hl=en.
Leistungen
Bei Databricks bemühen wir uns, umfassende Leistungen und Vergünstigungen anzubieten, die den Bedürfnissen aller unserer Mitarbeiter entsprechen. Spezifische Details zu den in Ihrer Region angebotenen Leistungen finden Sie hier (docs.google.com/document/d/154un3e8Xav4BceOSlcYFZRGEuQI54xMxVydRwQn54eQ/edit?usp=sharing).
Unser Engagement für Vielfalt und Inklusion
Bei Databricks sind wir bestrebt, eine vielfältige und inklusive Kultur zu fördern, in der jeder erfolgreich sein kann. Wir legen großen Wert darauf, dass unsere Einstellungspraktiken integrativ sind und die Standards der Chancengleichheit erfüllen. Personen, die eine Anstellung bei Databricks suchen, werden unabhängig von Alter, Hautfarbe, Behinderung, ethnischer Zugehörigkeit, Familien- oder Familienstand, Geschlechtsidentität oder -ausdruck, Sprache, Herkunft, physischer und geistiger Fähigkeit, politischer Zugehörigkeit, Rasse, Religion, sexueller Orientierung, sozioökonomischem Status, Veteranenstatus und anderen geschützten Merkmalen berücksichtigt.
Compliance
Wenn der Zugang zu exportkontrollierter Technologie oder Quellcode für die Erfüllung der Arbeitsaufgaben erforderlich ist, liegt es im Ermessen des Arbeitgebers, eine US-Regierungslizenz für solche Positionen zu beantragen, und der Arbeitgeber kann allein aus diesem Grund davon absehen, mit einem Bewerber fortzufahren.
