Roku
Altruist
Staff Software Engineer, Cloud Infrastructure
Über Altruist
Altruist verändert die Multi-Billionen-Dollar-Vermögensverwaltungsbranche, indem es eine KI-Plattform für Vermögensfachleute aufbaut. Wir arbeiten mit Finanzberatern im ganzen Land zusammen und befähigen sie, ihre Kundenbeziehungen auszubauen, Zeit und Ressourcen zu optimieren und überlegene Ergebnisse für ihre Kunden zu erzielen.
Wir suchen außergewöhnliche Talente, die uns helfen, unsere Mission zu erfüllen, Finanzberatung besser, erschwinglicher und zugänglicher für alle zu machen. Wenn Sie leidenschaftlich daran interessiert sind, den Status quo herauszufordern und die wichtigste Arbeit Ihres Lebens leisten möchten, würden wir Sie gerne kennenlernen!
Aber zuerst unsere Werte
- Freundlichkeit – Freundlichkeit bedeutet nicht nur Nettigkeit. Wir hören zu, um zu verstehen. Wir begrüßen und fördern gesunde Debatten und unterschiedliche Perspektiven. Wir gehen Konflikte offen, ehrlich und respektvoll an.
- Brillanz – Bescheidenheit ist die Fähigkeit, auf die wir am stolzesten sind, und eine Wachstumsmentalität ist immer oberste Priorität. Wir übernehmen Verantwortung für alles, was wir tun; wir nutzen regelmäßig unsere einzigartigen Superkräfte, um als Team ein gemeinsames Ziel zu erreichen. Wir feiern Erfolge und Misserfolge gemeinsam.
- Hartnäckigkeit – Wenn Herausforderungen auftreten, bleiben wir laserfokussiert auf die Erreichung unserer Mission und finden einen Weg nach vorne, auch wenn es schwierig ist. Wir sind agil und bewahren ein Gefühl der Dringlichkeit, passen uns schnell an Veränderungen an und überwinden Hindernisse.
Die Gelegenheit
Wir stellen einen Staff Cloud Infrastructure Engineer für das Cloud Infrastructure & Platform (CIN) Team bei Altruist ein. Dies ist eine wirkungsvolle Teamleiterrolle, die für die Architektur, den Aufbau und den Betrieb der AWS-basierten Infrastruktur verantwortlich ist, die unsere Broker-Dealer- und Clearing-Plattform antreibt. Sie werden kritische Infrastrukturbereiche End-to-End verantworten und technische Entscheidungen treffen, die die Zuverlässigkeit, Sicherheit und Skalierbarkeit von Systemen beeinflussen, die reale Finanztransaktionen verarbeiten.
Da sich die Branche mit generativer KI und agentenbasierten Workflows rasant weiterentwickelt, benötigen wir einen KI-orientierten Ingenieur, der tiefgreifende AWS- und Kubernetes-Expertise mit der Vision und Initiative kombiniert, um zu definieren, wie KI/ML-Tools und -Muster den Infrastrukturbetrieb, die Entwicklerproduktivität und die Plattformresilienz transformieren können. Diese Rolle hat erheblichen technischen Einfluss – Sie werden die Infrastrukturstrategie gestalten, komplexe funktionsübergreifende Initiativen leiten und die Messlatte für Engineering-Praktiken im gesamten Unternehmen höher legen.
Was diese Rolle auszeichnet
Dies ist keine Ticket-gesteuerte Infrastrukturrolle. Auf Staff-Niveau erwarten wir von Ihnen:
Ihr Einfluss
Diese Rolle folgt einem hybriden Zeitplan, mit drei Tagen pro Woche vor Ort in unserem Büro in Culver City oder San Francisco.
Gehaltsspanne Los Angeles, CA $181,000—$265,000 USD
Erfüllen Sie nicht jede einzelne Anforderung? Studien haben gezeigt, dass Frauen und Menschen of Color sich seltener auf Stellen bewerben, wenn sie nicht jede einzelne Qualifikation erfüllen. Bei Altruist sind wir bestrebt, ein vielfältiges, integratives und authentisches Arbeitsumfeld zu schaffen. Wenn Sie sich für diese Stelle begeistern, aber Ihre bisherige Erfahrung nicht perfekt mit jeder Qualifikation in der Stellenbeschreibung übereinstimmt, ermutigen wir Sie, sich trotzdem zu bewerben. Sie könnten genau der richtige Kandidat für diese oder andere Stellen sein.
- Verantwortung für Domänen, nicht nur für Aufgaben. Sie werden die technische Autorität für kritische Infrastrukturbereiche (z. B. EKS-Plattform, Observability-Strategie, DR-Architektur oder KI-Infrastruktur) sein und deren Roadmap vorantreiben.
- Technische Richtung definieren. Architekturentscheidungsaufzeichnungen (ADRs) verfassen, Infrastrukturstandards vorschlagen und durch Design-Reviews und RFCs die Technologieauswahl im gesamten Engineering beeinflussen.
- Mit gutem Beispiel vorangehen. Funktionsübergreifende Initiativen vorantreiben, Stakeholder abstimmen, andere Ingenieure entblocken und Infrastrukturperspektiven in Führungsdiskussionen und -planung vertreten.
- Das Team multiplizieren. Das gesamte CIN-Team durch Mentoring, Code-Reviews, Wissensaustausch und den Aufbau wiederverwendbarer Frameworks und Golden Paths, die über Ihre individuelle Leistung hinaus skalieren, aufwerten.
- Infrastruktur und Geschäft verbinden. Komplexe technische Kompromisse in klare Empfehlungen für das Engineering-Management, Produktteams und Compliance-Stakeholder übersetzen.
Cloud-Infrastrukturarchitektur & Plattform-Engineering
- Architektur, Bereitstellung und Betrieb von AWS-Produktionsinfrastruktur, die Hochverfügbarkeits-Finanzdienstleistungs-Workloads unterstützt (EKS, MSK, RDS/Aurora PostgreSQL, OpenSearch, ElastiCache, S3, CloudFront und mehr).
- Verantwortung und Weiterentwicklung der Infrastructure as Code (IaC)-Strategie mit Terraform – Modulstandards definieren, Code-Review-Praktiken durchsetzen und die Einführung wiederverwendbarer Muster teamübergreifend vorantreiben.
- Leitung der Kubernetes (EKS)-Plattformstrategie, einschließlich Cluster-Upgrades, Node-Group-Architektur, Helm-Chart-Governance, Service-Mesh-Entwicklung und Workload-Autoscaling-Richtlinien.
- Entwurf und Vorantreiben von CI/CD-Plattformverbesserungen (GitHub Actions, ArgoCD oder ähnliches), um sichere, schnelle und Self-Service-Bereitstellungen für Anwendungsentwicklungsteams zu ermöglichen.
- Architektur und Validierung von Disaster-Recovery-Strategien (DR), einschließlich Cross-Region-Failover-Designs, Backup-Automatisierung und Leitung von DR-Simulationsübungen.
- Leitung von Infrastruktur-Design-Reviews und Architekturdikussionen; Sicherstellung, dass Lösungen vor der Implementierung Skalierbarkeits-, Sicherheits- und Compliance-Anforderungen erfüllen.
Zuverlässigkeit, Observability & Betriebliche Exzellenz
- Definition und Vorantreiben der Observability-Strategie über die Plattform hinweg (Datadog, Prometheus, Grafana, CloudWatch, OpenSearch) – einschließlich SLO/SLI-Frameworks, Alerting-Standards und verteiltem Tracing.
- Als Senior-On-Call-Eskalationspunkt fungieren; Leitung der Ursachenanalyse bei kritischen Produktionsvorfällen und Vorantreiben systemischer Verbesserungen durch fehlerfreie Post-Mortems.
- Verantwortung für monatliche Ressourcensättigungs-Reviews und Kapazitätsplanungsprozesse; proaktive Identifizierung von Skalierungsbedarfen und Präsentation der Ergebnisse für das Engineering-Management.
- Vorantreiben der Cloud-Kostenoptimierungsstrategie: FinOps-Praktiken, Analyse von Reserved Instances/Savings Plans, Governance von Anbieter-Ausgaben und Verantwortlichkeits-Frameworks teamübergreifend.
Sicherheit, Compliance & Netzwerke
- Definition und Durchsetzung von Sicherheitsarchitekturstandards über AWS-Umgebungen hinweg: IAM-Richtlinien-Governance, VPC-Designmuster, Verschlüsselungsstrategien, Secret-Management (Vault, AWS Secrets Manager) und Workflows zur Behebung von Schwachstellen.
- Zusammenarbeit mit den Abteilungen Sicherheit, Compliance und Audit, um sicherzustellen, dass die Infrastruktur die Anforderungen von FINRA, SEC, SOC 2 und anderen regulatorischen Anforderungen erfüllt – und proaktiv Lücken identifiziert, bevor sie zu Beanstandungen werden.
- Verantwortung für Netzwerkarchitekturentscheidungen, einschließlich VPC-Topologie, Transit Gateway-Strategie, VPN-Konfigurationen, Load Balancer-Mustern (ALB/NLB), CDN-Optimierung (Fastly/CloudFront) und DNS-Management.
KI/ML-Infrastruktur & Entwicklerproduktivität
- Definition der Strategie zur Bewertung, Integration und Governance von KI-gestützten Entwicklerwerkzeugen (z. B. Cursor AI, GitHub Copilot, CodeRabbit) im gesamten Engineering-Unternehmen – einschließlich Nutzungsanalysen, Kostenoptimierung, Sicherheitsüberprüfung und Richtlinien-Frameworks.
- Architektur von Infrastruktur für KI/ML-Workloads: GPU-fähige Rechenleistung, SageMaker-Endpunkte, Bedrock-Integration, Vektordatenbanken und Orchestrierung von Datenpipelines.
- Leitung der Einführung von KI-gesteuerter Automatisierung für Infrastrukturbetriebe – intelligente Benachrichtigungen, Anomalieerkennung, automatische Behebung und AIOps-Muster – vom Explorationsstadium zur Produktionsintegration.
- Aufbau und Förderung interner Plattformen und Golden Paths, die generative KI nutzen, um die Entwicklererfahrung zu verbessern, operative Belastungen zu reduzieren und die Liefergeschwindigkeit zu erhöhen.
Technische Führung & Zusammenarbeit
- Als vertrauenswürdiger technischer Berater für den Director of Engineering und die technische Führung bei Infrastrukturstrategie, Kompromissen und Investitionsprioritäten fungieren.
- Leitung funktionsübergreifender Initiativen, die Anwendungsentwicklung, Daten, Sicherheit und DevSecOps-Teams umfassen – Förderung der Abstimmung bei komplexen, teamübergreifenden Infrastrukturprojekten.
- Vertretung des CIN-Teams in Architektur-Review-Boards, bei der Leitung von Incident-Response und in unternehmensweiten Planungssitzungen.
- Verfassen und Pflegen umfassender technischer Dokumentationen, Runbooks, ADRs und Betriebsverfahren, die als Wissensressourcen für das Unternehmen dienen.
- Mentoring von Senior- und Mid-Level-Ingenieuren; Durchführung gründlicher Design- und Code-Reviews; aktive Beteiligung an Einstellungs- und Onboarding-Prozessen für das CIN-Team.
Mindestanforderungen
Was Sie mitbringen
- 7+ Jahre praktische Erfahrung in der Cloud-Infrastruktur-Entwicklung, mit tiefgreifender, produktionserprobter Expertise in AWS.
- Nachweisliche Erfolgsbilanz bei der Übernahme und Durchführung von Infrastrukturinitiativen von Anfang bis Ende – vom Design und der Architektur bis hin zur Implementierung, Einführung und betrieblichen Exzellenz.
- Expertenniveau-Kenntnisse in Terraform, einschließlich Moduldesign, State-Management-Strategien und der Etablierung von IaC-Standards für Entwicklungsteams.
- Umfangreiche Produktionserfahrung im Betrieb von Kubernetes (EKS stark bevorzugt) im großen Maßstab – Cluster-Lebenszyklus-Management, Multi-Tenancy-Muster, Helm-Governance und GitOps-Workflows.
- Starke Linux-System-Engineering-Kenntnisse und fortgeschrittene Scripting-Kenntnisse (Python, Bash oder Go).
- Tiefgreifende Expertise in CI/CD-Plattformen (GitHub Actions, ArgoCD, Jenkins) mit Erfahrung in der Gestaltung von Bereitstellungsstrategien für Multi-Service-Architekturen.
- Expertenniveau-Verständnis von Cloud-Netzwerken (VPC-Architektur, Transit Gateway, Peering, DNS, Load Balancing) und Sicherheit (IAM, KMS, WAF, GuardDuty, Secrets Manager).
- Nachgewiesene Erfahrung im Design und Betrieb von Observability-Plattformen (Datadog, Prometheus/Grafana, CloudWatch, OpenSearch/ELK) im unternehmensweiten Maßstab.
- Umfangreiche Erfahrung mit Datenbankinfrastruktur und Datenlayersarchitektur (Aurora PostgreSQL, RDS, ElastiCache/Redis, OpenSearch, DynamoDB).
- Nachgewiesene Fähigkeit zur Planung von Disaster Recovery (DR), Durchführung von DR-Simulationen und Gestaltung von HA-Architekturmustern für geschäftskritische Systeme.
- Hervorragende technische Kommunikationsfähigkeiten – Fähigkeit, klare ADRs zu schreiben, vor der Führungsebene zu präsentieren und Infrastrukturkomplexität für nicht-technische Stakeholder zu übersetzen.
- Nachgewiesene Erfolgsbilanz im Mentoring von Ingenieuren und der Verbesserung der Teamfähigkeiten durch Wissensaustausch, Design-Reviews und Tooling-Verbesserungen.
Bonuspunkte
- 7+ Jahre Erfahrung in der Infrastruktur- oder Plattformentwicklung, davon 5+ Jahre auf Senior- oder Staff-Niveau.
- Erfahrung im Finanzdienstleistungs-, Fintech-, Broker-Dealer- oder anderen stark regulierten Branchen mit FINRA/SEC-Compliance-Anforderungen.
- AWS-Zertifizierungen auf Professional- oder Specialty-Level: Solutions Architect Professional, DevOps Engineer Professional, Security Specialty oder Machine Learning Specialty.
- Erfahrung mit Event-Streaming-Plattformen im großen Maßstab (Amazon MSK / Apache Kafka) einschließlich Cluster-Betrieb, Partitionierungsstrategie und Management von Consumer-Gruppen.
- Praktische Erfahrung mit API-Gateway-Management und Plattformdesign (Kong, AWS API Gateway).
- Nachgewiesene Erfahrung mit KI/ML-Infrastruktur: Bereitstellung von GPU-Rechenleistung, SageMaker/Bedrock-Integration, Vektordatenbanken, MLOps-Pipelines oder AIOps-Automatisierung in der Produktion.
- Erfahrung in der Definition und Durchführung von Rollout-Strategien für KI-Entwicklerwerkzeuge im Unternehmen, einschließlich Governance-Frameworks, Nutzungsanalysen und Kostenmanagement.
- Kenntnisse in Policy-as-Code-Frameworks (OPA/Rego, Sentinel, Kyverno) für Infrastruktur-Governance und Compliance-Automatisierung.
- FinOps-Zertifizierung oder nachgewiesene Erfahrung in der Leitung von Cloud-Kostenoptimierungsprogrammen im großen Maßstab.
- Erfahrung im Verfassen von RFCs, ADRs oder technischen Strategiedokumenten, die unternehmensweite Entscheidungen beeinflusst haben.
- Beiträge zu Open-Source-Projekten, Konferenzvorträge oder veröffentlichte technische Texte.
Was wir bieten
Die Gewinnung und Bindung von Top-Talenten hat Priorität. Wir sind stolz auf die Kultur, die wir aufgebaut haben, und sind uns der sich ständig verändernden beruflichen Landschaft bewusst. Unser dynamisches Angebot an Vergünstigungen und Leistungen ist darauf zugeschnitten, dass Sie sich bei Ihrer besten Leistung am besten fühlen.
- Atemberaubende, mit Annehmlichkeiten ausgestattete Büroräume in Culver City, CA, San Francisco, CA und Dallas, TX. Unsere Büros sind bewusst auf Komfort, Zusammenarbeit und Produktivität ausgelegt.
- Wettbewerbsfähige Gesamtvergütung.
- Erstklassige Kranken-, Zahn- und Augenversicherungspläne (HMO und PPO).
- 401k-Sparkonto mit 4% Zuschuss und sofortiger Vesting.
- 16 Wochen bezahlter Elternurlaub nach einem Jahr Beschäftigung.
- Berufliche Wachstums- und Entwicklungsmöglichkeiten, einschließlich eines Mitarbeiter-Mobilitätsprogramms und eines jährlichen L&D-Budget-Anteils für jeden Mitarbeiter.
- Firmen-Perk-Programm (beinhaltet Rabatte auf Tierversicherung, Fitness, Mobilfunktarife und Reisen usw.).
- Finanzberatungsprogramm (beinhaltet Beratung zur Bewältigung von Schulden, Verfolgung persönlicher Ausgaben, Spar- und Planungszielen, Vorbereitung auf den Hauskauf usw.).
- Einmonatige „Work from Anywhere“-Richtlinie (mit Ausnahme einiger Länder).
Die Gesamtvergütung beinhaltet ein wettbewerbsfähiges Leistungspaket sowie ein Bonusprogramm für berechtigte Rollen. Für Gehaltspositionen wird ein Gehaltsangebot durch eine Reihe von Faktoren bestimmt, darunter Erfahrung, Qualifikationsniveau, interne Gehaltsgerechtigkeit, geografischer Standort und andere relevante geschäftliche Überlegungen. Wir überprüfen regelmäßig alle Gehalts- und Vergütungsprogramme für Mitarbeiter, um eine faire, gerechte und wettbewerbsfähige Bezahlung zu gewährleisten. Bei Altruist verpflichten wir uns, eine faire, gerechte und wettbewerbsfähige Vergütung zu bieten, indem wir Marktdaten zur Information unserer Gehaltsbänder nutzen. Grundgehälter werden in regelmäßigen Abständen im Laufe des Jahres überprüft, typischerweise im Zusammenhang mit Leistungsbeurteilungszyklen. Durch die regelmäßige Bewertung der Vergütung können wir hohe Leistungen honorieren und sicherstellen, dass alle Mitarbeiter Wachstumschancen haben.
