Esri
Charles River Associates
Site Reliability Engineer – Disaster Recovery & Business Continuity
Über Charles River Associates
Seit über 50 Jahren ist Charles River Associates ein führendes Beratungsunternehmen, das seinen Mitarbeitern die Möglichkeit bietet, von einer vielfältigen Gruppe von Beratern, Branchenexperten und Akademikern zu lernen. Bei CRA lernen Sie führende Köpfe kennen, die ökonomische, finanzielle und geschäftliche Analysen nutzen, um komplexe globale Probleme für eine beeindruckende Liste von Kunden zu lösen, darunter große Anwaltskanzleien, Fortune 100-Unternehmen und Regierungsbehörden. Durch ein kollegiales Umfeld, formelle und informelle Schulungsmöglichkeiten sowie ein breites Spektrum an professionellen Entwicklungsressourcen eröffnet Ihnen Ihre Erfahrung bei CRA Türen für Ihre gesamte Karriere.
Die Abteilung Information Technology (ITS) bei Charles River Associates ist derzeit ein Team von mehr als 40 Fachleuten, die sich der Verbesserung, Wartung und Entwicklung der technologischen Infrastruktur und Sicherheit des Unternehmens widmen. Das Team besteht aus vier Funktionen:
- Service Delivery & Telecom
- Enterprise Application Solutions
- Infrastruktur, Netzwerke und Cloud-Lösungen
- Informationssicherheit
Die Mitarbeiter der Informationstechnologie sind in den Büros in Boston, Chicago, London, München, New York, Oakland, San Francisco, College Station und Washington, DC tätig.
CRA ist hauptsächlich ein Microsoft-Haus und möchte die Leistung unserer lokalen Systeme und unserer hybriden Infrastruktur maximieren, was bedeutet, dass Erfahrung mit Cloud-Technologien für diese Rolle unerlässlich ist.
Position im Überblick
Der Site Reliability Engineer (SRE) trägt dazu bei, die Zuverlässigkeit, Skalierbarkeit und Leistung der kritischen Geschäftsdienste von CRA in lokalen und Cloud-Umgebungen sicherzustellen. Diese Rolle kombiniert Software-Engineering- und Betriebspraktiken, um manuelle Arbeit durch Automatisierung zu reduzieren, die Service-Observability zu verbessern und die Reaktion auf Vorfälle zu stärken. Der SRE arbeitet eng mit den Infrastruktur-, Sicherheits-, Anwendungs- und Service-Delivery-Teams zusammen, um messbare Zuverlässigkeitsziele (SLIs/SLOs) zu definieren, resiliente Architekturen zu implementieren und kontinuierliche Verbesserungen durch blameless Post-Incident Learning voranzutreiben.
Hauptverantwortlichkeiten
- Praktische Erfahrung im System Engineering mit Kern-Enterprise-Infrastrukturplattformen und -diensten, einschließlich Windows Server, VMware vSphere, VMware Site Recovery Manager (SRM), SAN-Technologien und dem Rubrik-Ökosystem, mit der Fähigkeit, Abhängigkeiten, Wiederherstellungsworkflows und Ausfallmodi in lokalen und Cloud-Umgebungen zu verstehen.
- Service-Verantwortung & Zuverlässigkeitsziele: Arbeiten Sie mit Service-Ownern zusammen, um Service Level Indicators (SLIs) und Service Level Objectives (SLOs) für Verfügbarkeit, Latenz und Leistung zu definieren und aufrechtzuerhalten; verfolgen Sie Fehlerbudgets und Zuverlässigkeitsrisiken.
- Observability: Implementieren und verbessern Sie kontinuierlich Monitoring, Logging, Alerting und Dashboards, um umsetzbare, symptom-basierte Signale bereitzustellen und die mittlere Erkennungs-/Reaktionszeit (MTTD/MTTR) zu reduzieren.
- Blameless Postmortems & Kontinuierliche Verbesserung: Moderieren Sie Post-Incident-Reviews, identifizieren Sie Ursachen und beitragende Faktoren und treiben Sie Behebungsmaßnahmen zur Fertigstellung voran; standardisieren Sie Erkenntnisse in Runbooks und Betriebspraktiken.
- Aufbau des DR-Testprogramms: Entwerfen und starten Sie ein skalierbares DR-Testprogramm (Umfang, Testarten, Kadenz, Erfolgskriterien und Beweiserfassung) in Zusammenarbeit mit Anwendungs-, Infrastruktur- und Sicherheitsteams; pflegen Sie Runbooks und leiten Sie regelmäßige Tabletop- und technische Wiederherstellungsübungen, um RTO/RPO-Annahmen zu validieren und die Wiederherstellbarkeit zu verbessern.
- DR-Bereitschaft: Tragen Sie zur Zuverlässigkeitsarchitektur und zur Katastrophenschutzbereitschaft für Schlüssel-Services bei, einschließlich Abhängigkeitszuordnung, Eingaben für Wiederherstellungstests und Validierung von Wiederherstellungsverfahren.
- Cross-funktionale Zusammenarbeit: Arbeiten Sie täglich mit Infrastruktur-, Netzwerk-, Cloud-, Sicherheits- und Anwendungs-Teams zusammen, um operative Exzellenz, eine Kultur der Zuverlässigkeit und gemeinsame Verantwortung für Produktionsergebnisse zu verbessern.
Mindestanforderungen
Relevante Fähigkeiten & Erfahrungen
- Erfahrung im Betrieb und der Verbesserung der Zuverlässigkeit von Produktionsdiensten (lokal und/oder Cloud), einschließlich Incident Response, operativer Bereitschaft und Service-Verantwortung.
- Arbeitskenntnisse über SRE-Konzepte und -Praktiken wie SLIs/SLOs, Fehlerbudgets, Monitoring/Alerting-Strategie und blameless Postmortems.
- Erfahrung mit Observability-Tools und -Praktiken (Logs, Metriken, Tracing, Dashboards) und der Nutzung von Daten zur Verbesserung von Zuverlässigkeit und Leistung.
- Erfahrung mit Disaster-Recovery-Orchestrierung und Wiederherstellungstests mit VMware Site Recovery Manager (SRM) und Azure Site Recovery (ASR) (oder ähnlichen Public-Cloud-DR-Diensten).
- Nachgewiesene Erfahrung im Aufbau und Betrieb eines DR-Testprogramms, einschließlich Abhängigkeitszuordnung, Testplanung, Koordination zwischen Stakeholdern, Durchführung von Tabletop- und technischen Failover-Tests, Dokumentation von Ergebnissen und Verfolgung von Behebungsmaßnahmen bis zum Abschluss.
- Starke cross-funktionale Kommunikations- und Teamfähigkeiten; komfortabel in der Zusammenarbeit mit Engineering-, Sicherheits- und Betriebsteams, um gemeinsame Ergebnisse zu erzielen.
- Fähigkeit, operative Verfahren (Runbooks) zu dokumentieren und zu standardisieren, an Bereitschaftsdiensten teilzunehmen und mehrere Prioritäten in einem sich schnell entwickelnden Umfeld zu verwalten.
Karrierewachstum und Vorteile
- Die robusten Weiterbildungsprogramme von CRA crai.com/cra-careers/talent-development/, einschließlich einer Verpflichtung, jährlich 100 Stunden Schulung durch formelle und informelle Programme anzubieten, ermutigen Sie, sich als Einzelperson und Teammitglied zu entfalten. Beginnend mit dem Aufbau von Forschungs- und Analysefähigkeiten, geht die Schulung weiter mit technischem Training, Präsentationsfähigkeiten, internen Seminaren und Karriere-Mentoring und Leistungs-Coaching durch einen zugewiesenen erfahrenen Kollegen. Zusätzliche Führungs- und Kooperationsmöglichkeiten ergeben sich aus internen Entwicklungsaktivitäten des Unternehmens.
- Wir bieten ein umfassendes Gesamtvergütungspaket, einschließlich eines überlegenen Leistungspakets, Wellness-Programmen crai.com/benefits/ zur Unterstützung des körperlichen, geistigen, emotionalen und finanziellen Wohlbefindens sowie Inhouse-Unterstützung bei Einwanderungsfragen crai.com/cra-careers/immigration-global-mobility/ für ausländische Staatsbürger und internationale Geschäftsreisende.
CRA bietet ein umfassendes Leistungspaket, vorbehaltlich der Anspruchsvoraussetzungen, das Folgendes umfassen kann: Kranken-, Zahn- und Augenversicherung; 401(k) Altersvorsorgeplan mit Arbeitgeberzuschuss; Lebens- und Invaliditätsversicherung; bezahlte Freizeit (Urlaub, Krankheitstage, Feiertage); bezahlter Elternurlaub; Wellnessprogramme und Mitarbeiterunterstützungsressourcen; und Pendlerleistungen.
Flexibilität des Arbeitsortes
CRA schafft ein Arbeitsumfeld, das es unseren Kollegen ermöglicht, von der Anwesenheit im Büro zu profitieren, um unser Versprechen von Karrierewachstum, Mentoring und Inklusivität am besten zu erfüllen. Gleichzeitig erkennen wir an, dass Einzelpersonen eine Reihe von Vorteilen erzielen, wenn sie gelegentlich von zu Hause aus arbeiten. Wir gehen derzeit davon aus, dass Einzelpersonen mindestens 3 bis 4 Tage pro Woche im Büro arbeiten (was auch Reisen zu einem anderen CRA-Büro oder zu Kundentreffen beinhalten kann), wobei spezifische Tage in Abstimmung mit Ihrer Praxis oder Ihrem Team festgelegt werden.
Unser Engagement für Chancengleichheit am Arbeitsplatz
Charles River Associates ist ein Arbeitgeber, der Chancengleichheit fördert (EOE). Alle qualifizierten Bewerber erhalten eine Berücksichtigung für eine Anstellung, unabhängig von Rasse, Hautfarbe, Religion, Geschlecht, nationaler Herkunft, Alter, Behinderung, Status als geschützter Veteran oder einer anderen durch geltendes Recht geschützten Eigenschaft.
Gehalt und sonstige Vergütung
Eine gutgläubige Schätzung der jährlichen Grundgehaltsspanne für diese Position beträgt 130.000 $ - 150.000 $. Die Angabe der Bezahlung innerhalb dieser Spanne kann je nach Faktoren wie Bildungsniveau, Erfahrung, Fähigkeiten, geografischem Standort, Marktbedingungen und anderen Qualifikationen des erfolgreichen Kandidaten variieren. Diese Position kann Anspruch auf zusätzliche Bonus-Incentive-Vergütung haben.
