Launch Legends
Charles River Associates
Ingeniero de Fiabilidad de Sitios - Recuperación ante Desastres y Continuidad del Negocio
Acerca de Charles River Associates
Durante más de 50 años, Charles River Associates ha sido una consultora de primer nivel que ofrece a los empleados un lugar para aprender de un grupo diverso de consultores, expertos de la industria y académicos. En CRA estará expuesto a mentes líderes que utilizan análisis económicos, financieros y de negocios para resolver complejos problemas mundiales para una impresionante lista de clientes, incluyendo importantes bufetes de abogados, empresas de la lista Fortune 100 y agencias gubernamentales. A través de un entorno colegiado, oportunidades de formación formal e informal, y una amplia gama de recursos de desarrollo profesional, su experiencia en CRA le abrirá puertas a lo largo de su carrera.
El departamento de Tecnología de la Información (ITS) de Charles River Associates es actualmente un equipo de más de 40 profesionales dedicados a mejorar, mantener y desarrollar la infraestructura tecnológica y la seguridad de la firma. El equipo está compuesto por cuatro funciones:
- Entrega de Servicios y Telecomunicaciones
- Soluciones de Aplicaciones Empresariales
- Infraestructura, Redes y Soluciones en la Nube
- Seguridad de la Información
El personal de Tecnología de la Información está ubicado en las oficinas de Boston, Chicago, Londres, Múnich, Nueva York, Oakland, San Francisco, College Station y Washington, DC.
Principalmente una casa Microsoft, CRA busca maximizar el rendimiento de nuestros sistemas locales y nuestra infraestructura híbrida, lo que significa que la experiencia con tecnologías en la nube es esencial para este puesto.
Descripción General del Puesto
El Ingeniero de Fiabilidad de Sitios (SRE) ayuda a garantizar que los servicios críticos de negocio de CRA sean fiables, escalables y de alto rendimiento en entornos locales y en la nube. Este puesto combina prácticas de ingeniería de software y operaciones para reducir el trabajo manual a través de la automatización, mejorar la observabilidad del servicio y fortalecer la respuesta a incidentes. El SRE colabora estrechamente con los equipos de infraestructura, seguridad, aplicaciones y entrega de servicios para definir objetivos medibles de fiabilidad (SLI/SLO), implementar arquitecturas resilientes e impulsar la mejora continua a través del aprendizaje post-incidente sin culpas.
Responsabilidades Clave
- Experiencia práctica en Ingeniería de Sistemas con plataformas y servicios de infraestructura empresarial centrales, incluyendo Windows Server, VMware vSphere, VMware Site Recovery Manager (SRM), tecnologías SAN y el ecosistema Rubrik, con la capacidad de comprender las dependencias, los flujos de trabajo de recuperación y los modos de fallo en entornos locales y en la nube.
- Propiedad del Servicio y Objetivos de Fiabilidad: Colaborar con los propietarios de servicios para definir y mantener indicadores de nivel de servicio (SLI) y objetivos de nivel de servicio (SLO) para disponibilidad, latencia y rendimiento; realizar un seguimiento de los presupuestos de error y el riesgo de fiabilidad.
- Observabilidad: Implementar y mejorar continuamente la monitorización, el registro, las alertas y los paneles para proporcionar señales accionables basadas en síntomas y reducir el tiempo medio de detección/respuesta (MTTD/MTTR).
- Postmortems sin Culpas y Mejora Continua: Facilitar revisiones post-incidente, identificar causas raíz y factores contribuyentes, y llevar a cabo las acciones de remediación hasta su finalización; estandarizar los aprendizajes en manuales de operaciones y prácticas operativas.
- Desarrollo del Programa de Pruebas de DR: Diseñar y lanzar un programa escalable de pruebas de DR (alcance, tipos de pruebas, cadencia, criterios de éxito y captura de evidencia) en colaboración con los equipos de aplicaciones, infraestructura y seguridad; mantener manuales de operaciones y liderar ejercicios regulares de simulación y recuperación técnica para validar las suposiciones de RTO/RPO y mejorar la recuperabilidad.
- Preparación para DR: Contribuir a la arquitectura de fiabilidad y a la preparación para la recuperación ante desastres de servicios clave, incluyendo el mapeo de dependencias, las entradas de pruebas de recuperación y la validación de los procedimientos de recuperación.
- Colaboración Interfuncional: Trabajar día a día con los equipos de infraestructura, red, nube, seguridad y aplicaciones para mejorar la excelencia operativa, la cultura de fiabilidad y la propiedad compartida de los resultados de producción.
Requisitos mínimos
Habilidades y Experiencia Relevantes
- Experiencia operando y mejorando la fiabilidad de servicios de producción (locales y/o en la nube), incluyendo respuesta a incidentes, preparación operativa y propiedad del servicio.
- Conocimiento práctico de los conceptos y prácticas de SRE como SLI/SLO, presupuestos de error, estrategia de monitorización/alertas y postmortems sin culpas.
- Experiencia con herramientas y prácticas de observabilidad (registros, métricas, trazado, paneles) y uso de datos para mejorar la fiabilidad y el rendimiento.
- Experiencia con orquestación de recuperación ante desastres y pruebas de recuperación utilizando VMware Site Recovery Manager (SRM) y Azure Site Recovery (ASR) (o servicios similares de DR en la nube pública).
- Experiencia demostrada en la creación y operación de un programa de pruebas de DR, incluyendo mapeo de dependencias, planificación de pruebas, coordinación entre partes interesadas, ejecución de pruebas de simulación y failover técnico, documentación de resultados y seguimiento de acciones de remediación hasta su cierre.
- Sólidas habilidades de comunicación y trabajo en equipo interfuncional; comodidad colaborando con equipos de ingeniería, seguridad y operaciones para lograr resultados compartidos.
- Capacidad para documentar y estandarizar procedimientos operativos (manuales de operaciones), participar en rotaciones de guardia y gestionar múltiples prioridades en un entorno de rápida evolución.
Crecimiento Profesional y Beneficios
- Los sólidos programas de desarrollo de habilidades de CRA crai.com/cra-careers/talent-development/, incluyendo un compromiso de ofrecer 100 horas de formación anual a través de programas formales e informales, le animan a prosperar como individuo y miembro del equipo. Comenzando con la creación de habilidades de investigación y análisis, la formación continúa con capacitación técnica, habilidades de presentación, seminarios internos y mentoría profesional y coaching de rendimiento por parte de un colega senior asignado. Existen oportunidades adicionales de liderazgo y colaboración a través de actividades internas de desarrollo de la firma.
- Ofrecemos un programa integral de recompensas totales que incluye un paquete superior de beneficios, programas de bienestar crai.com/benefits/ para apoyar el bienestar físico, mental, emocional y financiero, y soporte interno de inmigración crai.com/cra-careers/immigration-global-mobility/ para ciudadanos extranjeros y viajeros de negocios internacionales.
CRA ofrece un paquete integral de beneficios, sujeto a los requisitos de eligibilidad, que pueden incluir: seguro médico, dental y de visión; plan de jubilación 401(k) con aportación del empleador; seguro de vida y } discapacidad; tiempo libre remunerado (vacaciones, baja por enfermedad, días festivos); baja parental remunerada; programas de bienestar y recursos de asistencia al empleado; y beneficios de transporte.
Flexibilidad en la Ubicación del Trabajo
CRA crea un entorno de trabajo que permite a nuestros colegas beneficiarse de estar juntos en la oficina para cumplir mejor nuestra promesa de crecimiento profesional, mentoría e inclusión. Al mismo tiempo, reconocemos que los individuos obtienen una variedad de beneficios al trabajar desde casa periódicamente. Actualmente esperamos que las personas pasen al menos 3 a 4 días a la semana trabajando en la oficina (lo que puede incluir viajar a otra oficina de CRA o a reuniones con clientes), con días específicos determinados en coordinación con su práctica o equipo.
Nuestro Compromiso con la Igualdad de Oportunidades de Empleo
Charles River Associates es un empleador que ofrece igualdad de oportunidades (EOE). Todos los solicitantes cualificados recibirán consideración para el empleo sin distinción de raza, color, religión, sexo, origen nacional, edad, discapacidad, condición de veterano protegido o cualquier otra característica protegida por la ley aplicable.
Salario y otras compensaciones
Una estimación de buena fe del rango salarial base anual para este puesto es de $130,000 - $150,000. La declaración de pago dentro de este rango puede variar según factores como el nivel educativo, la experiencia, las habilidades, la ubicación geográfica, las condiciones del mercado y otras calificaciones del candidato seleccionado. Este puesto puede ser elegible para una compensación adicional de bonificación.
