Roku
PulseRise Technologies
Senior SRE, Ingeniería de Software (AWS / Escalado de Infraestructura)
Sobre la oportunidad
Estimados/as candidatos/as, tengan en cuenta que las solicitudes sin expectativas salariales y perfil de LN activo no serán consideradas. Esperamos su comprensión.
HÍBRIDO EN NUEVA YORK
Detalles
Ubicación: NYC (Híbrido)
Modelo de Trabajo: Híbrido
Tipo de Empleo: Tiempo completo
Industria: Tecnología Financiera
Fecha de Inicio: ASAP
Proceso de Entrevista
- Criba del reclutador.
- Criba del Hiring Manager.
- Estudio de caso / Entrevista de panel.
- Entrevistas presenciales.
- Entrevista cultural / CEO.
- Oferta.
Buscamos dos Ingenieros/as de Fiabilidad de Sitios (Site Reliability Engineers) Senior para construir y escalar los cimientos de fiabilidad para una plataforma fintech en rápido crecimiento. Este rol se centra en la arquitectura de infraestructuras resilientes, el fortalecimiento de la observabilidad y el establecimiento de prácticas SRE sostenibles a medida que los sistemas escalan de miles a millones de usuarios. Liderarás la respuesta a incidentes, diseñarás arquitecturas cloud de alta disponibilidad y asegurarás que los equipos de ingeniería puedan lanzar código rápidamente sin comprometer la fiabilidad. El puesto requiere una profunda experiencia en AWS, una sólida experiencia en infraestructura como código y una mentalidad proactiva de fiabilidad. Colaborarás estrechamente con los equipos de desarrollo para diseñar bases de datos escalables, flujos de trabajo asíncronos y pipelines de datos. Este es un rol híbrido de alto impacto basado en NYC para ingenieros/as que prosperan en entornos de escalado rápido.
Responsabilidades Clave
- Liderar la respuesta a incidentes y establecer procesos sostenibles de guardia (on-call).
- Crear runbooks completos y fomentar una cultura de postmortems sin culpabilización (blameless postmortem).
- Arquitectar infraestructura cloud escalable y de alta disponibilidad en AWS.
- Diseñar estrategias de autoescalado, comprobaciones de estado (health checks) y degradación elegante (graceful degradation).
- Implementar y promover herramientas modernas de observabilidad (monitorización, logging, tracing).
- Desarrollar infraestructura como código utilizando Terraform o CloudFormation.
- Construir y mejorar pipelines de CI/CD con estrategias de despliegue avanzadas (blue/green, canary).
- Colaborar con los equipos de ingeniería para integrar la fiabilidad en el diseño de funcionalidades.
- Mejorar el rendimiento de bases de datos, flujos de trabajo asíncronos y la fiabilidad de pipelines de datos.
- Reducir el MTTR (Mean Time To Recover) mediante mejoras sistemáticas de procesos y herramientas.
Requisitos
- 5+ años de experiencia en SRE/DevOps O 7+ años de ingeniería de software con un fuerte enfoque en infraestructura.
- Experiencia demostrada liderando la respuesta a incidentes para sistemas de producción de alta disponibilidad.
- Sólida experiencia en AWS (EC2, Fargate, redes, estrategias de escalado).
- Experiencia con infraestructura como código (Terraform preferido).
- Experiencia práctica en la implementación de soluciones de observabilidad (Datadog, Prometheus, ELK, etc.).
- Experiencia en el diseño de pipelines de CI/CD y automatización de despliegues.
- Sólidos conocimientos de diseño de sistemas escalables y prácticas de fiabilidad en producción.
- Excelentes habilidades de documentación y comunicación inter-equipos.
Se valorará
- Experiencia escalando sistemas fintech o regulados.
- Experiencia trabajando en culturas de ingeniería de alto rendimiento.
- Evidencia de experiencia emprendedora o de alta iniciativa.
- Experiencia diseñando infraestructura de flujos de trabajo asíncronos o pipelines de datos a gran escala.
