Roku
PulseRise Technologies
Engenheiro(a) Sênior de Confiabilidade de Sistemas (SRE), Engenharia de Software (AWS / Escalabilidade de Infraestrutura)
Sobre a oportunidade
Prezados(as) candidatos(as), pedimos a gentileza de notar que candidaturas sem pretensão salarial e perfil LN ativo não serão consideradas. Agradecemos a compreensão.
HÍBRIDO EM NOVA YORK
Detalhes
Localização: NYC (Híbrido)
Modelo de Trabalho: Híbrido
Tipo de Contrato: Tempo Integral
Indústria: Tecnologia Financeira
Data de Início: Imediatamente
Processo de Entrevista
- Triagem com Recrutador(a)
- Triagem com Gerente Contratante
- Estudo de Caso / Entrevista em Painel
- Entrevistas Presenciais
- Entrevista Cultural / com CEO
- Oferta
Estamos buscando dois Engenheiros(as) Sêniores de Confiabilidade de Sistemas para construir e escalar as bases de confiabilidade para uma plataforma de fintech em rápido crescimento. Esta função foca na arquitetura de infraestrutura resiliente, fortalecimento da observabilidade e estabelecimento de práticas sustentáveis de SRE à medida que os sistemas escalam de milhares para milhões de usuários. Você liderará a resposta a incidentes, projetará arquiteturas de nuvem de alta disponibilidade e garantirá que as equipes de engenharia possam entregar rapidamente sem comprometer a confiabilidade. A posição exige profundo conhecimento em AWS, forte experiência em infraestrutura como código e uma mentalidade proativa de confiabilidade. Você fará parceria com as equipes de desenvolvimento para projetar bancos de dados escaláveis, fluxos de trabalho assíncronos e pipelines de dados. Esta é uma função híbrida de alto impacto baseada em NYC para engenheiros que prosperam em ambientes de escalabilidade rápida.
Principais Responsabilidades
- Liderar a resposta a incidentes e estabelecer processos sustentáveis de plantão (on-call)
- Criar runbooks abrangentes e promover uma cultura de postmortens sem culpa (blameless)
- Arquitetar infraestrutura de nuvem altamente disponível e escalável na AWS
- Projetar estratégias de auto-escalonamento, health checks e graceful degradation
- Implementar e evangelizar ferramentas modernas de observabilidade (monitoramento, logging, tracing)
- Desenvolver infraestrutura como código usando Terraform ou CloudFormation
- Construir e aprimorar pipelines de CI/CD com estratégias avançadas de implantação (blue/green, canary)
- Colaborar com equipes de engenharia para incorporar a confiabilidade no design de funcionalidades
- Melhorar o desempenho de bancos de dados, fluxos de trabalho assíncronos e a confiabilidade de pipelines de dados
- Reduzir o MTTR (Tempo Médio para Recuperação) através de melhorias sistemáticas de processos e ferramentas
Requisitos
- 5+ anos de experiência em SRE/DevOps OU 7+ anos de engenharia de software com forte foco em infraestrutura
- Experiência comprovada em liderar resposta a incidentes para sistemas de produção de alta disponibilidade
- Forte expertise em AWS (EC2, Fargate, redes, estratégias de escalonamento)
- Experiência com infraestrutura como código (Terraform preferencial)
- Experiência prática na implementação de soluções de observabilidade (Datadog, Prometheus, ELK, etc.)
- Experiência em projetar pipelines de CI/CD e automação de implantação
- Sólido conhecimento em design de sistemas escaláveis e práticas de confiabilidade de produção
- Excelentes habilidades de documentação e comunicação inter-equipes
Diferenciais
- Experiência em escalonamento de sistemas fintech ou regulamentados
- Experiência em trabalhar em culturas de engenharia de alta performance
- Evidência de histórico empreendedor ou de alta iniciativa
- Experiência em projetar infraestrutura de fluxo de trabalho assíncrono ou pipelines de dados de alta escala
