Sword
Boston Consulting Group
Gerente Sênior Global de Engenharia de Confiabilidade de Sites
Quem Somos
Boston Consulting Group faz parcerias com líderes em negócios e sociedade para enfrentar seus desafios mais importantes e capturar suas maiores oportunidades. A BCG foi pioneira em estratégia de negócios quando foi fundada em 1963. Hoje, ajudamos os clientes com transformação total - inspirando mudanças complexas, capacitando organizações a crescer, construindo vantagem competitiva e impulsionando o impacto financeiro.
Para ter sucesso, as organizações devem combinar capacidades digitais e humanas. Nossas equipes diversas e globais trazem profundo conhecimento setorial e funcional e uma variedade de perspectivas para impulsionar a mudança. A BCG entrega soluções por meio de consultoria de gestão de ponta, juntamente com tecnologia e design, empreendimentos corporativos e digitais - e propósito de negócios. Trabalhamos em um modelo colaborativo único em toda a empresa e em todos os níveis da organização do cliente, gerando resultados que permitem que nossos clientes prosperem.
O Que Você Fará
O Engenheiro Sênior de Confiabilidade de Sites é responsável por gerenciar a capacidade de engenharia por trás de uma área definida de confiabilidade em toda a organização. A função atua em várias disciplinas de SRE, incluindo infraestrutura, nuvem, observabilidade, automação, identidade, segurança e operações de rede, aplicando o pensamento de engenharia para reduzir o trabalho operacional repetitivo, melhorar a resiliência e incorporar confiabilidade e governança nos fluxos de trabalho de entrega e operacionais.
A função impulsiona a qualidade e a consistência da engenharia dentro de seu escopo de responsabilidade, contribui para padrões de engenharia mais amplos e ajuda a moldar como a confiabilidade é entregue em toda a organização. Ela constrói padrões reutilizáveis, orienta engenheiros e fornece contribuições de engenharia sênior para um conjunto mais amplo de stakeholders.
Responsabilidades Principais
- Executar e melhorar continuamente os sistemas de engenharia de confiabilidade dentro do escopo, incluindo automação, pipelines, observabilidade e ferramentas operacionais.
- Projetar e implementar soluções de engenharia que eliminem o trabalho operacional repetitivo em escala e incorporem a confiabilidade nos fluxos de trabalho de entrega.
- Ajudar a moldar padrões de engenharia, modelos e frameworks reutilizáveis em toda a prática de SRE.
- Liderar a resposta de engenharia a incidentes complexos dentro do escopo, impulsionar a remediação sistêmica e contribuir para o aprendizado pós-incidente.
- Orientar e treinar engenheiros menos seniores em engenharia de confiabilidade, automação, observabilidade e princípios de SRE.
- Impulsionar a colaboração entre equipes com as funções de engenharia, plataforma e operações para incorporar confiabilidade e governança por meio de controles de engenharia.
- Comunicar o status da engenharia, riscos e recomendações claramente para stakeholders seniores e fóruns de liderança.
- Contribuir para revisões operacionais mensais com métricas estruturadas sobre saúde do serviço, desempenho de ingestão ou pipeline, cobertura de automação e progresso de melhoria.
O Que Você Trará
O candidato ideal é um profissional sênior que se sente confortável operando em vários domínios, equilibra a entrega com mentoria e pode articular claramente as compensações de engenharia para públicos técnicos e não técnicos.
- 5–8 anos de experiência em Engenharia de Confiabilidade de Sites, Engenharia de Plataforma ou disciplinas de engenharia operacional relacionadas.
- Forte experiência prática em múltiplos domínios de SRE, incluindo nuvem, automação, observabilidade e CI/CD.
- Experiência comprovada no projeto e implementação de soluções de automação e confiabilidade em escala.
- Profundo conhecimento de pelo menos uma plataforma de nuvem (AWS ou Azure), incluindo rede, identidade e primitivas de observabilidade.
- Experiência com Infraestrutura como Código (ex: Terraform) e pipelines de CI/CD.
- Forte experiência em scripting (ex: Python).
- Experiência em liderar resposta a incidentes e impulsionar melhorias sistêmicas.
- Fortes habilidades de engajamento de stakeholders e comunicação técnica.
- Profunda experiência prática com uma ou mais plataformas de observabilidade corporativa (ex: Splunk, Datadog).
- Experiência comprovada no projeto e operação de pipelines de telemetria, controles de ingestão e gerenciamento de custos de observabilidade.
- Experiência comprovada no projeto de sinais (SLIs, SLOs, verificações sintéticas, alertas) e automação de operações acionada por esses sinais.
- Experiência em impulsionar práticas de SLO/SLI em várias equipes.
- Profunda experiência prática na operação de infraestrutura de nuvem em pelo menos duas das seguintes: AWS, Azure, GCP ou Alibaba Cloud.
- Experiência comprovada no projeto de padrões reutilizáveis de IaC e componentes de zona de pouso entre provedores de nuvem.
- Forte conhecimento prático de rede em nuvem, gerenciamento de contas, primitivas de identidade e aplicação de políticas entre provedores.
- Experiência em impulsionar padrões de engenharia de plataforma de nuvem e governança em várias equipes.
- Profunda experiência prática com plataformas de identidade (ex: Entra ID) e gerenciamento de segredos (ex: HashiCorp Vault).
- Experiência comprovada no projeto de padrões OIDC, identidade de carga de trabalho e credenciais dinâmicas.
- Experiência em impulsionar a adoção de Zero Trust e menor privilégio em várias equipes.
- Profunda experiência prática com ferramentas de segurança incorporadas em pipelines de CI/CD.
- Experiência comprovada no projeto de controles de política como código e padrões seguros por padrão.
- Experiência em impulsionar a adoção de engenharia segura em várias equipes.
- Profunda experiência prática com arquiteturas de rede híbridas e em nuvem.
- Experiência comprovada no projeto de controles de rede automatizados por meio de IaC.
- Experiência em impulsionar a segmentação Zero Trust e a adoção de observabilidade de rede.
Qualificações Preferenciais
- Experiência de trabalho em um ambiente federado, multinuvem ou de grande empresa.
- Familiaridade com conteinerização (Docker) e orquestração (Kubernetes).
- Experiência com ferramentas de gerenciamento de segredos (ex: HashiCorp Vault).
- Certificação em nuvem em nível profissional.
- Experiência com ferramentas de política como código (ex: OPA, Sentinel).
- Experiência em contribuir para comunidades de prática de engenharia.
- Experiência com AIOps, redução de ruído e correlação de eventos.
- Experiência com plataformas de automação de operações orientadas a eventos (ex: ServiceNow, PagerDuty, fluxos de trabalho personalizados).
- Capacidade de liderar incidentes complexos de plataforma de observabilidade e revisões de capacidade.
- Experiência com FinOps em nuvem, engenharia de custos e ferramentas de rateio.
- Experiência prática com arquitetura de plataforma Alibaba Cloud.
- Experiência com ferramentas de política como código em nuvem (ex: Políticas de Controle de Serviço AWS, Política Azure, OPA).
- Forte compreensão dos riscos de segurança relacionados à identidade e mitigações.
- Forte compreensão dos riscos de segurança comuns e mitigações em todo o SDLC.
- Forte compreensão dos padrões de confiabilidade, observabilidade e segurança de rede.
Com Quem Você Trabalhará
- Modelo de trabalho híbrido ou presencial.
- Atua como um contribuidor individual sênior com mentoria e influência entre equipes.
- Espera-se que participe do rodízio de plantão e lidere a resposta a incidentes.
- Viagens ocasionais podem ser necessárias para engajamento de equipe ou stakeholders.
Boston Consulting Group é um Empregador de Oportunidades Iguais. Todos os candidatos qualificados receberão consideração para emprego sem distinção de raça, cor, idade, religião, sexo, orientação sexual, identidade/expressão de gênero, origem nacional, deficiência, status de veterano protegido ou qualquer outra característica protegida pela lei nacional, provincial ou local, quando aplicável, e aqueles com histórico criminal serão considerados de maneira consistente com as leis estaduais e locais aplicáveis.
BCG é um Empregador E-Verify. Clique aqui para mais informações sobre E-Verify.
