Rightsline Inc

Gerente de DevOps

AWSKubernetesGoTerraform
Tradução automática. Consulte o original.

MISSÃO E IMPACTO

A Rightsline está contratando um Gerente de DevOps, baseado em Toronto, para liderar a equipe que é dona da nossa plataforma de nuvem, pipelines de entrega e confiabilidade de produção em toda a América do Norte e Europa. Você gerenciará e desenvolverá uma equipe de cinco pessoas — um Engenheiro de DevOps Sênior, um Engenheiro de DevOps e dois Engenheiros de Sistemas Sênior — e terá responsabilidade ponta a ponta pela infraestrutura em que nosso produto é executado. Você se reportará ao Arquiteto de DevOps Sênior e fará uma parceria próxima com Engenharia, QA, Segurança e Conformidade, e Suporte.

A Rightsline opera uma plataforma AWS multirregional: produção em duas regiões atendendo clientes nos EUA e na UE, doze ambientes que abrangem desde sandbox de desenvolvedor até espelho de pré-produção e produção, infraestrutura definida em Terraform, e uma frota de CI/CD com modelos que constrói e implanta cada componente em cada um deles. A equipe é dona de nossas contas AWS ponta a ponta, juntamente com um parque de servidores misto Linux e Windows. A equipe que gerencia esta plataforma é tecnicamente muito capaz. Sua missão é combinar essa capacidade com a disciplina operacional de uma organização de plataforma madura: um proprietário nomeado para cada sistema e ambiente, mudanças de infraestrutura que chegam de forma previsível e completa em todos os lugares onde pertencem, documentação atual o suficiente para ser confiável durante um incidente, e uma equipe que se responsabiliza pelo acompanhamento.

Você será responsável pela plataforma como um produto do qual o resto da empresa depende — sua confiabilidade, seu custo, sua postura de segurança e a rapidez com que os engenheiros podem colocar trabalho em produção com segurança. O sucesso é medido pela disponibilidade de produção e recuperação de incidentes em ambas as regiões; por mudanças de ambiente que se completam pela primeira vez, com um registro do que mudou e por quê; por runbooks, diagramas e inventários de ambiente que estão atualizados; por recuperação de desastres e evidências de auditoria produzidas como resultado rotineiro em vez de um esforço de última hora; e por uma equipe onde a propriedade é inequívoca, as pessoas estão crescendo e os compromissos são cumpridos.

NOSSOS VALORES ESSENCIAIS

Na Rightsline, procuramos essas qualidades em todos os contratados e nos mantemos fiéis a elas todos os dias.

  1. SEJA CURIOSO E INTELIGENTE Ser inteligente não é ter todas as respostas — é fazer as perguntas certas, buscar novas ideias e nunca presumir que você já sabe o suficiente.
  1. ABRAÇE A MUDANÇA Esta indústria se move rápido e nós também. Não resistimos à mudança — nós a abraçamos. Isso significa permanecer flexível, desistir do que não está funcionando e tratar a incerteza como oportunidade, não como obstáculo.
  1. DÊ AS CARAS Dar as caras significa estar presente — não apenas física, mas mental e emocionalmente. Seus colegas de equipe contam com você. Seus clientes contam com você. Fazemos nosso melhor trabalho quando todos estão totalmente engajados e responsáveis uns pelos outros.
  1. FAÇA ACONTECER Ideias são fáceis. A execução é o trabalho. Nós nos responsabilizamos pelo que nos comprometemos, superamos as partes difíceis e medimos o sucesso por nossas realizações reais.
  1. SEJA HUMILDE Ninguém aqui tem o monopólio de boas ideias. Ouvimos mais do que falamos, compartilhamos créditos livremente e deixamos nossos egos na porta. O melhor resultado importa mais do que de quem foi a ideia.

O QUE VOCÊ IRÁ GERENCIAR

LIDERANÇA DE EQUIPE E RESPONSABILIDADE

  1. Gerenciar, treinar e desenvolver uma equipe de quatro engenheiros de infraestrutura, incluindo contribuidores individuais seniores — pessoas com profundo conhecimento que você liderará por meio de julgamento e clareza, em vez de autoridade posicional.
  1. Estabelecer propriedade inequívoca: cada sistema, ambiente, pipeline e dever operacional recorrente tem um proprietário nomeado e um backup documentado.
  1. Executar o ciclo de desempenho — metas, one-on-ones regulares, feedback escrito e planos de desenvolvimento calibrados em relação ao nosso framework de nível de engenharia — e abordar tanto o forte desempenho quanto as lacunas de forma direta e justa.
  1. Cobrar a equipe por seus compromissos e construir a visibilidade que torna os compromissos legíveis: uma única fila de trabalho priorizada, higiene de tickets atualizada e encerramento claro dos itens de ação.
  1. Recrutar, integrar e reter, construindo profundidade de banco de reservas suficiente para que nenhum sistema dependa da disponibilidade de uma única pessoa.

RIGOR OPERACIONAL E GERENCIAMENTO DE MUDANÇAS

  1. Gerenciar o processo de gerenciamento de mudanças para infraestrutura e ambientes ponta a ponta: proposta, revisão por pares, execução agendada, verificação e um registro duradouro do que mudou e por quê.
  1. Definir e manter o padrão do que significa "concluído" para o trabalho de ambiente — a mudança aplicada consistentemente em todos os ambientes e regiões onde pertence, código e estado em concordância, monitoramento atualizado, documentação atualizada e o ticket fechado.
  1. Impulsionar o trabalho de infraestrutura por meio de controle de versão e revisão de código, em vez de mudanças no console, e fechar sistematicamente a deriva de configuração entre ambientes e regiões.
  1. Tornar a documentação um entregável: diagramas de arquitetura, runbooks, caminhos de escalonamento e inventários de ambiente nos quais um engenheiro de plantão possa confiar às três da manhã.
  1. Gerenciar a prática de incidentes — rotação de plantão, definições de severidade, postmortems sem culpa e itens de remediação que são rastreados até o encerramento.

PLATAFORMA DE NUVEM E ENTREGA

  1. Gerenciar integralmente nossas contas AWS — estrutura e organização da conta, limites de IAM e acesso, cotas de serviço, rede, faturamento e marcação, e as salvaguardas que mantêm cada conta consistente com a próxima.
  1. Gerenciar tudo o que é executado nessas contas em ambas as regiões — serviços em contêineres, balanceamento de carga, bancos de dados relacionais, busca, mensagens e componentes serverless — incluindo capacidade, desempenho, patching e postura de segurança.
  1. Gerenciar o parque de servidores em Linux e Windows: padrões de construção, gerenciamento de configuração, cadência de patching, hardening e ciclo de vida, para que nenhuma plataforma se torne aquela que ninguém quer tocar.
  1. Gerenciar infraestrutura como código em Terraform: design de módulos, composição de ambiente, gerenciamento de estado e os padrões de revisão que a mantêm mantenível à medida que o parque cresce.
  1. Gerenciar o parque de CI/CD — uma frota de pipeline por componente por ambiente em doze ambientes e duas regiões — juntamente com o modelo de promoção de lançamento e os portões de aprovação de produção.
  1. Gerenciar a observabilidade e o gerenciamento de logs para que os alertas sejam acionáveis, o ruído seja baixo e os dados necessários para investigar um problema ainda estejam lá quando a pergunta for feita.
  1. Colaborar com a Engenharia para reduzir o risco de implantação e encurtar o tempo de entrega para produção, e com QA sobre disponibilidade, paridade e atualização de ambiente.

CONFIABILIDADE, RECUPERAÇÃO DE DESASTRES E CONFORMIDADE

  1. Gerenciar os objetivos de disponibilidade e desempenho para produção em ambas as regiões, e o monitoramento que demonstra que eles estão sendo atendidos.
  1. Executar nosso ciclo recorrente de teste de recuperação de desastres ponta a ponta — incluindo evidências contra nossos objetivos de RPO de 15 minutos e RTO parcial de 4 horas / total de 24 horas — e impulsionar todas as descobertas até o encerramento antes do próximo ciclo.
  1. Produzir evidências de infraestrutura para SOC 2 e PCI DSS como um subproduto de como a equipe já trabalha: revisões de acesso, registros de alterações, verificação de backup e restauração, e gerenciamento de vulnerabilidades.
  1. Colaborar com a Segurança em hardening, gerenciamento de segredos, prazos de remediação e prontidão para auditoria, e manter nossos compromissos de residência de dados da UE intactos.

GERENCIAMENTO DE STAKEHOLDERS E CUSTOS

  1. Atuar como ponto de escalonamento para problemas de infraestrutura que afetam clientes, comunicando o status de forma credível à liderança de engenharia e, quando necessário, aos clientes.
  1. Gerenciar os custos de nuvem e de ferramentas de infraestrutura, com uma visão clara do custo por ambiente e um plano para onde ele deve ir.
  1. Coordenar efetivamente com colegas de engenharia nos Estados Unidos e na Índia, incluindo o planejamento de trabalho e lançamentos entre fusos horários.

O QUE VOCÊ TRARÁ

  1. 7+ anos de experiência em DevOps, SRE ou engenharia de infraestrutura, incluindo 2+ anos gerenciando diretamente uma equipe de DevOps ou infraestrutura, com responsabilidade por contratação, desempenho e desenvolvimento. É necessária experiência em gestão especificamente nesta área — liderar engenheiros de infraestrutura é uma função diferente de liderar desenvolvedores de aplicações.
  1. Experiência liderando engenheiros e arquitetos seniores — especialistas que conhecem seus domínios melhor do que você — e um histórico de conquistar a confiança deles.
  1. Um registro demonstrado de introduzir rigor de processo a uma equipe tecnicamente forte sem desacelerá-la: gerenciamento de mudanças, padrões de documentação e prática de plantão e incidentes que a equipe genuinamente adotou e sustentou.
  1. Conforto em responsabilizar as pessoas — definir expectativas explicitamente, acompanhar consistentemente e ter a conversa direta cedo em vez de tarde.
  1. Profunda experiência prática em AWS, incluindo propriedade em nível de conta: organizações e estrutura de conta, IAM, rede e balanceamento de carga, orquestração de contêineres, bancos de dados relacionais e arquitetura multirregional.
  1. Fluência de trabalho em servidores Linux e Windows — você pode ter uma conversa técnica credível sobre qualquer um deles, e você entende o que é preciso para manter um parque misto atualizado, protegido e consistente.
  1. Terraform em escala — módulos, composição de ambiente, gerenciamento de estado e os padrões de revisão que mantêm o código de infraestrutura saudável.
  1. Propriedade de CI/CD de produção (AWS CodePipeline e CodeBuild, Spinnaker, GitHub Actions ou comparável), incluindo promoção de lançamento e portões de aprovação.
  1. Experiência operando sob um framework de auditoria como SOC 2, PCI DSS ou ISO 27001, e gerenciando testes de recuperação de desastres em vez de apenas participar deles.
  1. Forte comunicação escrita — você documenta decisões, e suas atualizações são claras para pessoas que não estavam na sala.
  1. Bacharelado em Ciência da Computação ou área relacionada, ou experiência prática equivalente.
  1. Deve ter autorização legal para trabalhar no Canadá.

QUALIFICAÇÕES PREFERENCIAIS

  1. SaaS multitenant em escala, particularmente com requisitos de residência de dados da UE.
  1. Profundidade em ferramentas de observabilidade como New Relic, Sumo Logic, Datadog ou Grafana, incluindo design de retenção de logs consciente de custos.
  1. Infraestrutura de busca (Solr ou Elasticsearch) e hospedagem de aplicativos .NET.
  1. Profundidade do lado do Windows — Active Directory, IIS, Group Policy — juntamente com administração Linux.
  1. Experiência em FinOps ou otimização de custos de nuvem com resultados mensuráveis.
  1. Kubernetes, e ferramentas de qualidade de infraestrutura como código, como Terratest, Checkov ou política como código.
  1. Certificação AWS (Solutions Architect Professional ou DevOps Engineer Professional).
  1. Experiência na integração de ferramentas de desenvolvimento assistidas por IA em pipelines de entrega e as salvaguardas que isso exige.

ARRANJOS DE TRABALHO

  1. Baseado em Toronto, Canadá, em um arranjo híbrido — nosso escritório de Toronto está disponível para você, com a flexibilidade de trabalhar em casa.
  1. Sobreposição regular com colegas de engenharia nos Estados Unidos e na Índia.
  1. Participação na cobertura de escalonamento e trabalho ocasional planejado fora do horário comercial para lançamentos, migrações e testes de recuperação de desastres.

----------------------------------------

----------------------------------------

OPORTUNIDADE DE EMPREGO IGUALITÁRIO

A Rightsline é um local de trabalho que oferece igualdade de oportunidades. Todos os candidatos terão igualdade de oportunidades durante o processo de recrutamento. Não discriminamos nenhum funcionário ou candidato a emprego por raça, cor, sexo, idade, origem nacional, religião, orientação sexual, deficiência, identidade ou expressão de gênero. Estamos dedicados a formar uma equipe diversificada de indivíduos altamente talentosos e a criar um ambiente inclusivo onde todos se sintam capacitados a trazer seus eus autênticos para o trabalho.

Se você for contatado para uma entrevista e precisar de acomodação durante o processo de entrevista, por favor, nos informe.

INSCREVA-SE HOJE

Se você quer se juntar a uma empresa que se esforça por uma missão, propósito e impacto, nós o encorajamos a se inscrever hoje.

Mais oportunidades com um só perfil

Quer aparecer para várias vagas sem repetir todo o processo? Crie seu perfil e seja encontrado pelas empresas que usam a Nort.

Criar meu perfil

Seu próximo empregojá está te procurando.

Nort

Plataforma de recrutamento reverso para programadores