Encora

Engenheiro(a) Sênior de Confiabilidade de Site (SRE) – Observabilidade e Prontidão de Aplicações (Azure)

SQL
Tradução automática. Consulte o original.

Sobre a oportunidade

Título da Vaga: Engenheiro(a) Sênior de Confiabilidade de Site (SRE) – Observabilidade e Prontidão de Aplicações (Azure)

Principais Habilidades: Azure IaaS, Azure Monitor, Application Insights, New Relic, Databricks, DBT, SQL, Azure DevOps, GitHub Actions, Engenharia de Confiabilidade de Site (SRE), Monitoramento de Desempenho de Aplicações (APM), Log Analytics (KQL), Observabilidade, Rastreamento Distribuído, Logging Estruturado

Experiência: 5+ anos de experiência em Engenharia de Confiabilidade de Site, Operações em Nuvem ou funções relacionadas. Mínimo obrigatório de 1 ano de experiência prática com DBT, Databricks e SQL.

Localização: Residentes legais no Peru, Colômbia, Bolívia, Costa Rica, México e Brasil.

Modalidade de Trabalho: Remoto

Publicado em: 28-09-2026

Na Coforge, contratamos profissionais exclusivamente com base em suas habilidades e qualificações e não discriminamos com base em idade, deficiência, religião, gênero, orientação sexual, status socioeconômico ou nacionalidade.

Na Coforge, estamos buscando um(a) Engenheiro(a) Sênior de Confiabilidade de Site (SRE) – Observabilidade e Prontidão de Aplicações (Azure) (#21013-18-1) com o seguinte perfil.

Principais Responsabilidades

  1. Colaborar com as equipes de desenvolvimento para projetar e implementar monitoramento, alertas, dashboards e instrumentação APM em aplicações e serviços.
  1. Liderar a implementação, configuração e otimização de soluções de Monitoramento de Desempenho de Aplicações (APM).
  1. Aplicar as melhores práticas de observabilidade usando ferramentas como Azure Monitor, Application Insights, New Relic e Log Analytics (KQL).
  1. Habilitar instrumentação em nível de código, rastreamento distribuído e logging estruturado para melhorar a visibilidade e a confiabilidade da aplicação.
  1. Projetar e manter dashboards de monitoramento de aplicações e métricas de saúde operacional.
  1. Definir e implementar Indicadores de Nível de Serviço (SLIs), Objetivos de Nível de Serviço (SLOs) e estratégias de alerta eficazes com base em latência, taxas de erro, tráfego e saturação de recursos.
  1. Melhorar continuamente os mecanismos de monitoramento e alerta por meio de insights de produção e aprendizados de incidentes.
  1. Participar de revisões de prontidão de produção, identificando riscos operacionais, lacunas de observabilidade e potenciais cenários de falha antes da implantação.
  1. Apoiar a análise de incidentes e melhorias pós-incidente por meio de telemetria aprimorada e práticas de monitoramento.
  1. Fazer parceria com as equipes de engenharia para garantir que as aplicações sejam confiáveis, escaláveis e prontas para produção.

Requisitos Obrigatórios

  1. Sólida experiência em suporte e operação de aplicações em ambientes Microsoft Azure IaaS.
  1. Experiência prática com observabilidade de aplicações, monitoramento e práticas de engenharia de confiabilidade.
  1. Experiência obrigatória com DBT, Databricks e SQL (mínimo de 1 ano de experiência).
  1. Experiência na implementação e gerenciamento de soluções APM como Application Insights, New Relic ou plataformas similares.
  1. Experiência em projetar dashboards e soluções de monitoramento usando Azure Monitor, Application Insights e Log Analytics (KQL).
  1. Familiaridade com ambientes CI/CD, incluindo Azure DevOps e GitHub Actions.
  1. Sólido entendimento de arquiteturas nativas da nuvem e sistemas de aplicações distribuídas.
  1. Mentalidade prática de SRE com experiência em análise de incidentes, investigação de causa raiz e prevenção proativa de problemas.
  1. Fortes habilidades de comunicação em inglês, verbal e escrita, com capacidade de colaborar efetivamente com equipes globais.

Requisitos Preferenciais

  1. Experiência com scripting e automação usando PowerShell e/ou Bash.
  1. Conhecimento de padrões de escalabilidade, disponibilidade e resiliência em ambientes de nuvem modernos.
  1. Experiência em impulsionar iniciativas de prontidão de produção e excelência operacional.
  1. Exposição às melhores práticas de engenharia de confiabilidade em ambientes de escala empresarial.

Mais oportunidades com um só perfil

Quer aparecer para várias vagas sem repetir todo o processo? Crie seu perfil e seja encontrado pelas empresas que usam a Nort.

Criar meu perfil

Seu próximo empregojá está te procurando.

Nort

Plataforma de recrutamento reverso para programadores