Nominal
American Bureau of Shipping
Gerente Sênior, SRE, Operações e Suporte de Produto
Sobre a oportunidade
A ABS Group Digital Solutions está buscando um Líder de Site Reliability Engineering, Operações e Suporte de Produto para estabelecer o modelo operacional de confiabilidade e suporte de produção para seu Sistema de Gerenciamento de Frota (FMS) de próxima geração. A função ajudará a levar o FMS do desenvolvimento à versão beta, migração de clientes e operações SaaS escalonadas. Combina engenharia de confiabilidade prática com liderança de resposta a incidentes, prontidão operacional, escalonamento de suporte técnico e melhoria pós-lançamento.
Trabalhando com o líder de Engenharia de Plataforma e Arquitetura de Nuvem, engenharia de aplicações, QA, segurança e equipes de suporte ao cliente, esta pessoa garantirá que o produto seja observável, recuperável e suportável. O líder usará automação convencional e assistida por IA para otimizar as operações, ao mesmo tempo em que estabelece limites claros entre a propriedade técnica de SRE e a propriedade de suporte voltada para o cliente.
O que você fará: *
- Definir métricas de saúde de serviço e objetivos de confiabilidade para o FMS, incluindo disponibilidade, latência, taxas de erro, expectativas de recuperação e indicadores e objetivos de nível de serviço apropriados. *
- Estabelecer observabilidade de ponta a ponta em aplicações, infraestrutura, integrações e serviços habilitados por IA por meio de logs acionáveis, métricas, traces, dashboards, verificações de saúde e alertas; avaliar onde a detecção de anomalias assistida por IA pode melhorar a qualidade do sinal. *
- Liderar o modelo técnico de resposta a incidentes, incluindo definições de severidade, práticas de plantão e escalonamento, coordenação de incidentes, procedimentos de recuperação e revisões pós-incidente; usar sumarização assistida por IA e coleta de evidências onde melhora a resposta sem substituir o julgamento humano. *
- Trabalhar com equipes de engenharia e plataforma para projetar resiliência, desempenho, capacidade, backup e recuperação, e operação segura sob o crescimento esperado de clientes e dados. *
- Definir e implementar critérios de prontidão operacional para lançamentos beta e de produção, incluindo monitoramento, runbooks, planos de rollback, propriedade, transferências de suporte e validação pós-lançamento. *
- Estabelecer o modelo de escalonamento de suporte técnico e fazer parceria com o suporte ao cliente, produto e engenharia para resolver problemas e transformar incidentes e tickets recorrentes em correções permanentes; avaliar categorização de tickets assistida por IA e recuperação de conhecimento para acelerar o triagem técnica. *
- Apoiar migrações de clientes, go-lives e estabilização pós-lançamento preparando planos técnicos de monitoramento e resposta, triando problemas de produção e incorporando lições em procedimentos repetíveis. *
- Automatizar tarefas operacionais rotineiras, verificações de saúde, verificação de implantação, triagem de incidentes e recuperação; usar IA onde demonstra velocidade ou precisão aprimoradas, com controles de acesso, auditabilidade e aprovação humana para ações que impactam a produção. *
- Rastrear tendências de confiabilidade, incidentes, suporte e eficiência operacional; comunicar riscos, ações corretivas e progresso à liderança de engenharia e de programas, incluindo evidências de se fluxos de trabalho assistidos por IA reduzem o trabalho árduo ou melhoram os resultados. *
- Ajudar a construir e treinar uma capacidade de SRE/operações de produção à medida que o FMS avança de lançamentos iniciais para uso escalonado por clientes.
O que você precisará
Educação e Experiência *
- Bacharelado em Ciência da Computação, Engenharia, Sistemas de Informação ou área relacionada, ou experiência relevante equivalente. *
- 10+ anos de experiência relevante em engenharia de confiabilidade de site, engenharia de produção, operações de nuvem ou operações de software, incluindo experiência em liderar resposta a incidentes ou melhoria operacional entre equipes. *
- Experiência comprovada operando serviços web ou SaaS em produção e melhorando sua confiabilidade por meio de engenharia de software e automação. *
- Experiência em estabelecer observabilidade, práticas de plantão, runbooks e métricas de saúde de serviço ou confiabilidade para sistemas de produção. *
- Experiência em parceria com equipes de engenharia de software, engenharia de plataforma e equipes de suporte ao cliente durante lançamentos, incidentes e go-lives de clientes. *
- Experiência em aplicar ferramentas ou fluxos de trabalho assistidos por IA a operações técnicas, triagem de incidentes, análise de monitoramento, recuperação de conhecimento de suporte ou automação operacional, com compreensão de como validar resultados antes do uso em produção. *
Conhecimentos, Habilidades e Aptidões *
- Forte domínio das práticas de SRE, incluindo SLIs/SLOs, resposta a incidentes, análise de causa raiz, desempenho, capacidade, resiliência e recuperação de desastres. *
- Experiência operando aplicações SaaS em produção na Azure, incluindo computação, redes, identidade, armazenamento, contêineres, bancos de dados, integrações e segurança. *
- Capacidade de construir práticas eficazes de observabilidade e plantão usando telemetria, logs, métricas, traces e ferramentas como Azure Monitor, Application Insights e Log Analytics - sem criar ruído de alerta desnecessário. *
- Capacidade de automatizar implantações seguras e fluxos de trabalho operacionais usando scripting, APIs, CI/CD, infraestrutura como código, identidades gerenciadas e Key Vault. *
- Bom julgamento sobre risco de lançamento, rollback, impacto no cliente e uso responsável de operações assistidas por IA, incluindo proteção de dados e supervisão humana de ações que impactam a produção. *
- Comunicação clara e liderança colaborativa entre engenharia, suporte e stakeholders de negócios, incluindo a capacidade de impulsionar melhorias sem propriedade direta de cada equipe ou sistema.
- Experiência com nuvem Azure é preferível.
Oportunidade Igualitária
Relacionamentos de Relatório: *
Reporta-se ao Diretor Sênior de Engenharia de Plataforma e Arquitetura de Nuvem. A função inicialmente liderará práticas operacionais multifuncionais; o escopo de relatórios diretos será determinado à medida que a capacidade de SRE e operações de produção escalar.
As equipes de suporte ao cliente mantêm a propriedade das comunicações rotineiras com o cliente e do suporte de linha de frente.
Oportunidade Igualitária
A ABS Wavesight está comprometida com a igualdade de oportunidades de emprego de seus funcionários e proíbe a discriminação contra qualquer funcionário ou candidato qualificado com base em raça, cor, credo, religião, origem nacional, sexo, identidade de gênero, idade, deficiência, estado civil, orientação sexual, status de cidadania ou status de veterano, ou outras características não relacionadas ao trabalho que possam ser protegidas pela lei do Governo Federal ou leis de emprego estaduais específicas.
Aviso
A ABS e Empresas Afiliadas (ABS) não pagarão taxa a nenhuma agência terceirizada sem um Contrato Mestre de Serviço (MSA) válido da ABS autorizado e assinado pelo RH. Qualquer currículo, CV, inscrição ou outras formas de submissão de candidato fornecidas a qualquer funcionário da ABS sem um MSA válido em arquivo serão considerados propriedade da ABS, e nenhuma taxa será paga.
Outros
Esta descrição de cargo não se destina, e não deve ser interpretada, como uma lista exaustiva de responsabilidades, habilidades, esforços ou condições de trabalho associadas ao cargo do ocupante. Destina-se a ser um reflexo preciso dos elementos essenciais do trabalho para tomar uma decisão justa em relação à estrutura de remuneração do cargo. #ogjs
Sobre a ABS Wavesight
A ABS Wavesight é a nova empresa de software as a service (SaaS) da ABS Affiliate, dedicada a ajudar armadores e operadores a otimizar a conformidade, mantendo operações competitivas, mais eficientes e sustentáveis. Nossa missão é desenvolver produtos de software de classe mundial que melhorem o desempenho de embarcações para a saúde de nossos mares, meio ambiente e nós mesmos. O portfólio da ABS Wavesight é composto por tecnologia proprietária de ponta e integrações de terceiros que oferecem insights incomparáveis em todos os aspectos das operações de uma frota. Apoiados pelo legado de 160 anos de inovação e experiência marítima da ABS, nossos produtos estão instalados coletivamente em mais de 5,000 embarcações em toda a frota global. Saiba mais sobre a ABS Wavesight visitando abswavesight.com abswavesight.com.
Sobre Nossos Benefícios
A ABS Wavesight oferece orgulhosamente uma variedade de benefícios líderes do setor, projetados para aprimorar a vida e o bem-estar de nossos funcionários e suas famílias. Esses benefícios incluem, mas não se limitam a, seguro médico (PPO e HD), seguro odontológico e oftalmológico, conta de poupança de saúde (HSA), conta de poupança flexível (FSA), seguro de vida, seguro por morte acidental e desmembramento, programas de licença por invalidez, programa de licença parental, feriados remunerados e tempo de férias remunerado. A Empresa oferece um Plano de Assistência ao Empregado (EAP) que oferece suporte adicional em bem-estar pessoal, incluindo serviços de equilíbrio entre vida pessoal e profissional. A ABS Wavesight também oferece um plano 401K com uma generosa contrapartida da empresa, sujeito aos requisitos do plano.
