NOS
Intermedia Intelligent Communications
Site Reliability Engineer
Descrição
Site Reliability Engineer
Sobre a Intermedia
Você está procurando uma empresa onde SUA VOZ seja ouvida? Onde você possa FAZER A DIFERENÇA? Você PROSPERA em um ambiente de trabalho ÁGIL? Você acorda todas as manhãs ANIMADO para trabalhar com PESSOAS INCRÍVEIS e criar SUCESSO JUNTOS? Então a Intermedia é o lugar para você.
A Intermedia consolidou-se como uma fornecedora líder de tecnologias de comunicação e colaboração em nuvem que permitem que as empresas se conectem melhor. Temos um forte histórico de crescimento, lucratividade e criação de um ambiente onde todos importam. Todos. Embora sejamos ágeis e, admitidamente, um pouco intensos, prometemos que você não ficará entediado. Você descobrirá que a Intermedia é um lugar onde você pode satisfazer sua paixão por criar e dar suporte a excelentes tecnologias em nuvem. Além disso, sempre buscamos promover internamente e temos muitos funcionários que estão conosco há 10, 15 e 20+ anos!
A cultura na Intermedia é construída com base no trabalho em equipe e na transparência. Nós nos responsabilizamos uns pelos outros e sempre apoiamos uns aos outros!
Embora seja principalmente remoto, esta função exige visitas ocasionais ao escritório em Coimbra ou em Aveiro. Planejamos abrir um escritório no Porto no futuro. Essa abordagem oferece aos membros da equipe a flexibilidade de trabalhar remotamente, ao mesmo tempo em que se reúnem no escritório para colaboração e trabalho em equipe.
Você está pronto para deixar sua marca?
Sobre a função
Estamos procurando um Site Reliability Engineer (SRE) para garantir aos nossos clientes que nossos sistemas estarão disponíveis o tempo todo. À medida que continuamos a expansão global de nossas implementações de produtos, esta função ajudará a fortalecer nossa função central de SRE e apoiar a integração de serviços de Voz/Comunicações Unificadas (UC) com recursos baseados em IA. Você trabalhará com infraestrutura de produção, comunicações em tempo real e serviços dependentes de IA para melhorar a confiabilidade, escalabilidade, observabilidade e a experiência do cliente, enquanto colabora com equipes globais e multifuncionais.
Diversidade, Inclusão e Igualdade de Oportunidades
Departamento: Dev & Engineering
Tipo de contrato: Tempo integral
Localização: Portugal
Contratamos, promovemos e remuneramos funcionários com base em sua capacidade de desempenhar suas responsabilidades profissionais, sem levar em conta raça, cor, credo, religião, sexo, gênero, estado civil, origem nacional, ancestralidade, idade, cidadania, deficiência física ou mental, orientação sexual ou qualquer outra base protegida pela lei aplicável (coletivamente referidas em nosso Código de Conduta como “Classes Protegidas”). Não toleramos discriminação no emprego no local de trabalho e estamos comprometidos em fazer acomodações razoáveis para deficiências identificadas ou outras limitações, conforme exigido por todas as leis aplicáveis. Somos um empregador que oferece igualdade de oportunidades e valorizamos a diversidade em nossa empresa. Não discriminamos com base em raça, religião, cor, origem nacional, gênero, orientação sexual, idade, estado civil, status de veterano ou status de deficiência.
O que você fará
- Operar e melhorar ambientes de produção monitorando a disponibilidade e adotando uma visão holística da integridade do sistema.
- Criar software, automação e sistemas para gerenciar a infraestrutura da plataforma e aplicações.
- Melhorar a confiabilidade, qualidade, escalabilidade e o tempo de lançamento no mercado em nosso conjunto de soluções de software em nuvem.
- Medir e otimizar o desempenho do sistema, identificando restrições de capacidade, modos de falha e gargalos de desempenho antes que afetem os clientes.
- Fornecer suporte operacional e engenharia para aplicações e serviços grandes e distribuídos.
- Coletar e analisar métricas de sistema operacional, aplicação, rede e serviço para apoiar o ajuste de desempenho e o isolamento de falhas.
- Colaborar com equipes de desenvolvimento para melhorar os serviços por meio de testes rigorosos, procedimentos de lançamento e práticas de prontidão para produção.
- Participar do design de sistemas, gerenciamento de plataforma, planejamento de capacidade, resposta a incidentes e melhorias pós-incidente.
- Criar sistemas e serviços sustentáveis por meio de automação, melhorias de infraestrutura e redução de trabalho operacional repetitivo.
- Equilibrar a entrega de recursos e a confiabilidade usando indicadores de nível de serviço, objetivos de nível de serviço e orçamentos de erro bem definidos.
- Melhorar a confiabilidade das plataformas e integrações de Voz/UC, com atenção à sinalização em tempo real e fluxos de mídia, qualidade de chamada, latência, jitter, perda de pacotes, failover e disponibilidade de serviço de ponta a ponta.
- Colaborar com as equipes de engenharia de Voz/UC e IA para operacionalizar recursos de comunicação habilitados por IA, como reconhecimento de fala, transcrição, sumarização, roteamento inteligente, assistência conversacional e conversão de texto em fala, quando aplicável.
- Construir observabilidade para caminhos de serviço de Voz/UC + IA de ponta a ponta, correlacionando telemetria de comunicações com métricas de aplicação, infraestrutura e serviços de IA para acelerar a detecção e a análise de causa raiz.
- Projetar e testar degradação graciosa, isolamento de dependências, padrões de repetição/fallback e procedimentos de recuperação para que as comunicações principais permaneçam resilientes quando a IA ou serviços downstream estiverem prejudicados.
- Automatizar a validação e as verificações de prontidão para produção para integrações de Voz/UC + IA, incluindo desempenho, escala, confiabilidade e verificação de lançamento.
Requisitos mínimos
O que você trará para a função
- Bacharelado em ciência da computação ou outra disciplina altamente técnica ou científica, ou experiência prática equivalente.
- 4-7 anos de experiência em funções técnicas envolvendo operações de produção, engenharia de sistemas, SRE/DevOps, implementação de CI/CD, implantação de software e manutenção de sistemas de produção.
- Experiência com metodologias ágeis, práticas de DevOps, pipelines de CI/CD, automação de infraestrutura e monitoramento/observabilidade de produção.
- Experiência com sistemas distribuídos, infraestrutura em nuvem, containers e frameworks de gerenciamento dinâmico de recursos, como Kubernetes.
- Experiência com tecnologias de armazenamento distribuído, como NFS, HDFS ou S3, ou tecnologias de armazenamento em nuvem comparáveis.
- Habilidades práticas de solução de problemas em Linux, aplicações, redes, APIs e dependências de serviços distribuídos.
- Conhecimento prático de conceitos de Voz/UC ou comunicações em tempo real, incluindo tecnologias como SIP, RTP/SRTP, WebRTC, SBCs, serviços de mídia ou plataformas de comunicação equivalentes.
- Capacidade de usar métricas, logs, rastreamentos e indicadores de nível de serviço para diagnosticar problemas complexos de produção e impulsionar melhorias mensuráveis de confiabilidade.
- Uma abordagem proativa para identificar problemas, áreas de melhoria e gargalos de desempenho, com fortes habilidades de comunicação multifuncional.
- Experiência no suporte ou integração de serviços habilitados por IA, APIs ou fluxos de trabalho; familiaridade com considerações operacionais para IA de fala/voz, serviços de machine-learning ou aplicações baseadas em LLM é preferencial.
