Intermedia Intelligent Communications

Site Reliability Engineer

Kubernetes
Traduction automatique. Consultez l’original.

Description

Site Reliability Engineer

À propos d'Intermedia

Vous recherchez une entreprise où VOTRE VOIX est entendue ? Où vous pouvez FAIRE LA DIFFÉRENCE ? Vous vous ÉPANOUISSEZ dans un environnement de travail DYNAMIQUE ? Vous vous réveillez chaque matin avec l'ENVIE de travailler avec des GENS FORMIDABLES et de créer le SUCCÈS ENSEMBLE ? Alors Intermedia est fait pour vous.

Intermedia s'est imposé comme un fournisseur leader de technologies de communication et de collaboration cloud qui permettent aux entreprises de mieux se connecter. Nous avons un solide historique de croissance, de rentabilité et de création d'un environnement où chacun compte. Vraiment tout le monde. Bien que nous soyons rapides et certes un peu intenses, nous vous promettons que vous ne vous ennuierez pas. Vous découvrirez qu'Intermedia est un endroit où vous pouvez assouvir votre passion pour la création et le support de technologies cloud de premier plan. De plus, nous cherchons toujours à promouvoir en interne et nous avons de nombreux employés qui sont avec nous depuis 10, 15 et 20 ans et plus !

La culture chez Intermedia repose sur le travail d'équipe et la transparence. Nous nous tenons mutuellement responsables et nous nous soutenons toujours les uns les autres !

Bien que le poste soit principalement en télétravail, il nécessite des visites occasionnelles au bureau de Coimbra ou d'Aveiro. Nous prévoyons d'ouvrir un bureau à Porto à l'avenir. Cette approche offre aux membres de l'équipe la flexibilité de travailler à distance tout en se réunissant au bureau pour la collaboration et le travail d'équipe.

Êtes-vous prêt à laisser votre empreinte ?

À propos du poste

Nous recherchons un Site Reliability Engineer (SRE) pour garantir à nos clients que nos systèmes seront disponibles à tout moment. Alors que nous poursuivons l'expansion mondiale de nos déploiements de produits, ce rôle aidera à renforcer notre fonction SRE principale et à soutenir l'intégration des services de voix/communications unifiées (UC) avec des capacités basées sur l'IA. Vous travaillerez sur l'infrastructure de production, les communications en temps réel et les services dépendants de l'IA pour améliorer la fiabilité, l'évolutivité, l'observabilité et l'expérience client, tout en collaborant avec des équipes mondiales et interfonctionnelles.

Diversité, inclusion et égalité des chances

Département : Dev & Engineering

Type de contrat : Temps plein

Lieu : Portugal

Nous embauchons, promouvons et rémunérons nos employés en fonction de leur capacité à remplir leurs responsabilités professionnelles, sans distinction de race, de couleur, de croyance, de religion, de sexe, de genre, d'état civil, d'origine nationale, d'ascendance, d'âge, de citoyenneté, de handicap physique ou mental, d'orientation sexuelle ou de toute autre base protégée par la loi applicable (collectivement appelées dans notre Code de conduite « Classes protégées »). Nous ne tolérons aucune discrimination à l'emploi sur le lieu de travail et nous nous engageons à prendre des aménagements raisonnables pour les handicaps identifiés ou d'autres limitations, conformément à toutes les lois applicables. Nous sommes un employeur garantissant l'égalité des chances et valorisons la diversité au sein de notre entreprise. Nous ne pratiquons aucune discrimination fondée sur la race, la religion, la couleur, l'origine nationale, le genre, l'orientation sexuelle, l'âge, l'état civil, le statut d'ancien combattant ou le statut de handicap.

Vos missions

  1. Exploiter et améliorer les environnements de production en surveillant la disponibilité et en adoptant une vision globale de la santé du système.
  1. Développer des logiciels, des automatisations et des systèmes pour gérer l'infrastructure de la plateforme et les applications.
  1. Améliorer la fiabilité, la qualité, l'évolutivité et les délais de mise sur le marché de notre suite de solutions logicielles cloud.
  1. Mesurer et optimiser les performances du système, en identifiant les contraintes de capacité, les modes de défaillance et les goulots d'étranglement de performance avant qu'ils n'affectent les clients.
  1. Fournir un support opérationnel et une expertise technique pour les grandes applications et services distribués.
  1. Collecter et analyser les métriques du système d'exploitation, des applications, du réseau et des services pour soutenir l'optimisation des performances et l'isolation des pannes.
  1. Collaborer avec les équipes de développement pour améliorer les services grâce à des tests rigoureux, des procédures de mise en production et des pratiques de préparation à la production.
  1. Participer à la conception des systèmes, à la gestion de la plateforme, à la planification de la capacité, à la réponse aux incidents et à l'amélioration post-incident.
  1. Créer des systèmes et des services durables grâce à l'automatisation, aux améliorations de l'infrastructure et à la réduction du travail opérationnel répétitif.
  1. Équilibrer la livraison de fonctionnalités et la fiabilité en utilisant des indicateurs de niveau de service, des objectifs de niveau de service et des budgets d'erreur bien définis.
  1. Améliorer la fiabilité des plateformes de voix/UC et de leurs intégrations, en portant une attention particulière à la signalisation en temps réel et aux flux multimédias, à la qualité des appels, à la latence, à la gigue, à la perte de paquets, au basculement et à la disponibilité du service de bout en bout.
  1. Collaborer avec les équipes d'ingénierie voix/UC et IA pour opérationnaliser les capacités de communication activées par l'IA, telles que la reconnaissance vocale, la transcription, la synthèse, le routage intelligent, l'assistance conversationnelle et la synthèse vocale, le cas échéant.
  1. Mettre en place une observabilité pour les chemins de service voix/UC + IA de bout en bout, en corrélant la télémétrie des communications avec les métriques des applications, de l'infrastructure et des services d'IA pour accélérer la détection et l'analyse des causes profondes.
  1. Concevoir et tester la dégradation gracieuse, l'isolation des dépendances, les modèles de nouvelle tentative/repli et les procédures de récupération afin que les communications principales restent résilientes lorsque l'IA ou les services en aval sont défaillants.
  1. Automatiser la validation et les contrôles de préparation à la production pour les intégrations voix/UC + IA, y compris les performances, l'échelle, la fiabilité et la vérification des versions.

Prérequis

Ce que vous apporterez au poste

  1. Licence en informatique ou dans une autre discipline hautement technique ou scientifique, ou expérience pratique équivalente.
  1. 4-7 ans d'expérience dans des rôles techniques impliquant des opérations de production, l'ingénierie système, SRE/DevOps, la mise en œuvre de CI/CD, le déploiement de logiciels et la maintenance de systèmes de production.
  1. Expérience des méthodologies Agile, des pratiques DevOps, des pipelines CI/CD, de l'automatisation de l'infrastructure et de la surveillance/observabilité de la production.
  1. Expérience des systèmes distribués, de l'infrastructure cloud, des conteneurs et des frameworks de gestion dynamique des ressources tels que Kubernetes.
  1. Expérience des technologies de stockage distribué telles que NFS, HDFS ou S3, ou des technologies de stockage cloud comparables.
  1. Compétences pratiques en dépannage sur Linux, les applications, les réseaux, les APIs et les dépendances de services distribués.
  1. Connaissance pratique des concepts de voix/UC ou de communications en temps réel, y compris des technologies telles que SIP, RTP/SRTP, WebRTC, SBC, les services multimédias ou des plateformes de communication équivalentes.
  1. Capacité à utiliser des métriques, des journaux, des traces et des indicateurs de niveau de service pour diagnostiquer des problèmes de production complexes et favoriser des améliorations mesurables de la fiabilité.
  1. Une approche proactive pour repérer les problèmes, les domaines d'amélioration et les goulots d'étranglement de performance, avec de solides compétences en communication interfonctionnelle.
  1. Une expérience dans le support ou l'intégration de services activés par l'IA, d'APIs ou de flux de travail est un atout ; une familiarité avec les considérations opérationnelles pour l'IA vocale/parole, les services de machine-learning ou les applications basées sur LLM est préférée.

Plus d’opportunités avec un seul profil

Vous souhaitez accéder à plus de postes sans répéter tout le processus ? Créez votre profil pour être trouvé par les entreprises utilisant Nort.

Créer mon profil

Ton prochain jobest déjà à ta recherche.

Nort

Plateforme de recrutement inversé pour développeurs

Réseaux sociauxInstagramLinkedInTwitter