Meta

Ingénieur Réseau, Opérations & Support

Python
Traduction automatique. Consultez l’original.

À propos du poste

Meta recherche un Ingénieur Réseau pour soutenir la fiabilité et la performance de son infrastructure réseau de production. Dans ce rôle, vous serez responsable des opérations sur les systèmes réseau qui sous-tendent les services mondiaux de Meta, en pilotant la réponse aux incidents, l'exécution des changements et l'amélioration continue dans les environnements de production. Vous travaillerez en étroite collaboration avec les équipes d'ingénierie réseau, de déploiement et les équipes d'opérations interfonctionnelles pour garantir que les services réseau répondent aux normes de fiabilité et de performance à grande échelle.

Responsabilités

  1. Piloter la réponse aux incidents et le dépannage des problèmes de réseau de production, y compris l'isolement des fautes, l'analyse des causes profondes et la coordination de la restauration sur les différentes couches du réseau
  1. Exécuter et valider les changements réseau, y compris les configurations d'appareils, les mises à jour des politiques de routage et les ajustements de capacité dans les environnements de production
  1. Surveiller la santé du réseau de production à l'aide d'outils d'observabilité et de télémétrie, en identifiant les anomalies et en pilotant la résolution avant qu'un impact client ne survienne
  1. Participer aux rotations d'astreinte et diriger la réponse opérationnelle aux événements réseau, en communiquant le statut, les risques et les plans d'atténuation aux parties prenantes
  1. Contribuer à l'analyse des causes profondes et aux revues post-incident, en identifiant les lacunes systémiques et en pilotant des actions correctives pour réduire les incidents répétés
  1. Collaborer avec les équipes d'ingénierie réseau et de déploiement pour soutenir les constructions, expansions et migrations réseau, en validant la préparation opérationnelle avant la bascule
  1. Identifier les opportunités d'améliorer les flux de travail opérationnels, les runbooks et l'automatisation pour augmenter la fiabilité et réduire le temps de résolution
  1. Maintenir une documentation précise de la topologie réseau, des configurations et des procédures opérationnelles pour soutenir les transferts et les exigences d'audit
  1. Conseiller les partenaires interfonctionnels sur les contraintes et les compromis opérationnels du réseau lors de l'évaluation de changements ou de nouveaux déploiements
  1. Tirer parti des flux de travail intégrés à l'IA pour accélérer le diagnostic, rationaliser la documentation et améliorer l'efficacité opérationnelle au sein de l'équipe

Qualifications minimales

  1. Diplôme de licence en informatique, en ingénierie informatique, dans un domaine technique pertinent, ou expérience pratique équivalente
  1. 6+ années d'expérience en opérations réseau de production, y compris le dépannage pratique des protocoles de routage, de commutation et de transport dans des environnements à grande échelle
  1. Expérience avec les protocoles réseau, y compris BGP, OSPF, IS-IS, MPLS et Ethernet à grande échelle
  1. Expérience de travail dans des environnements d'astreinte, axés sur les incidents, avec une responsabilité pour les délais de restauration et la communication avec les parties prenantes
  1. Expérience dans l'exécution et la validation des changements de configuration réseau dans les environnements de production avec une discipline de gestion des changements
  1. Expérience de collaboration avec les équipes d'ingénierie et interfonctionnelles pour s'aligner sur les priorités opérationnelles et communiquer les compromis techniques

Qualifications préférées

  1. Expérience dans le support d'environnements réseau de centres de données ou de dorsales à grande échelle, y compris les opérations de transport optique et d'interconnexion
  1. Capacité démontrée à intégrer des outils d'IA pour optimiser les flux de travail opérationnels et générer des améliorations mesurables en termes d'efficacité ou de qualité
  1. Capacité démontrée à intégrer des outils d'IA pour optimiser/redéfinir les flux de travail et générer un impact mesurable (par exemple, gains d'efficacité, améliorations de la qualité)
  1. Développement continu de compétences en IA démontré (par exemple, ingénierie de prompts/contexte, orchestration d'agents) et veille technologique sur les nouvelles technologies d'IA
  1. Connaissance des plateformes d'observabilité réseau, des pipelines de télémétrie et des frameworks d'alerte utilisés pour surveiller la santé de l'infrastructure de production
  1. Expérience avec l'automatisation réseau et le scripting (par exemple, Python, Ansible) pour réduire le travail opérationnel manuel et améliorer la répétabilité
  1. Expérience dans l'adhésion et la mise en œuvre de pratiques d'IA responsables et éthiques (par exemple, évaluation des risques, atténuation des biais, revues de qualité et d'exactitude)

135 000 $ à 191 000 $ par an + bonus + actions + avantages sociaux

Plus d’opportunités avec un seul profil

Vous souhaitez accéder à plus de postes sans répéter tout le processus ? Créez votre profil pour être trouvé par les entreprises utilisant Nort.

Créer mon profil

Ton prochain jobest déjà à ta recherche.

Nort

Plateforme de recrutement inversé pour développeurs

Réseaux sociauxInstagramLinkedInTwitter