Futurex

Manager Senior, Ingénierie de la Fiabilité des Sites - Infrastructure Cloud

AWSGCPGoTerraform
Traduction automatique. Consultez l’original.

À propos de Futurex

Futurex est un leader basé au Texas dans les modules matériels de sécurité (HSM), la gestion des clés d'entreprise et la protection des données, auquel font confiance les institutions financières mondiales, les processeurs de paiement et les fournisseurs de cloud depuis plus de quatre décennies. L'infrastructure cloud de Futurex fournit des services sécurisés et hautement disponibles à des clients du monde entier.

Aperçu du rôle

Le Manager Senior, Ingénierie de la Fiabilité des Sites – Infrastructure Cloud est responsable de la disponibilité, de la sécurité et de l'excellence opérationnelle de l'infrastructure cloud de Futurex dans le monde entier. Vous dirigerez une équipe SRE distribuée mondialement qui gère l'infrastructure de production dans plusieurs régions, fournisseurs de cloud et centres de données.

Ce rôle se situe à l'intersection des opérations cloud, de la sécurité et de la conformité. Nos clients dépendent de services qui ne peuvent pas tomber en panne, la fiabilité est donc mesurée autant par la confiance des clients que par la disponibilité.

Vous reporterez à la direction exécutive et travaillerez en étroite collaboration avec les équipes d'Ingénierie, Produit, Sécurité, Conformité et Support Client.

Culture d'entreprise accueillante, de type familial, particulièrement adaptée aux individus dynamiques, entreprenants et motivés

L'un des 'Meilleurs Lieux de Travail' de San Antonio pendant neuf années consécutives

Responsabilités clés

Leadership d'équipe

  1. Diriger, recruter et développer une équipe SRE mondiale à travers plusieurs fuseaux horaires, avec une responsabilité claire et une couverture 'follow-the-sun'.
  1. Gérer le programme mondial d'astreinte, y compris la conception des rotations, les normes de temps de réponse, les chemins d'escalade et la couverture dans toutes les régions.
  1. Tenir l'équipe responsable de la réponse aux incidents, du suivi des remédiations et du respect des normes opérationnelles.
  1. Définir la feuille de route SRE, le plan d'effectifs et le budget de fonctionnement.

Fiabilité et niveaux de service

  1. Définir et posséder les SLI, SLO et budgets d'erreur pour les services d'infrastructure cloud, et les utiliser pour équilibrer la stabilité par rapport à la vitesse de publication.
  1. Collaborer avec les ventes et le service juridique pour que les engagements SLA clients soient systématiquement respectés.
  1. Suivre la conformité SLA et la consommation du budget d'erreur sur tous les services.

Rapports opérationnels

  1. Fournir des rapports réguliers à la direction exécutive sur la disponibilité, les performances SLA, les tendances des incidents et les métriques d'astreinte telles que les temps de réponse et le volume d'escalade.
  1. Maintenir des tableaux de bord qui donnent à la direction et aux parties prenantes une visibilité en temps réel sur la santé des services.
  1. Produire des rapports d'incidents destinés aux clients et des analyses des causes profondes pour les événements importants.

Gestion des incidents

  1. Gérer le processus de réponse aux incidents, y compris les définitions de sévérité, les chemins d'escalade et les communications clients.
  1. Diriger les post-mortems et mener les actions de remédiation à leur terme.
  1. Servir de point d'escalade senior lors d'incidents majeurs.

Infrastructure et opérations

  1. Examiner les normes de surveillance, d'observabilité et d'alerte.
  1. Maintenir et tester régulièrement les plans de reprise après sinistre et de continuité des activités par rapport aux objectifs RTO et RPO définis.

Sécurité et conformité

  1. Opérer dans le respect des contrôles requis par les cadres de sécurité et de conformité de l'industrie.
  1. Superviser les procédures opérationnelles sécurisées, y compris le double contrôle et la chaîne de possession lorsque cela est requis.
  1. Appliquer une isolation stricte des locataires, un accès basé sur le principe du moindre privilège et une gestion des changements.
  1. Soutenir les audits internes et externes avec des preuves opérationnelles précises.

Qualifications requises

  1. 10+ années d'expérience en SRE, DevOps ou en infrastructure de production, dont 5+ années de gestion d'équipes d'ingénierie.
  1. Expérience dans la direction d'équipes géographiquement distribuées à travers plusieurs fuseaux horaires.
  1. Propriété avérée d'une plateforme SaaS ou cloud de production avec des SLA contractuels et des opérations 24x7.
  1. Expérience pratique approfondie dans au moins un fournisseur de cloud majeur (AWS, GCP, ou Azure), avec une connaissance opérationnelle des autres.
  1. Solide expérience en Linux, réseaux, infrastructure as code (Terraform ou similaire), et CI/CD.
  1. Expérience d'exploitation dans le cadre de cadres de conformité tels que PCI DSS, SOC 2, ou ISO 27001.
  1. Expérience avérée dans la mise en place de programmes de gestion des incidents, d'observabilité et de reprise après sinistre.
  1. Communication écrite et verbale claire avec les dirigeants, les clients et les auditeurs.
  1. Diplôme de licence en informatique, ingénierie, ou expérience équivalente.

Qualifications préférées

  1. Expérience dans l'exploitation d'infrastructures sensibles à la sécurité ou cryptographiques.
  1. Familiarité avec les normes de certification de sécurité telles que FIPS 140.
  1. Expérience dans la gestion d'environnements hybrides combinant le cloud public avec du matériel de centre de données physique.
  1. Expérience dans la direction de migrations de centres de données ou d'expansions régionales.
  1. Expérience dans le secteur des services financiers ou dans une autre industrie hautement réglementée.
  • Assurance santé, dentaire, vision, vie et invalidité courte/longue durée
  • Vacances payées, jours fériés et congés maladie
  • Rémunération compétitive et opportunités d'avancement
  • Plan de retraite avec abondement de l'employeur

Plus d’opportunités avec un seul profil

Vous souhaitez accéder à plus de postes sans répéter tout le processus ? Créez votre profil pour être trouvé par les entreprises utilisant Nort.

Créer mon profil

Ton prochain jobest déjà à ta recherche.

Nort

Plateforme de recrutement inversé pour développeurs

Réseaux sociauxInstagramLinkedInTwitter