Capgemini
Blip.pt
Ingénieur Senior en Fiabilité des Sites
Le Rôle
Ingénieur Senior en Fiabilité des Sites
Ingénieur Senior en Fiabilité des Sites
Nous recherchons un ingénieur senior motivé et expérimenté pour rejoindre notre organisation dynamique. En tant qu'Ingénieur Senior en Fiabilité des Sites, vous serez responsable de la supervision d'un groupe d'employés, en fournissant des directives et un soutien pour garantir l'atteinte des objectifs et le bon déroulement des opérations. Si vous avez une solide expérience en gestion d'équipe et que vous êtes prêt à relever un nouveau défi, nous voulons vous entendre.
Venez faire partie de notre équipe et avoir un impact positif sur le succès de notre organisation.
Opportunités égales
Blip est une entreprise technologique de premier plan axée sur les solutions d'ingénierie logicielle pour le divertissement sportif.
Nous opérons à grande échelle. En tant que partie de Flutter Entertainment, nous jouons un rôle essentiel dans l'objectif du Groupe de devenir le leader mondial des paris sportifs en ligne et de l'iGaming, en développant des produits et des plateformes innovants pour plus de 14 millions de clients mensuels dans le monde.
Nous prenons la technologie au sérieux. Nous sommes des solutionneurs de problèmes avec de grandes ambitions, en gardant une approche centrée sur l'humain au cœur de notre travail. Nous privilégions la flexibilité tout en nous efforçant de fournir les meilleurs produits technologiques et de relever les plus grands défis de l'industrie.
Reconnaissant que chacun apporte ses propres forces, expériences et nouvelles perspectives, nous vous donnons les moyens d'être vous-même. Cette unicité façonne la culture d'appartenance dont nous sommes si fiers.
Chez Blip, nous nous engageons à créer un lieu de travail diversifié et inclusif. Nous encourageons vivement les personnes de tous horizons, de toutes façons de penser et de travailler à postuler. Nous nous engageons à inclure tout le monde, indépendamment de sa race, de son handicap, de son âge, de son identité de genre, de son orientation sexuelle et de sa religion.
Chacun apporte des perspectives et des expériences différentes ; vous n'avez pas besoin de répondre à toutes les exigences énumérées pour postuler à ce poste. Si vous avez besoin d'un ajustement pour postuler au poste et pour vous assurer que ce rôle correspond à vos besoins, veuillez envoyer un e-mail à [email protected].
Nous ne répondrons qu'aux demandes relatives aux handicaps.
Ce que vous ferez
- Participer et améliorer l'ensemble du cycle de vie des services — de la conception au déploiement, à l'exploitation et au perfectionnement.
- Participer activement à l'investigation des causes profondes des problèmes de production, à leur identification et à leur résolution (si nécessaire).
- Soutenir les services avant leur mise en production par des activités telles que la consultation en conception de systèmes, le développement de plateformes et de frameworks logiciels, la planification de la capacité et les revues de lancement.
- Maintenir les services une fois qu'ils sont en production en mesurant et en surveillant la disponibilité, la latence et la santé globale du système.
- Participer activement aux tests de performance et de capacité ;
- Optimiser la surveillance et l'alerte de fiabilité ;
- Faire évoluer les systèmes de manière durable grâce à des mécanismes tels que l'automatisation ; faire évoluer les systèmes en poussant des changements qui améliorent la fiabilité et la vélocité.
- Effectuer itérativement l'audit des vulnérabilités de performance et de fiabilité ;
- Définir et réviser les indicateurs de niveau de service (SLI) ;
- Pratiquer une réponse aux incidents durable et des post-mortems sans blâme.
Ce que vous apporterez
- Une profonde familiarité avec la construction et le dépannage des pipelines de publication et de build (ex. Jenkins, buildkite, actions GitHub)
- Expérience dans la mise en œuvre d'une approche créative pour la surveillance des systèmes distribués tout en tirant parti des meilleures pratiques de l'industrie (ex. taxonomie de marquage instrumentée à travers des systèmes disparates).
- Expérience dans la construction, la gestion et le déploiement d'une application utilisant des microservices conteneurisés, dans une infrastructure distribuée (ex. AWS, GCP, cloud auto-hébergé).
- Expérience dans l'utilisation de nouvelles technologies lorsque cela sert au mieux un besoin commercial.
- Compréhension complète des meilleures pratiques de gestion des incidents.
- Approche réfléchie et compétente pour la mise en œuvre des meilleures pratiques de l'industrie.
- Expérience démontrée dans le développement d'équipes, l'encouragement de la croissance, le rôle de mentor technique et de leader.
- Démontre une force et une compréhension dans au moins un langage de programmation (ex. Java, Python, Scala, Kotlin).
- Expérience dans la prise de décisions techniques directionnelles majeures (ex. Décider quelle technologie ou quel modèle créer ou exploiter).
- Expérience d'être « d'astreinte » pour un service, et familiarité avec les outils de notification d'incidents (ex. Pagerduty, Opsgenie).
- Compréhension complète des principes SRE (ex. Connaissance pratique du livre SRE de Google).
- Force démontrée dans la direction d'un projet dans un environnement agile/scrum.
- S'épanouit dans un environnement de travail diversifié.
Nous aimerions que vous maîtrisiez
- Expérience dans la gestion de solutions de télémétrie complexes qui ont directement contribué à la fiabilité globale.
- Concevoir des solutions Greenfield en utilisant des outils de gestion de configuration/infrastructure en tant que code (ex. Chef, puppet, Terraform).
- Créer des outils automatisés qui ont contribué à la vélocité de plusieurs équipes.
- Expérience démontrée avec les meilleures pratiques de gestion de projet.
- Démontre la capacité à décomposer de grands concepts techniques en une communication efficace avec les parties prenantes de toute l'organisation.
- Connaissance approfondie des meilleures pratiques, des outils et de l'observabilité réseau.
- Expérience dans le développement et le déploiement de la configuration automatisée de services en périphérie (ex. configuration CDN, renouvellement de certificats).
- Travailler en consultation avec une équipe, en étant capable de conseiller sur sa technologie, ses flux de travail, ses outils de développement, sa surveillance et ses meilleures pratiques d'alerte.
- Identifier le besoin et diriger le développement d'une automatisation qui a considérablement réduit le travail répétitif (ex. pipelines de déploiement, environnements de développement distribués).
- Construire et maintenir un système et une culture qui ont soutenu et mis en œuvre les SLO.
- S'est révélé être un leader d'opinion contribuant à la conversation plus large de l'industrie sur les principes et sujets SRE (ex. Intervenir lors de conférences).
C'est ce que vous devriez avoir.
Alors... vous êtes partant ?
Ce que nous avons, vous demandez-vous ? Eh bien... vous pouvez consulter nos incroyables avantages et bénéfices juste ici
