Arcesium LLC

Ingénieur Principal en Fiabilité de Site - PSRE

PythonJavaAWSKubernetesTerraform
Traduction automatique. Consultez l’original.

À PROPOS DE L'ENTREPRISE

Arcesium est une entreprise mondiale de technologie financière qui résout des défis complexes basés sur les données auxquels sont confrontées certaines des institutions financières les plus sophistiquées au monde. Nous innovons constamment notre plateforme et nos capacités pour relever les défis de demain, anticiper les risques rencontrés par nos clients et concevoir des solutions avancées pour les aider à obtenir des résultats commerciaux transformationnels.

La technologie financière est un secteur à forte croissance, car le changement et l'innovation continuent de perturber le statu quo et de susciter des transformations majeures. Arcesium traverse une période particulièrement intéressante dans sa propre croissance, alors que nous cherchons à tirer parti de notre position de marché établie avec succès et à étendre nos opérations dans la poursuite de nouvelles opportunités commerciales stratégiques. Nous valorisons la curiosité intellectuelle, la prise d'initiative proactive et la collaboration avec nos collègues, et nous vous donnons les moyens de contribuer de manière significative dès le premier jour et d'accélérer votre développement professionnel.

À propos du rôle et de l'équipe

Nous recherchons un Ingénieur Principal en Fiabilité de Site (SRE) intelligent, débrouillard et hautement qualifié pour rejoindre notre équipe de Fiabilité de Site de Plateforme (PSRE). Cette équipe joue un rôle essentiel pour garantir la stabilité, la fiabilité et la disponibilité des applications de production critiques sur la plateforme Arcesium.

L'équipe PSRE est responsable de :

  1. L'observabilité, la surveillance, la journalisation et le traçage pour détecter et prévenir proactivement les problèmes.
  1. La création d'outils et d'infrastructures qui améliorent la stabilité et la résilience des systèmes.
  1. Le dépannage des problèmes de production en direct avec un accent profond sur la résolution rapide des incidents.
  1. La gouvernance, la déclaration, la gestion et la récupération des incidents à l'échelle de la plateforme pour minimiser les temps d'arrêt et l'impact commercial.

En tant que SRE dans cette équipe à fort impact, vous travaillerez sous des délais serrés dans un environnement sous haute pression, où chaque seconde compte pour résoudre les incidents de production critiques. Cela signifie que vous devez avoir l'esprit vif, être hautement analytique et proactif dans la prévention et la résolution des perturbations.

Ce que vous ferez

  1. Gestion des incidents : Servir de contact principal et de leader pour les incidents et les problèmes critiques impactant notre plateforme pendant les heures d'ouverture de New York. Prendre en charge les incidents, assurer une communication efficace et faciliter une résolution rapide en collaborant avec les équipes d'ingénierie pertinentes.
  1. Surveillance et analyse proactives : Surveiller en permanence la santé et les performances de nos applications et de notre infrastructure. Analyser les tendances, identifier les risques potentiels et mettre en œuvre de manière proactive des mesures pour prévenir les incidents et améliorer la fiabilité globale du système.
  1. Dépannage et résolution de problèmes : Dépanner des problèmes techniques complexes à travers diverses couches de la pile (application, infrastructure, réseau). Utiliser vos compétences analytiques et votre expertise technique pour identifier les causes profondes et mettre en œuvre des solutions efficaces.
  1. Collaboration et communication : Travailler en étroite collaboration avec les équipes d'ingénierie, de développement et d'exploitation pour assurer une collaboration transparente lors de la réponse aux incidents et dans les initiatives de fiabilité proactive. Communiquer efficacement avec les parties prenantes à tous les niveaux, en fournissant des mises à jour claires et concises sur les incidents et l'état du système.
  1. Automatisation et optimisation : Identifier les opportunités d'automatiser les tâches, d'améliorer l'efficacité opérationnelle et de renforcer la résilience de nos systèmes. Développer des outils et des scripts si nécessaire pour rationaliser les processus et réduire l'intervention manuelle.
  1. Amélioration continue : Contribuer au développement et à l'amélioration continus de nos pratiques, outils et processus SRE. Partager vos connaissances et votre expertise avec l'équipe pour favoriser une culture d'apprentissage et de croissance.

Prérequis

Ce que nous recherchons

  1. Jusqu'à 5 ans d'expérience dans un rôle d'Ingénieur en Fiabilité de Site (SRE), DevOps, ou d'Ingénieur de Production, avec une compréhension approfondie des principes et des meilleures pratiques SRE.
  1. Expertise en gestion des incidents, y compris le triage, l'escalade et la résolution des pannes de haute gravité.
  1. Maîtrise d'au moins un langage de programmation (Python ou Java) pour l'automatisation et le débogage.
  1. Expérience pratique de Kubernetes (K8s) pour la gestion et l'orchestration des applications conteneurisées.
  1. Expérience du cloud (AWS de préférence) avec une exposition aux services clés tels que EC2, S3, Lambda et CloudWatch.
  1. Excellentes compétences en communication pour articuler efficacement les défis et les solutions techniques.
  1. Solides compétences en dépannage et en résolution de problèmes, avec une expérience du diagnostic de problèmes de production complexes.
  1. Capacité à rester calme sous pression, à effectuer plusieurs tâches et à prioriser efficacement dans des environnements en évolution rapide.
  1. La maîtrise de l'anglais (parlé et écrit) est requise.
  1. Doit avoir le droit légal de travailler dans le pays.

Compétences souhaitables

  1. Expérience avec Terraform ou CloudFormation pour l'infrastructure-as-code.
  1. Expérience avec les outils de surveillance (par exemple, Datadog, Prometheus, Grafana)
  1. Familiarité avec les architectures d'applications Web et les meilleures pratiques.
  1. Exposition aux pipelines CI/CD et aux flux de travail DevOps.

POURQUOI REJOINDRE ARCESIUM

Chez Arcesium, nous offrons :

  • Des modalités de travail flexibles (modèle hybride) et une tenue décontractée
  • L'opportunité de travailler sur des projets stimulants dans un environnement mondial dynamique
  • Des opportunités d'apprentissage et de développement continus
  • Une culture de travail collaborative et innovante
  • Un ensemble de rémunération et d'avantages sociaux compétitifs
  • Un bureau moderne et confortable situé Avenida da Liberdade (Lisbonne)

Rejoignez notre équipe et jouez un rôle crucial dans la définition de l'avenir d'Arcesium !

L'avis de confidentialité des données personnelles d'Arcesium pour les candidats est lié ici cdn.builder.io/api/v1/assets/8279000be2e444159cf06fa2a0d2c664/2026-07-16-personal-data-privacy-policy-candidates.pdf.

Sécurité du recrutement

Les e-mails des recruteurs Arcesium authentiques qui sont des employés de l'entreprise proviendront toujours du domaine @arcesium.com. Dans certains cas, vous pourriez également être contacté par des cabinets de recherche indépendants mandatés pour recruter en notre nom ; les e-mails de leurs employés devraient toujours provenir du domaine applicable de leur cabinet.

Nous ne vous demanderons jamais vos informations bancaires ou tout paiement dans le cadre du processus de recrutement. Si quelque chose vous semble suspect ou si vous êtes contacté par un tiers inattendu, veuillez nous contacter à [email protected] (US/UK), [[email protected]] [email protected] (Inde) [[email protected]] ou [email protected] (Portugal/Suède) [[email protected]].

Arcesium est un employeur qui respecte l'égalité des chances.

Plus d’opportunités avec un seul profil

Vous souhaitez accéder à plus de postes sans répéter tout le processus ? Créez votre profil pour être trouvé par les entreprises utilisant Nort.

Créer mon profil

Ton prochain jobest déjà à ta recherche.

Nort

Plateforme de recrutement inversé pour développeurs

Réseaux sociauxInstagramLinkedInTwitter