Acclaim

Ingénieur DevOps Senior

PythonPostgreSQLAWSGCPDockerKubernetesTerraform
Traduction automatique. Consultez l’original.

À propos du poste

Nous cherchons à renforcer notre équipe pour un Ingénieur DevOps/SRE !

Prérequis

  1. Minimum 5 ans d'expérience dans un rôle DevOps et/ou d'Ingénieur Fiabilité de Site
  1. Solide expérience pratique de l'administration système Linux
  1. Expérience approfondie du déploiement, de l'exploitation et de la mise à l'échelle de Kubernetes dans des environnements cloud et bare-metal
  1. Expertise approfondie et expérience pratique d'au moins un fournisseur de cloud majeur (de préférence Google Cloud Platform)
  1. Expérience avérée dans la mise en œuvre des pratiques SRE et la construction de piles d'observabilité à l'aide de Grafana, Prometheus et Loki
  1. Forte adhésion aux principes GitOps, Infrastructure as Code (IaC) et CI/CD
  1. Expertise avancée en Terraform, Ansible et Python
  1. A l'aise dans des environnements à forte incertitude : nous construisons un nouveau produit, les exigences évoluent rapidement, et la capacité à apprendre rapidement de nouvelles technologies et de nouveaux modèles est essentielle
  1. Esprit proactif : capacité à aller au-delà des tâches DevOps et à déboguer et comprendre activement le produit
  1. Pensée stratégique : capacité à choisir les technologies et les approches architecturales en fonction des objectifs à long terme plutôt que des compromis à court terme
  1. L'expérience de l'inférence ML sur GPU/CPU est un atout majeur

Responsabilités

  1. Déployer, exploiter et faire évoluer une plateforme basée sur les microservices fonctionnant dans des clusters Kubernetes sur AWS, GCP et on-prem (Rancher)
  1. Exploiter et supporter les services d'inférence ML basés sur GPU (Triton Inference Server, vLLM) déployés sur RunPod, Scaleway et Nebius
  1. Construire et maintenir des images Docker pour tous les microservices et assurer un cycle de vie de service stable
  1. Maintenir et faire évoluer les clusters Kubernetes de développement et de production, participer activement au débogage des déploiements, à l'investigation des incidents et au dépannage des performances
  1. Développer, maintenir et faire évoluer des Helm charts personnalisés pour chaque service
  1. Concevoir et opérer des pipelines CI/CD en utilisant GitHub (code et pipelines) et GitLab pour les déploiements clients on-prem
  1. Assurer la conformité de la plateforme avec les exigences SOC 2 et contribuer activement à l'amélioration des processus de sécurité et de conformité
  1. Gérer l'accès aux clusters via NetBird VPN, en implémentant le contrôle d'accès basé sur les rôles à l'aide de politiques de groupe
  1. Déployer et gérer l'infrastructure en utilisant des pratiques IaC avec Terraform et Ansible
  1. Développer et améliorer continuellement les systèmes d'observabilité :
  1. Grafana & Prometheus pour les métriques
  1. Pile ELK pour le stockage et l'analyse centralisés des logs
  1. Optimiser continuellement l'infrastructure dans les domaines de l'IaC, de l'IAM, de l'Observabilité et du CI/CD
  1. Travailler avec une pile technologique comprenant : Python, Kubernetes, Linux, Docker, GitHub CI/CD, PostgreSQL, ClickHouse, Kafka, Superset, Terraform, Ansible

Ce que nous offrons

  • L'équipe a développé des produits d'IA primés pour des entreprises technologiques — des appareils, des assistants vocaux, des produits qui existent réellement dans le monde
  • Pile technologique de pointe : Technologies de la parole, NLP, IA générative (LLMs, modèles de diffusion), architecture d'agent vocal avec confidentialité et déploiement sur site
  • Haut niveau d'ingénierie et réelle appropriation — l'équipe se soucie de ce qui fonctionne réellement en production, pas de ce qui est beau en démo, et vous verrez l'impact de votre travail directement
  • Progression de carrière rapide — une équipe majoritairement senior et un grand volume de problèmes réels signifient que vous grandissez plus vite que vous ne le feriez ailleurs
  • Rythme de startup avec stabilité d'entreprise — clients réels, revenus réels, pas de bureaucratie
  • Entièrement à distance
  • 21 jours de congés payés + jours fériés + 5 jours de maladie
  • Cours d'anglais privés via Preply

Plus d’opportunités avec un seul profil

Vous souhaitez accéder à plus de postes sans répéter tout le processus ? Créez votre profil pour être trouvé par les entreprises utilisant Nort.

Créer mon profil

Ton prochain jobest déjà à ta recherche.

Nort

Plateforme de recrutement inversé pour développeurs

Réseaux sociauxInstagramLinkedInTwitter