GFT Technologies SE
Acclaim
Ingénieur DevOps Senior
PythonPostgreSQLAWSGCPDockerKubernetesTerraform
Traduction automatique. Consultez l’original.
À propos du poste
Nous cherchons à renforcer notre équipe pour un Ingénieur DevOps/SRE !
Prérequis
- Minimum 5 ans d'expérience dans un rôle DevOps et/ou d'Ingénieur Fiabilité de Site
- Solide expérience pratique de l'administration système Linux
- Expérience approfondie du déploiement, de l'exploitation et de la mise à l'échelle de Kubernetes dans des environnements cloud et bare-metal
- Expertise approfondie et expérience pratique d'au moins un fournisseur de cloud majeur (de préférence Google Cloud Platform)
- Expérience avérée dans la mise en œuvre des pratiques SRE et la construction de piles d'observabilité à l'aide de Grafana, Prometheus et Loki
- Forte adhésion aux principes GitOps, Infrastructure as Code (IaC) et CI/CD
- Expertise avancée en Terraform, Ansible et Python
- A l'aise dans des environnements à forte incertitude : nous construisons un nouveau produit, les exigences évoluent rapidement, et la capacité à apprendre rapidement de nouvelles technologies et de nouveaux modèles est essentielle
- Esprit proactif : capacité à aller au-delà des tâches DevOps et à déboguer et comprendre activement le produit
- Pensée stratégique : capacité à choisir les technologies et les approches architecturales en fonction des objectifs à long terme plutôt que des compromis à court terme
- L'expérience de l'inférence ML sur GPU/CPU est un atout majeur
Responsabilités
- Déployer, exploiter et faire évoluer une plateforme basée sur les microservices fonctionnant dans des clusters Kubernetes sur AWS, GCP et on-prem (Rancher)
- Exploiter et supporter les services d'inférence ML basés sur GPU (Triton Inference Server, vLLM) déployés sur RunPod, Scaleway et Nebius
- Construire et maintenir des images Docker pour tous les microservices et assurer un cycle de vie de service stable
- Maintenir et faire évoluer les clusters Kubernetes de développement et de production, participer activement au débogage des déploiements, à l'investigation des incidents et au dépannage des performances
- Développer, maintenir et faire évoluer des Helm charts personnalisés pour chaque service
- Concevoir et opérer des pipelines CI/CD en utilisant GitHub (code et pipelines) et GitLab pour les déploiements clients on-prem
- Assurer la conformité de la plateforme avec les exigences SOC 2 et contribuer activement à l'amélioration des processus de sécurité et de conformité
- Gérer l'accès aux clusters via NetBird VPN, en implémentant le contrôle d'accès basé sur les rôles à l'aide de politiques de groupe
- Déployer et gérer l'infrastructure en utilisant des pratiques IaC avec Terraform et Ansible
- Développer et améliorer continuellement les systèmes d'observabilité :
- Grafana & Prometheus pour les métriques
- Pile ELK pour le stockage et l'analyse centralisés des logs
- Optimiser continuellement l'infrastructure dans les domaines de l'IaC, de l'IAM, de l'Observabilité et du CI/CD
- Travailler avec une pile technologique comprenant : Python, Kubernetes, Linux, Docker, GitHub CI/CD, PostgreSQL, ClickHouse, Kafka, Superset, Terraform, Ansible
Ce que nous offrons
- L'équipe a développé des produits d'IA primés pour des entreprises technologiques — des appareils, des assistants vocaux, des produits qui existent réellement dans le monde
- Pile technologique de pointe : Technologies de la parole, NLP, IA générative (LLMs, modèles de diffusion), architecture d'agent vocal avec confidentialité et déploiement sur site
- Haut niveau d'ingénierie et réelle appropriation — l'équipe se soucie de ce qui fonctionne réellement en production, pas de ce qui est beau en démo, et vous verrez l'impact de votre travail directement
- Progression de carrière rapide — une équipe majoritairement senior et un grand volume de problèmes réels signifient que vous grandissez plus vite que vous ne le feriez ailleurs
- Rythme de startup avec stabilité d'entreprise — clients réels, revenus réels, pas de bureaucratie
- Entièrement à distance
- 21 jours de congés payés + jours fériés + 5 jours de maladie
- Cours d'anglais privés via Preply
