DYMATRIX GmbH
Sanitätshaus Aktuell AG
Ingénieur Données (h/f/d)
À propos du poste
Ce poste vous correspond si... Les données ne sont pas seulement des zéros et des uns pour vous, mais la base de bonnes décisions ? Vous trouvez de la satisfaction à créer des structures de données propres à partir de systèmes hérités chaotiques ? Vous pensez en pipelines, pas en scripts ? La gestion des erreurs et la logique de nouvelle tentative sont une évidence pour vous, pas une option ? Vous souhaitez apprendre d'ingénieurs expérimentés tout en mettant en œuvre vos propres idées ? Alors vous êtes au bon endroit !
Vos missions
En tant qu'Ingénieur Données, vous construisez les pipelines de données qui permettent notre transformation numérique. Vous êtes responsable du flux de données propre, fiable et évolutif entre des centaines de systèmes ERP et notre architecture de données moderne.
- Ingénierie de pipelines de données : Vous concevez et implémentez des pipelines ETL/ELT robustes qui extraient, transforment et chargent de manière fiable les données de plusieurs centaines de systèmes ERP. Vous utilisez des outils d'orchestration modernes et veillez à ce que tout fonctionne sans problème, même avec des flux de données complexes. Vous construisez des pipelines qui non seulement fonctionnent, mais sont également maintenables et extensibles.
- Architecture Data Lake & Data Warehouse : Vous construisez notre infrastructure Data Lake sur AWS à partir de zéro. Vous structurez les données de manière appropriée, mettez en œuvre des concepts de gouvernance des données et veillez à ce que les données soient optimalement préparées pour l'analyse et la Business Intelligence. Vous comprenez la différence entre les données brutes (Raw), intermédiaires (Staging) et traitées (Curated) et mettez en œuvre les architectures correspondantes.
- Projet Greenfield – Intégration de systèmes hérités : Vous êtes au cœur d'un projet Greenfield passionnant : l'intégration de plusieurs centaines de systèmes ERP hérités. Il ne s'agit pas d'une intégration standard – il s'agit de structures de données complexes, de formats différents et du défi de créer un modèle de données cohérent à partir de sources hétérogènes.
- Orchestration de flux de travail & Fiabilité : Vous implémentez des flux de travail résilients pour le traitement de données critiques en termes de temps. Vous utilisez des modèles d'orchestration modernes et veillez à ce que les pipelines continuent de fonctionner de manière contrôlée ou redémarrent même en cas d'erreurs. Vous mettez en place le monitoring et l'alerte afin que les problèmes soient détectés avant de devenir de véritables pannes.
- Collaboration & Développement : Vous travaillez en étroite collaboration avec notre Staff Engineer, les Product Owners et l'équipe de développement d'environ 10 personnes. Vous apprenez de collègues expérimentés tout en apportant vos propres idées. Vous évoluez avec les défis et vous développez continuellement.
- Qualité des données & Documentation : Vous implémentez des contrôles de qualité des données et veillez à ce que les mauvaises données n'entrent pas dans nos systèmes. Vous documentez les flux de données et la logique de transformation afin que d'autres puissent comprendre ce qui arrive aux données.
Votre profil
Indispensables
- Au moins 3 ans d'expérience en tant qu'Ingénieur Données ou dans des rôles similaires
- Expérience pratique des pipelines ETL/ELT et des Data Lakes
- Bonnes connaissances en Python pour le traitement des données et le développement de pipelines
- Expérience avec les plateformes cloud, idéalement AWS (S3, Glue, Athena, RDS, etc.)
- Connaissances de base en Infrastructure as Code (Terraform ou CDK)
- Compréhension de la modélisation des données et solides connaissances en SQL
- Expérience avec Git et CI/CD
Atouts supplémentaires
- Expérience avec Temporal ou des frameworks d'orchestration de flux de travail similaires (Airflow, Prefect, Dagster)
- Connaissances en intégration de systèmes ERP hérités
- Expérience avec les technologies de streaming (Kafka, Kinesis)
- Connaissances en conteneurisation (Docker, ECS)
- Monitoring avec Grafana
- Intérêt pour le secteur de la santé ou l'e-commerce
- Certifications AWS
Pourquoi nous rejoindre ?
Ce que nous offrons
- Modèle hybride : 2 jours par semaine au bureau à Cologne, 3 jours de travail flexible où vous le souhaitez
- Projet Greenfield : Vous construisez notre architecture de données moderne à partir de zéro – pas de code hérité à comprendre d'abord
- Véritable défi : Intégration de plusieurs centaines de systèmes ERP – complexe, mais aussi extrêmement enrichissant
- Stack technologique moderne : AWS, Python, Terraform, outils modernes d'ingénierie de données
- Mentorat & Croissance : Vous travaillez avec des ingénieurs expérimentés et vous développez
- Marge de manœuvre : Vous apportez vos idées et contribuez à façonner notre infrastructure de données
- Équipe en pleine croissance : Vous rejoignez une équipe de développement motivée d'environ 10 personnes
- Impact : Vos pipelines permettent aux gens d'accéder plus facilement à des aides importantes
À propos de nous
Depuis plus de 35 ans, nous sommes un partenaire fiable et solide pour nos membres dans tout le spectre des prestations du domaine des aides techniques. Ainsi, nous organisons pour nos plus de 480 membres, répartis sur plus de 700 sites nationaux, les achats, la vente, le développement du personnel et le marketing.
Afin de nous améliorer continuellement pour nos membres et d'optimiser notre portefeuille de services à l'ère de la transformation numérique, nous vous recherchons à temps plein pour une prise de poste dès que possible sur le site de Vettelschoß.
