Clara
Tractian
Ingénieur Data Foundry
POURQUOI NOUS REJOINDRE
Tractian transforme le monde industriel en permettant aux travailleurs de maintenance de première ligne d'accomplir davantage. Nous avons fusionné du matériel de pointe avec un logiciel innovant pour créer une plateforme puissante, perturbant les systèmes existants et offrant des solutions plus intelligentes et plus rapides à nos clients.
DATA SCIENCE CHEZ TRACTIAN
L'équipe Data Science de Tractian se concentre sur l'extraction d'informations précieuses à partir de vastes quantités de données industrielles. En utilisant des méthodes statistiques avancées, des algorithmes et des techniques de visualisation de données, cette équipe transforme les données brutes en intelligence exploitable qui guide la prise de décision dans les domaines de l'ingénierie, du développement de produits et des stratégies opérationnelles. L'équipe travaille constamment à l'optimisation des modèles de prédiction, à l'identification des tendances et à la fourniture de solutions basées sur les données qui améliorent directement l'efficacité opérationnelle de l'entreprise et la qualité de ses produits.
CE QUE VOUS FEREZ
Nous recrutons des Ingénieurs Data Foundry pour rejoindre l'équipe Machine Learning Engineering de Tractian.
Ce rôle se concentre sur la construction et l'amélioration des ensembles de données utilisés dans toute l'entreprise.
L'équipe travaille sur l'ingénierie des données, le back-end, le front-end, le produit, l'étiquetage et l'ingénierie de l'IA pour rendre l'information plus structurée, fiable et utile pour les systèmes internes, les clients et les applications d'IA.
Tractian traite plus de 20 millions d'échantillons de données industrielles par jour. Nous recherchons une personne à l'aise pour travailler au plus près des données : comprendre la qualité source, identifier les incohérences, améliorer la logique de traitement et aider à transformer des informations fragmentées en ensembles de données cohérents.
RESPONSABILITÉS
- Améliorer et maintenir les pipelines d'enrichissement de données construits en Python
- Travailler sur des tâches de curation de données telles que l'étiquetage, la dédoublification, la normalisation et la résolution des incohérences
- Enquêter sur les problèmes de qualité des données en interrogeant et en combinant des données provenant de plusieurs bases de données
- Prototyper des outils, des APIs et des flux de travail pour soutenir les opérations de données
- Utiliser et créer des outils basés sur l'IA de manière responsable pour soutenir les tâches de données, y compris la révision des sorties automatisées lorsque nécessaire
- Collaborer avec les équipes produit, données et machine learning sur la qualité et l'utilisabilité des données
- Documenter les flux de travail et la méthodologie pour maintenir les processus reproductibles et auditable
PROFIL RECHERCHÉ
- + de 3 ans d'expérience en ingénierie des données, ingénierie logicielle, ingénierie machine learning, ou rôles similaires
- Solides compétences en Python pour le traitement des données et l'automatisation
- Expérience solide avec Pandas et la manipulation de données tabulaires
- Expérience avec les flux de travail de curation, d'enrichissement, d'étiquetage ou de contrôle qualité des données
- Expérience de travail avec des ensembles de données volumineux ou désordonnés
- Capacité à évaluer si les sorties de données sont correctes, cohérentes et utiles
- A l'aise pour travailler sur de nouveaux domaines de données et changer de contexte entre différents ensembles de données et flux de travail
- Approche organisée et méthodique du travail technique
COMPÉTENCES TECHNIQUES
- Expérience avec les APIs et l'intégration de services
- Connaissance de FastAPI ou de frameworks similaires pour les APIs internes
- Connaissance des bases de données SQL et/ou NoSQL
- Connaissance des outils d'orchestration de flux de travail tels qu'Airflow ou Temporal
- Connaissance des flux de travail assistés par l'IA, y compris l'utilisation de LLMs ou d'agents pour les tâches de données et la révision des sorties automatisées
- Expérience avec les feuilles de calcul et l'analyse tabulaire
- Expérience du web scraping ou de l'extraction de données à partir de sources semi-structurées
ATOUTS
- Expérience avec Streamlit ou des outils similaires pour les prototypes internes
- Expérience avec Selenium, Playwright ou des outils similaires d'automatisation de navigateur
- Connaissance des données industrielles, de maintenance ou opérationnelles
- La connaissance de gRPC est un plus
- Expérience avec les flux de travail d'annotation ou d'étiquetage
- Expérience dans des travaux techniques scientifiques ou hautement reproductibles
RÉMUNÉRATION & AVANTAGES
- Rémunération compétitive
- 30 jours de congés payés annuels
- Budget pour la formation et les cours
- Gagnez un voyage n'importe où dans le monde tous les 4 ans
- R$1.035/mois pour les allocations repas
- Plan de santé avec couverture nationale et sans coparticipation
- Assurance dentaire : nous vous aidons pour les traitements dentaires pour une meilleure qualité de vie.
- Adhésion Wellhub : Accès à un large éventail de salles de sport et de programmes d'entraînement.
