Roku
Stord
Ingénieur Données Senior (GCP)
À propos du poste
Stord est The Consumer Experience Company, qui optimise le parcours client grâce à la livraison pour les plus grandes marques d'aujourd'hui. Stord est en pleine croissance et devrait doubler son chiffre d'affaires dans les 18 prochains mois. Pour atteindre et dépasser cet objectif, Stord renforce stratégiquement ses équipes dans toute l'entreprise et recherche des experts énergiques pour nous aider à accomplir notre mission.
En combinant une technologie complète d'activation du commerce avec des services de fulfillment à haut volume, Stord offre aux marques une plateforme pour rivaliser avec les géants de la distribution. Stord gère plus de 10 milliards de dollars de commerce chaque année grâce à ses plateformes de fulfillment, d'entreposage, de transport et sa suite logicielle construite par des opérateurs, incluant les plateformes OMS, Pre- et Post-Purchase, et WMS. Stord met à égalité les chances pour toutes les marques de fournir la meilleure expérience client à grande échelle. Avec Stord, les marques peuvent augmenter la conversion du panier, améliorer l'économie unitaire et fidéliser durablement la clientèle. Les solutions de commerce de bout en bout de Stord combinent le fulfillment et l'expédition omnicanal de premier ordre avec une technologie de pointe pour garantir une expédition rapide, des promesses de livraison fiables, un accès facile à davantage de canaux et des marges améliorées sur chaque commande.
Des centaines d'entreprises leaders DTC et B2B comme AG1, True Classic, Native, Seed Health, quip, goodr, Sundays for Dogs, et d'autres font confiance à Stord pour offrir des expériences client de premier plan sur chaque commande. Stord est basé à Atlanta avec des installations à travers les États-Unis, le Canada et l'Europe.
Stord est soutenu par des investisseurs de premier plan, notamment Kleiner Perkins, Franklin Templeton, Founders Fund, Strike Capital, Baillie Gifford et Salesforce Ventures.
Stord fonctionne grâce aux données : chaque palette déplacée, chaque commande traitée et chaque modèle expédié par notre équipe IA dépend de données rapides, propres et faciles à trouver.
En tant que notre Ingénieur Données Senior, vous serez responsable de cet écosystème : concevoir, construire et maintenir les pipelines et l'infrastructure qui transforment les données opérationnelles brutes en quelque chose sur lequel toute l'entreprise peut agir. Vous travaillerez en étroite collaboration avec les data scientists, les analystes et les ingénieurs logiciels dans un environnement cloud-native, en construisant pour l'avenir de Stord, pas seulement pour son passé.
Nous traitons plus de 10 milliards de dollars de commerce par an dans le domaine du fulfillment, de l'entreposage et des logiciels de chaîne d'approvisionnement. Vous construirez l'infrastructure qui transforme ce volume en données fiables, gouvernées et prêtes pour le ML, y compris les fondations sur lesquelles fonctionnent nos outils d'IA agentiques.
VOS RESPONSABILITÉS
- Concevoir et construire des pipelines de données évolutifs en utilisant les services GCP tels que Cloud Dataflow, Cloud Pub/Sub, Data Stream, Spark et Cloud Composer, en ingérant, traitant et stockant de grands ensembles de données provenant de multiples sources.
- Développer, tester et maintenir des modèles de données, des schémas et des processus ETL (Extract, Transform, Load) en utilisant BigQuery, Cloud SQL, Spark et Data Studio.
- Collaborer avec les parties prenantes pour comprendre les besoins métier et les traduire en une infrastructure de données qui résout réellement le problème.
- Optimiser les pipelines de données en termes de performance, d'évolutivité et d'efficacité des coûts, en utilisant des outils natifs GCP tels que Dataproc et Bigtable.
- Assurer la qualité, l'intégrité et la sécurité des données en construisant des processus de validation et en appliquant les meilleures pratiques en matière de gouvernance des données, de contrôle d'accès et de sécurité.
- Automatiser les flux de travail à l'aide de Cloud Composer afin que les pipelines s'exécutent de manière fiable et selon le calendrier, et non par accident.
- Assurer la fiabilité de l'infrastructure de pipelines et de données de bout en bout - surveillance, alertes, dépannage et analyse des causes profondes - en partenariat avec le SRE et l'Infrastructure sur les ressources GCP partagées (calcul, stockage, réseau) plutôt que de déléguer la fiabilité à quelqu'un d'autre.
- Préparer, modéliser et exposer les données pour des cas d'utilisation ML et d'IA agentique, y compris les pipelines de données gouvernés que les outils d'IA de Stord interrogent en production.
- Mentorer l'équipe de données au sens large en tant que voix technique senior sur la conception des pipelines et les normes d'infrastructure de données.
- Rester à l'avant-garde de la feuille de route de GCP et des meilleures pratiques émergentes, et réintégrer ce que vous apprenez dans la plateforme.
VOTRE PROFIL
- 5+ années d'expérience en ingénierie de données, dont au moins trois ans dans un environnement cloud (de préférence GCP).
- Expertise dans les services GCP : BigQuery, Dataflow, Pub/Sub, Cloud Composer, Cloud Storage, Cloud Functions et Cloud SQL.
- Solide maîtrise de SQL, avec une expérience réelle dans l'écriture de requêtes complexes pour l'extraction et l'analyse de données.
- Développement ETL pratique et orchestration de flux de travail à l'aide d'outils tels qu'Apache Airflow.
- Maîtrise de Python et/ou Spark pour le traitement des données et le développement de pipelines.
- Expérience avec les pipelines de données en streaming (Pub/Sub, Dataflow ou similaire) ainsi qu'avec le traitement par lots.
- Une solide compréhension des concepts d'entreposage de données, des grands ensembles de données et de l'optimisation des requêtes.
- Connaissance pratique de la gouvernance des données, de la sécurité et de la conformité dans un environnement cloud.
- Compréhension des concepts ML et de la préparation des données pour les applications ML, avec un intérêt marqué pour les outils d'IA agentique.
- Solides instincts analytiques, de résolution de problèmes et de dépannage, avec une réelle attention aux détails.
- Communication claire et confiante et capacité à collaborer entre les équipes.
ATOUTS SUPPLÉMENTAIRES
- Licence en informatique ou dans un domaine comparable, ou expérience équivalente.
- Certification GCP (Professional Data Engineer ou Cloud Architect).
- Expérience avec l'infrastructure ML sur GCP, telle qu'AI Platform et TensorFlow.
- Familiarité avec les pratiques DevOps/MLOps - CI/CD, infrastructure as code (Terraform) et conteneurisation (Kubernetes, Docker) sur GCP.
- Expérience avec d'autres frameworks de traitement de données, tels qu'Apache Spark.
- Une expérience dans la logistique, la chaîne d'approvisionnement, 3PL ou la technologie d'entrepôt/fulfillment
- Expérience de travail au sein d'une équipe distribuée.
