Nominal
NewsBreak
Ingénieur Senior en Infrastructure de Données
À propos de NewsBreak
Fondée en 2015, NewsBreak est la plateforme d'intelligence de contenu qui façonne l'avenir de l'économie du contenu. Avec plus de 40 millions d'utilisateurs actifs mensuels, notre plateforme phare fournit des informations et des actualités locales hautement personnalisées, alimentées par une IA avancée, des systèmes de recommandation et l'adtech.
Reconnue par Fast Company comme le n° 32 des Meilleurs Lieux de Travail pour les Innovateurs, nous sommes fiers d'être certifiés Great Place to Work® et d'accueillir une équipe dynamique de technologues, d'innovateurs produits et de leaders commerciaux passionnés par la résolution de défis significatifs à grande échelle.
Ensemble, nous avons atteint le statut de licorne en 2021, et nous restons déterminés à poursuivre cette trajectoire de forte croissance avec la bonne équipe pour accomplir notre mission : construire la couche d'infrastructure pour l'intelligence de contenu.
Si vous êtes inspiré à rêver grand, à innover rapidement et à faire une différence, nous serions ravis de vous entendre ! Pour plus d'informations, visitez newsbreak.com/about newsbreak.com/about
À PROPOS DU POSTE
NewsBreak touche des dizaines de millions d'utilisateurs chaque jour. Chaque décision de classement de flux, chaque recommandation, chaque test A/B et chaque modèle ML que nous déployons s'exécute sur l'infrastructure de données que vous géreriez. Nous recherchons un ingénieur senior pour construire et faire évoluer les pipelines batch et de streaming au cœur de cette plateforme — quelqu'un qui assume la responsabilité de bout en bout, assure la fiabilité et peut traduire des besoins métier ambigus en systèmes de données de qualité production.
RESPONSABILITÉS
- Gérer le backbone des données en streaming — concevoir et exploiter des pipelines Kafka à haut débit transportant les événements utilisateurs (clics, lectures, impressions, partages) des clients mobiles vers les consommateurs en aval : l'entrepôt de données et l'analyse en temps réel.
- Construire et maintenir des pipelines batch à grande échelle — créer et optimiser des jobs Spark traitant des milliards de lignes par jour : ingestion de contenu, agrégation d'engagement et calcul de caractéristiques au niveau utilisateur. Assurer la fiabilité des pipelines, les stratégies de réexécution incrémentielle et le coût par To traité.
- Piloter l'observabilité des pipelines — instrumenter les contrôles de qualité des données, les moniteurs de fraîcheur et les alertes d'anomalies afin que les problèmes soient détectés avant d'atteindre les tableaux de bord. Définir des SLO pour la fraîcheur et l'exhaustivité des données, et en être responsable.
- Modéliser des données structurées et non structurées — concevoir des modèles de données qui servent les cas d'utilisation analytiques et produit. Agir comme le point de contact données inter-équipes et être la personne qui s'oppose lorsqu'une décision de schéma nous nuira dans six mois.
- Collaborer avec les data scientists et les ingénieurs plateforme — comprendre les besoins en données des différentes équipes et piloter les décisions clés en matière d'infrastructure de données. Débloquer les équipes en aval sans devenir une file d'attente de tickets.
- Améliorer l'efficacité — réduire les coûts de calcul et la latence des jobs grâce à l'optimisation des requêtes, à un partitionnement plus intelligent, à une meilleure planification des ressources et à des stratégies de stockage hiérarchisé.
- Élever le niveau de la plateforme — contribuer à l'infrastructure partagée : normes de framework de pipeline, modèles d'orchestration (Airflow), bibliothèques Spark réutilisables et hygiène du catalogue de données. Mentorer les ingénieurs juniors de l'équipe.
PROFIL RECHERCHÉ
- 5+ années d'expérience en ingénierie de données, dont au moins 3 années à gérer des pipelines de production dans un environnement de données distribué.
- Solide expérience pratique avec Spark et Kafka à grande échelle — vous avez débogué un incident de production dans les deux, pas seulement suivi des tutoriels.
- Expérience avec les technologies big data, y compris Hadoop, Presto/Trino et Flink.
- Maîtrise de Python et SQL ; Scala est un plus.
- Expérience de travail dans un environnement cloud, de préférence AWS (S3, EMR, Glue, Redshift).
- Expérience avérée dans l'amélioration de l'efficacité, de la scalabilité et de la stabilité des systèmes de données — avec des résultats mesurables.
- Licence ou Master en Informatique ou équivalent.
- Solides compétences en communication ; à l'aise pour piloter les décisions d'infrastructure de données auprès des équipes applicatives et plateforme.
AVANTAGES
Nous offrons un ensemble d'avantages compétitifs :
- Soins de santé, dentaires et de vision pour vous et votre famille (couverture à 100% pour l'employé)
- Plan 401(K) de premier ordre avec abondement de l'entreprise
- Congés payés et jours fériés payés
- Programmes de prestations FSA, HSA et de transport
- Budget d'activités d'équipe
La fourchette de salaire de base aux États-Unis pour ce poste à temps plein est indiquée ci-dessous. Le salaire peut varier en fonction d'un certain nombre de facteurs, notamment les compétences liées au poste, le niveau, l'expérience, la situation géographique et la formation pertinente. Chez NewsBreak, nous concevons notre ensemble de rémunération globale pour attirer les meilleurs talents. Selon le poste, le rôle peut également être éligible à une prime discrétionnaire et à des options. Votre recruteur pourra vous fournir plus de détails lors du processus d'embauche.
Fourchette de salaire annuel de base $175,000 — $221,000 USD
Avis de confidentialité CPRA pour les candidats californiens docs.google.com/document/d/15apsJLgHq1p5NJR3fzFmdctKX4QIzzf2/edit?usp=sharing&ouid=110601223912453011659&rtpof=true&sd=true
