Roku
Further
Architecte de Données
À propos du poste
NOUS RECRUTONS ! Si vous aimez les données et recherchez des opportunités de croissance illimitées, nous voulons discuter avec vous de rejoindre Further.
Architecte de Données
Vous êtes responsable de la colonne vertébrale des données de la plateforme : l'enveloppe d'événements canonique, le magasin transactionnel multi-locataire, les projections du côté lecture qui alimentent chaque vue de console et réponse API, ainsi que l'infrastructure de données IA/ML qui rend le système intelligent plutôt que simplement instrumenté. Ce n'est pas un rôle de spécialiste. Nous recrutons une personne qui a maîtrisé ces trois aspects en production et qui peut gérer les compromis simultanément. Le volume de données est important, le problème de l'évolution du schéma est complexe, les exigences d'isolation des locataires sont impitoyables, et les charges de travail IA reposent sur tout cela. Si l'un de ces trois aspects ne vous intéresse pas, ce n'est pas le bon rôle pour vous. Vous travaillerez en étroite collaboration avec l'Architecte de Solution sur le modèle de données canonique et avec le Développeur Senior sur l'implémentation. Vous rédigerez les playbooks de migration, les chaînes d'upcaster, les procédures de reconstruction des projections et les runbooks qui nous permettent de dormir la nuit. Vous travaillerez dans notre siège social à Dallas, TX, selon un horaire hybride. L'équipe est au bureau les mardis, mercredis et jeudis.
Further est une entreprise spécialisée dans les données, le cloud et l'IA, dont l'objectif est d'aider les entreprises à transformer leurs données brutes en bonnes décisions. Nous avons une culture primée d'individus extraordinaires. Notre raison d'être est de permettre aux gens de s'épanouir afin que les entreprises puissent prospérer. Nous pensons que le travail que vous accomplissez doit avoir un sens – il doit être significatif pour vous professionnellement et personnellement, et il doit avoir un impact positif sur vous et sur nos clients. Si cela vous semble passionnant, discutons-en !
Prérequis
Quelle expérience devez-vous avoir
- 10+ années d'expérience en ingénierie de données, plateforme de données ou architecture de bases de données, dont au moins 3 à la tête de l'architecture, pas seulement de l'implémentation.
- Expérience de production avec des systèmes basés sur les événements. Vous avez personnellement implémenté ou fait évoluer une enveloppe d'événements, traité le problème de la chaîne d'upcaster et vécu avec les conséquences d'une décision de schéma précoce.
- Expertise approfondie de Postgres : conception de schémas, indexation, analyse de plans de requêtes, RLS. Pas juste « J'ai utilisé Postgres » mais « Je sais ce que je ferais différemment de la dernière équipe. »
- Expérience avec les plateformes de streaming : Kafka, Redpanda, Pulsar ou Kinesis. Vous comprenez la différence entre un topic, une partition, un groupe de consommateurs et une saga, et vous avez conçu pour chacun d'eux.
- Expérience de production en infrastructure de données analytiques : conception d'entrepôts de données (Snowflake, BigQuery, Databricks, ClickHouse) ou modèles OLAP modernes. Vous pouvez prendre un journal d'événements et produire une forme interrogeable que les analystes et les systèmes d'IA peuvent réellement utiliser.
- Expérience pratique en infrastructure de données IA/ML : bases de données vectorielles (pgvector, Pinecone, Weaviate, Qdrant), pipelines d'intégration, modèles de récupération. Vous avez déployé un système RAG qui a fonctionné et vous savez pourquoi la plupart d'entre eux échouent.
- Forte maîtrise de SQL, suffisamment pour être la personne vers qui les autres ingénieurs se tournent.
Les candidats doivent être actuellement autorisés à travailler aux États-Unis à temps plein. L'entreprise n'anticipe pas de fournir de parrainage pour le statut de visa d'emploi (par exemple, H-1B, TN, etc.) pour ce poste individuel.
Atouts appréciés
- Drizzle, Prisma, ou un autre ORM TypeScript moderne en production.
- Expérience avec les moteurs de workflow (Temporal, Cadence, Airflow) et les implications de données des processus de longue durée.
- Expérience dans les feature stores, les pipelines ML ou l'infrastructure d'évaluation de modèles.
- Expérience de la couche sémantique : dbt, Cube ou Malloy.
- Expérience en conformité : SOC 2, HIPAA, GDPR, résidence des données. L'historique d'audit fait partie de l'histoire des données.
- Travail open-source ou publications publiques sur l'architecture des données.
Ce que vous ferez dans ce rôle
- L'enveloppe d'événements canonique et la stratégie d'évolution du schéma : comment les événements sont versionnés, comment les upcasters s'enchaînent, comment les projections se reconstruisent, et comment nous ajoutons des champs sans casser l'historique. Vous écrivez les règles et les appliquez lors des revues de code.
- La couche de données transactionnelle : conception de schémas Postgres, isolation des locataires via la sécurité au niveau des lignes, stratégie d'indexation, modèles de requêtes et discipline de migration. Chaque table d'un plan de données porte un `tenant_id` et une politique. Vous vous en assurez.
- L'architecture du côté lecture : conception des projections, vues matérialisées, couche sémantique pour la consommation analytique et IA en aval. Vous décidez comment nous passons d'un journal d'événements à une forme interrogeable et comment cette forme reste peu coûteuse à maintenir.
- L'infrastructure de données IA/ML : magasins vectoriels, pipelines d'intégration, modèles de génération augmentée par récupération, feature stores le cas échéant, et la lignée qui nous permet de faire confiance à ce qui est retourné.
- Gouvernance des données : lignée, rétention, suppression (le droit à l'oubli dans un système multi-locataire basé sur les événements est un vrai problème et vous le résoudrez), et l'historique d'audit pour chaque donnée client que nous traitons.
- Le playbook opérationnel : reconstructions de projections, procédures de rejeu, migrations de schémas sur des données actives, maintenance des index vectoriels, planification de la capacité. Si la couche de données rencontre des problèmes à 2h du matin, votre runbook est ce qui sauve l'ingénieur de garde.
Notre programme de rémunération totale est conçu pour votre protection, votre tranquillité d'esprit et votre bien-être général. En plus de nos avantages de base exceptionnels, nous offrons une option médicale à coût net zéro, des contributions de l'entreprise à votre HSA, un soutien à la fertilité, un congé parental entièrement payé, une allocation mensuelle pour votre compte de dépenses de style de vie, et bien plus encore.
Postulez dès aujourd'hui ou consultez toutes nos opportunités !
#LI-Hybrid
En soumettant votre candidature, vous consentez à la collecte, au traitement et à la divulgation des données personnelles contenues dans votre candidature conformément à nos pratiques de données. Si vous résidez dans l'État américain de Californie, vous pouvez consulter nos pratiques de données et vos droits de confidentialité associés ici. Si vous résidez dans l'Espace économique européen, en Suisse ou au Royaume-Uni, vous pouvez consulter nos pratiques de données et vos droits de confidentialité associés ici.
