Astreya
Nebius
Ingénieur Logiciel Senior (Plateforme de Données, C++)
À propos de Nebius
Nebius ouvre une nouvelle ère dans l'infrastructure cloud pour l'économie mondiale de l'IA. Nous construisons une plateforme cloud IA full-stack qui prend en charge les développeurs et les entreprises, de l'entraînement des données et des modèles au déploiement en production, sans les coûts et la complexité liés à la construction d'une infrastructure IA/ML interne à grande échelle.
Conçu par des ingénieurs, pour des ingénieurs. De l'orchestration GPU à grande échelle à l'optimisation de l'inférence, nous maîtrisons les problèmes complexes liés au calcul, au stockage, au réseau et à l'IA appliquée.
Coté au Nasdaq (NBIS) et basé à Amsterdam, nous avons une présence mondiale avec des centres de R&D en Europe, au Royaume-Uni, en Amérique du Nord et en Israël. Notre équipe de plus de 1,500 personnes comprend des centaines d'ingénieurs possédant une expertise approfondie en matériel, en logiciels et en R&D IA.
LE POSTE
#LI-MM1
Nous recherchons un Ingénieur Logiciel avec une solide expertise en C++ pour rejoindre l'équipe qui construit et opère la Plateforme de Données Nebius — un système de stockage distribué et une plateforme de traitement qui sert de « source de vérité » pour l'entreprise et de colonne vertébrale pour de nombreux produits internes (et certains externes).
La Plateforme de Données Nebius est un écosystème multi-tenant unique basé sur YTsaurus — au lieu d'exécuter des systèmes séparés de type HDFS/Kafka/HBase, nous fournissons des capacités de stockage, de calcul et d'analyse au sein d'une seule plateforme.
Construit sur l'écosystème open-source YTsaurus, nous exécutons et étendons notre propre distribution Nebius et développons des fonctionnalités internes significatives (cœur et niveau plateforme). Nous pouvons concevoir, implémenter et déployer des fonctionnalités de bout en bout sur nos clusters sans attendre les approbations en amont et contribuer en amont lorsque cela est pertinent.
À l'échelle actuelle, cela comprend environ 500 serveurs, environ 20k cœurs CPU et environ 10 Po de données compressées dans notre plus grand cluster de production, supportant des charges de travail allant des pipelines critiques pour l'entreprise et des transactions financières à des ensembles de données et calculs ML/LLM à grande échelle.
CE QU'IL Y A DANS LA PLATEFORME
Vous travaillerez sur un système qui comprend (et relie) :
- Stockage Distribué (Cypress) : sémantique transactionnelle, stockage hiérarchisé, codage par effacement, réplication et attentes de fiabilité élevées.
- Calcul & ETL : un ordonnanceur de tâches à l'échelle du cluster (des dizaines de milliers de cœurs), MapReduce, YQL pour le traitement de données de type SQL, et SPYT (Spark sur YTsaurus) pour l'ingénierie de données moderne.
- Analyse interactive (CHYT) : instances ClickHouse® démarrées directement sur les nœuds de calcul pour des requêtes SQL rapides sur les données en place.
- Tables Dynamiques : KV NoSQL à faible latence avec transactions ACID distribuées pour des charges de travail de type OLTP et des banques de fonctionnalités.
- Orchestracto : orchestration de flux de travail profondément intégrée à la plateforme (similaire à Airflow, mais natif à la plateforme).
Comment est-ce de travailler chez Nebius :
Rythme rapide - Pensée audacieuse - Croissance constante - Impact significatif - Confiance et réelle autonomie - Opportunité de façonner l'avenir de l'IA
CE QUE VOUS FEREZ
Nous recherchons des ingénieurs qui combinent de solides compétences système avec un sens du produit : comprendre qui utilise la plateforme, pourquoi certaines capacités sont importantes, et faire des compromis pragmatiques pour maximiser l'impact. Au sein de notre équipe, le travail d'ingénierie est censé être connecté à des utilisateurs et des résultats réels — vous vous alignerez régulièrement avec les parties prenantes internes, clarifierez les exigences et aiderez à définir les priorités.
Dans ce rôle, vous allez :
- Concevoir et implémenter de nouvelles fonctionnalités dans le cœur de YTsaurus (C++) en tenant compte de la fiabilité en production.
- Construire et faire évoluer les capacités au niveau de la plateforme : architecture de la plateforme et modèle opérationnel — croissance multi-clusters, primitives partagées et une expérience cohérente qui évolue avec les nouvelles équipes et cas d'utilisation.
- Améliorer l'expérience plateforme de bout en bout pour les utilisateurs internes (et externes) : APIs, garde-fous, flux de débogage et automatisation.
- Assurer la qualité en production : réponse aux incidents / rotation des gardes, analyse des causes profondes et transformation des apprentissages en correctifs durables.
EXEMPLES DE PROJETS
- Déployer des maîtres YTsaurus shardés (y compris le support de l'opérateur Kubernetes) et construire un équilibrage automatique des métadonnées entre les cellules maîtres (groupes de consensus) pour éliminer les goulots d'étranglement du plan de contrôle et permettre une croissance du cluster de 10 à 100x.
- Rendre les requêtes SQL interactives CHYT plus rapides et plus prévisibles à forte charge grâce à des optimisations de performance comme les index de type data-skipping / min-max et une introspection d'exécution améliorée.
- Transformer Orchestracto en un produit plateforme en définissant les blocs de construction, l'expérience développeur et la gouvernance pour la création et le partage de flux de travail par les équipes.
- Mettre à l'échelle et renforcer Parquet-sur-S3 pour les charges de travail natives YTsaurus en traitant la réplication/le mouvement, les sémantiques de cycle de vie cohérentes et les optimisations des métadonnées du serveur maître pour la performance et la fiabilité.
- Concevoir et livrer des pistes d'audit complètes et fiables pour les modifications de données (qui/quoi/quand) sur des chemins de stockage et de calcul hétérogènes.
STACK TECHNIQUE
- Cœur : C++ moderne (C++20, primitives asynchrones + multithreadées)
- Services & outillage : Go et Python (microservices, utilitaires, tests d'intégration)
CE QUE NOUS ATTENDONS
- 5+ années d'expérience en ingénierie logicielle.
- Solides compétences en C++ (vous écrirez du code de base).
- Connaissance pratique de Python et/ou Go (vous n'avez pas besoin d'être expert, mais devriez être à l'aise pour les utiliser).
- Expérience dans le développement et/ou l'exploitation de services distribués à forte charge.
- État d'esprit de production : capacité à utiliser SSH, lire les logs/métriques/traces, et déboguer le comportement des systèmes distribués.
- Fondamentaux solides en informatique : algorithmes, structures de données, bases de la concurrence.
ATOUTS
- Expérience avec les systèmes Big Data (écosystèmes YTsaurus/Hadoop/Spark/ClickHouse/Kafka-like).
- Expérience avec les plateformes multi-tenants, les ordonnanceurs, l'isolation des ressources, les quotas et l'ingénierie de fiabilité.
- Solides compétences en ingénierie de performance (profilage, contention de verrous, compromis latence/débit).
Déclaration d'égalité des chances
Nous réalisons des entretiens de codage dans le cadre du processus.
Nebius est un employeur qui respecte l'égalité des chances. Nous nous engageons à favoriser un lieu de travail inclusif et diversifié et à offrir des opportunités d'emploi égales dans tous les aspects de l'emploi. Nous ne faisons aucune discrimination fondée sur la race, la couleur, la religion, le sexe (y compris la grossesse), l'origine nationale, l'ascendance, l'âge, le handicap, les informations génétiques, le statut matrimonial, le statut d'ancien combattant, l'orientation sexuelle, l'identité ou l'expression de genre, ou toute autre caractéristique protégée par la loi applicable.
Les candidats doivent être autorisés à travailler dans le pays où ils postulent et seront tenus de fournir une preuve d'éligibilité à l'emploi comme condition d'embauche.
Si vous avez besoin d'aménagements pendant le processus de candidature, veuillez nous en informer.
Avantages et Perks
- Rémunération compétitive
- Opportunités de carrière et d'apprentissage
- Flexibilité et autonomie
- Culture collaborative et innovante
- Opportunité de travailler sur des projets IA impactants
- Environnement international et équipes talentueuses
