Nebius

Ingénieur Terrain (Livraison Matériel)

Traduction automatique. Consultez l’original.

À propos de Nebius

Nebius est à la tête d'une nouvelle ère dans l'infrastructure cloud pour l'économie mondiale de l'IA. Nous construisons une plateforme cloud IA full-stack qui soutient les développeurs et les entreprises, de l'entraînement des données et des modèles au déploiement en production, sans les coûts et la complexité liés à la construction d'une infrastructure IA/ML interne à grande échelle.

Conçu par des ingénieurs, pour des ingénieurs. De l'orchestration GPU à grande échelle à l'optimisation de l'inférence, nous maîtrisons les défis complexes liés au calcul, au stockage, aux réseaux et à l'IA appliquée.

Le poste

Nebius exploite une infrastructure IA à grande échelle, dense en GPU, dans des environnements de centres de données critiques. En tant qu'Ingénieur de déploiement senior, vous serez responsable de la livraison de bout en bout, du déploiement et de la préparation à la production des plateformes GPU de nouvelle génération au sein de nos centres de données. Ce rôle se situe à l'intersection du matériel, des systèmes Linux et de l'exécution opérationnelle. Vous dirigerez la mise en service des racks sur site, validerez les systèmes IA basés sur NVIDIA, coordonnerez les réparations et assurerez la transition de l'infrastructure de la série GB de l'installation à des environnements de production entièrement opérationnels avec précision et fiabilité. Vous collaborerez étroitement avec les équipes d'ingénierie matérielle, de réseau et d'infrastructure pour déployer et stabiliser à grande échelle les systèmes GPU basés sur H200 et B200.

Rejoignez Nebius dès aujourd'hui et contribuez à construire le logiciel qui alimente la prochaine génération d'infrastructure IA.

À quoi ressemble le travail chez Nebius

Rythme rapide - Pensée audacieuse - Croissance constante - Impact significatif - Confiance et réelle autonomie - Opportunité de façonner l'avenir de l'IA

Cotée au Nasdaq (NBIS) et basée à Amsterdam, nous avons une présence mondiale avec des centres de R&D en Europe, au Royaume-Uni, en Amérique du Nord et en Israël. Notre équipe de plus de 1,500 personnes comprend des centaines d'ingénieurs possédant une expertise approfondie en R&D matérielle, logicielle et en IA.

Vos responsabilités incluront : *

  1. Diriger le déploiement de bout en bout des racks de la série GB dans les environnements de centres de données *
  1. Superviser l'installation, la mise en service, la validation et la préparation à la production des serveurs NVIDIA basés sur H200 et B200 *
  1. Dépanner les problèmes complexes de matériel, de firmware, de système d'exploitation Linux et de réseau *
  1. Exécuter des procédures structurées de test et de validation pendant le déploiement *
  1. Développer et maintenir des scripts de base pour la vérification de l'état du matériel et le diagnostic, basés sur Linux *
  1. Coordonner les réparations matérielles sur site, le remplacement de pièces et les escalades auprès des fournisseurs *
  1. Piloter l'analyse des causes profondes et s'assurer que des mesures correctives sont mises en œuvre *
  1. Gérer et prioriser les délais de déploiement sur plusieurs mises en production simultanées *
  1. Fournir un leadership technique et des conseils aux ingénieurs et techniciens sur site *
  1. Collaborer avec les équipes réseau et infrastructure pour assurer une intégration transparente *
  1. Documenter les processus de déploiement, les normes de validation et les guides opérationnels

Ce que nous attendons de vous : *

  1. Solide expérience pratique dans le déploiement et l'exploitation d'infrastructures de centres de données *
  1. Connaissance approfondie des systèmes denses en GPU, idéalement des plateformes NVIDIA série H *
  1. Expérience de travail avec des déploiements de racks haute densité (série GB ou similaire) *
  1. Solide expérience avec Linux, y compris le dépannage et le scripting *
  1. Capacité à diagnostiquer les problèmes sur les couches matérielle, OS, firmware et réseau *
  1. Expérience dans la coordination des réparations sur le terrain et le travail direct avec les fournisseurs de matériel *
  1. Expérience avérée dans la direction d'équipes techniques ou la supervision d'opérations sur le terrain *
  1. Fort sens de la responsabilité et capacité à opérer dans des environnements critiques pour la production *
  1. Compétences claires en communication et capacité à collaborer avec des équipes distribuées

Ce serait un plus si vous avez : *

  1. Expérience dans le déploiement de clusters IA ou HPC à grande échelle *
  1. Connaissance des systèmes de provisionnement automatisé ou de gestion du cycle de vie de l'infrastructure *
  1. Expérience en qualification matérielle, tests de rodage ou validation en usine *
  1. Expérience dans le support de l'expansion rapide de l'infrastructure *
  1. Exposition à des environnements de calcul basés sur ARM ou hétérogènes

Déclaration d'égalité des chances

Conditions de travail : *

  1. Collaboration avec des équipes d'ingénierie et d'exploitation distribuées mondialement

Déclaration d'égalité des chances

Nebius est un employeur qui respecte l'égalité des chances. Nous nous engageons à favoriser un lieu de travail inclusif et diversifié et à offrir des opportunités d'emploi égales dans tous les aspects de l'emploi. Nous ne faisons aucune discrimination fondée sur la race, la couleur, la religion, le sexe (y compris la grossesse), l'origine nationale, l'ascendance, l'âge, le handicap, les informations génétiques, le statut matrimonial, le statut d'ancien combattant, l'orientation sexuelle, l'identité ou l'expression de genre, ou toute autre caractéristique protégée par la loi applicable.

Les candidats doivent être autorisés à travailler dans le pays où ils postulent et devront fournir une preuve d'éligibilité à l'emploi comme condition d'embauche.

Si vous avez besoin d'aménagements pendant le processus de candidature, veuillez nous en informer.

Principaux avantages pour les employés : *

  • Assurance santé : couverture médicale, dentaire et visuelle à 100% % payée par l'entreprise pour les employés et leurs familles *
  • Plan 401(k) : jusqu'à 4% % de contribution de l'entreprise avec vesting immédiat *
  • Congés parentaux : 20 semaines payées pour les aidants principaux, 12 semaines pour les aidants secondaires *
  • Remboursement télétravail : jusqu'à 85 $ / mois pour la téléphonie mobile et internet *
  • Assurance invalidité et décès : couverture d'assurance invalidité de courte et longue durée, et d'assurance décès payée par l'entreprise

Rémunération *

  • Nous proposons des salaires compétitifs, allant de 125k $ à 180k $ de salaire de base, complétés par des primes de performance trimestrielles.

Avantages et Perks : *

  • Rémunération compétitive *
  • Opportunités de croissance professionnelle et d'apprentissage *
  • Flexibilité et autonomie *
  • Culture collaborative et innovante *
  • Opportunité de travailler sur des projets IA impactants *
  • Environnement international et équipes talentueuses

Plus d’opportunités avec un seul profil

Vous souhaitez accéder à plus de postes sans répéter tout le processus ? Créez votre profil pour être trouvé par les entreprises utilisant Nort.

Créer mon profil

Ton prochain jobest déjà à ta recherche.

Nort

Plateforme de recrutement inversé pour développeurs

Réseaux sociauxInstagramLinkedInTwitter