Lambda

Ingénieur Système Opérations Data Center III (Querétaro, Mexique)

Traduction automatique. Consultez l’original.

À propos du poste

Lambda, le Cloud de la Superintelligence, est un leader de l'infrastructure cloud IA au service de dizaines de milliers de clients. Nos clients vont des chercheurs en IA aux entreprises et aux hyperscalers. La mission de Lambda est de rendre le calcul aussi omniprésent que l'électricité et de donner à chacun le pouvoir de la superintelligence.

Une personne, un GPU.

Si vous souhaitez construire le meilleur cloud IA au monde, rejoignez-nous.

Prérequis

*Note : Ce poste nécessite une présence dans notre Data Center de Querétaro, Mexique 5 jours ; travail posté

Vous avez

  1. une solide expérience des systèmes d'infrastructure critiques supportant les data centers, tels que la distribution d'énergie, la gestion du flux d'air, la surveillance environnementale, la planification de la capacité, les logiciels DCIM, le câblage structuré et la gestion des câbles.
  1. Êtes fluent en anglais et en espagnol.
  1. Être familier avec les tests et mises en service des circuits DIA des opérateurs, les tests et le dépannage de la fibre.
  1. Connaissances de base des optiques de câble et des différents types d'utilisation.
  1. Solide compréhension des théories de l'alimentation monophasée et triphasée.
  1. Équilibrage des PDU et pourquoi c'est important.
  1. Familier avec plusieurs types de câbles et leurs utilisations.
  1. Connaissance du confinement des allées froides et chaudes.
  1. Solide compréhension du matériel serveur et du processus de démarrage.
  1. Capacité à structurer, collaborer et améliorer itérativement des MOPs de maintenance complexes.
  1. Travailler avec la gestion de produit, le support et d'autres équipes pour aligner les capacités opérationnelles sur les objectifs de l'entreprise.
  1. Traduire les priorités commerciales en exigences techniques et opérationnelles.
  1. Soutenir des projets interfonctionnels où l'infrastructure joue un rôle essentiel.
  1. Être orienté action et disposé à former le personnel junior aux meilleures pratiques.
  1. Être disposé à voyager pour la mise en service de nouveaux sites de data centers si nécessaire.

Ce que vous ferez

  1. Assurer que la nouvelle infrastructure serveur, stockage et réseau est correctement rackée, étiquetée, câblée et configurée.
  1. Dépanner les problèmes matériels et logiciels sur certains des systèmes GPU et réseau les plus avancés au monde.
  1. Documenter et mettre à jour la disposition du data center et la topologie réseau dans le logiciel DCIM
  1. Travailler avec les équipes de chaîne d'approvisionnement et de fabrication pour assurer le déploiement rapide des systèmes et des plans de projet pour les déploiements à grande échelle.
  1. Gérer l'inventaire d'un dépôt de pièces et suivre l'équipement tout au long du processus de livraison-stockage-mise en scène-déploiement-remise dans chacun de nos data centers.
  1. Collaborer avec les équipes de support matériel pour garantir que les incidents matériels du data center présentant des défis de dépannage de niveau supérieur sont résolus, rapportés et que les solutions sont diffusées à l'ensemble de l'organisation des opérations.
  1. Travailler avec l'équipe RMA pour s'assurer que les pièces défectueuses sont retournées et que les remplacements sont commandés.
  1. Suivre les normes d'installation et la documentation pour le placement, l'étiquetage et le câblage afin de garantir la cohérence et la découvrabilité dans tous les data centers.

Atouts supplémentaires

  1. 3+ années d'expérience avec les systèmes d'infrastructure critiques supportant les data centers, tels que la distribution d'énergie, la gestion du flux d'air, la surveillance environnementale, la planification de la capacité, les logiciels DCIM, le câblage structuré et la gestion des câbles.
  1. Expérience avec/ou connaissance de la topologie et des configurations réseau et des architectures Infiniband 400 Go.
  1. Expérience avec/ou connaissance des systèmes de stockage cluster DDP ou SCM.
  1. 3+ années d'expérience de travail avec et de reporting à partir de systèmes de ticketing comme JIRA et Zendesk.
  1. Expérience avancée avec l'administration Linux.
  1. Expérience avec les systèmes GPU de calcul haute performance (refroidis par air ou par eau) - en particulier Nvidia NVL72.

Informations sur la fourchette salariale

Il s'agit d'un poste salarié non-exempt, éligible aux heures supplémentaires. La fourchette de salaire annuelle pour ce poste a été établie sur la base de données du marché et d'autres facteurs. Cependant, un salaire supérieur ou inférieur à cette fourchette peut être approprié pour un candidat dont les qualifications diffèrent sensiblement de celles énumérées dans la description du poste.

Employeur garantissant l'égalité des chances

Lambda est un employeur garantissant l'égalité des chances. Les candidats sont considérés sans distinction de race, couleur, religion, croyance, origine nationale, âge, sexe, genre, état civil, orientation et identité sexuelle, informations génétiques, statut d'ancien combattant, citoyenneté ou tout autre facteur interdit par la loi locale, étatique ou fédérale.

À propos de Lambda

Fondée en 2012, avec plus de 500 employés, et en croissance rapide.

Nos investisseurs comprennent notamment TWG Global, US Innovative Technology Fund (USIT), Andra Capital, SGW, Andrej Karpathy, ARK Invest, Fincadia Advisors, G Squared, In-Q-Tel (IQT), KHK & Partners, NVIDIA, Pegatron, Supermicro, Wistron, Wiwynn, Gradient Ventures, Mercato Partners, SVB, 1517, et Crescent Cove.

Nous avons des articles de recherche acceptés dans les meilleures conférences de machine learning et de graphisme, notamment NeurIPS, ICCV, SIGGRAPH et TOG.

Nos valeurs sont publiquement disponibles :

  • Nous offrons une rémunération généreuse en espèces et en actions.
  • Couverture santé, dentaire et optique pour vous et vos dépendants.
  • Primes de bien-être et de transport pour certains postes.
  • Plan 401k avec une contrepartie de 2%% de l'entreprise (employés américains).
  • Plan de congés payés flexibles que nous utilisons tous réellement.

Plus d’opportunités avec un seul profil

Vous souhaitez accéder à plus de postes sans répéter tout le processus ? Créez votre profil pour être trouvé par les entreprises utilisant Nort.

Créer mon profil

Ton prochain jobest déjà à ta recherche.

Nort

Plateforme de recrutement inversé pour développeurs

Réseaux sociauxInstagramLinkedInTwitter