Axiom Path
SpaceXAI
Ingénieur Logiciel - Kernels/CUDA (C++)
À propos du poste
SpaceXAI a pour mission de créer des systèmes d'IA capables de comprendre avec précision l'univers et d'aider l'humanité dans sa quête de connaissance. Notre équipe est petite, très motivée et axée sur l'excellence en ingénierie. Cette organisation s'adresse aux personnes qui aiment se lancer des défis et qui sont animées par la curiosité. Nous fonctionnons avec une structure organisationnelle plate. Tous les employés doivent être sur le terrain et contribuer directement à la mission de l'entreprise. Le leadership est accordé à ceux qui font preuve d'initiative et fournissent constamment d'excellents résultats. L'éthique de travail et de solides compétences en matière de priorisation sont importantes. Tous les employés doivent posséder de solides compétences en communication. Ils doivent être capables de partager des connaissances de manière concise et précise avec leurs coéquipiers.
À PROPOS DU POSTE
Nous construisons l'un des plus grands superordinateurs d'IA au monde à partir de zéro. En tant que membre de l'équipe d'infrastructure informatique, vous serez responsable à la fois du superordinateur GPU brut et de la couche de plateforme qui fonctionne au-dessus. Vous travaillerez sur l'ensemble du full stack — des optimisations de noyaux GPU de bas niveau et des internes de noyaux Linux à l'orchestration et à la virtualisation à grande échelle — pour rendre l'entraînement et l'inférence chez SpaceXAI aussi rapides, fiables et évolutifs que possible. Il s'agit d'un rôle large et à fort impact qui combine un travail acharné sur les supercalculateurs et l'infrastructure informatique. Vos contributions accéléreront directement la vitesse d'entraînement de Grok et les progrès globaux de l'IA.
RESPONSABILITÉS
- Concevoir, construire et optimiser des clusters GPU massifs pour des charges de travail d'entraînement et d'inférence à grande échelle
- Développer et régler les noyaux CUDA de bas niveau (GeMM, Attention, etc.), en utilisant CUTLASS, Tensor Cores et Nsight pour des performances maximales
- Profiler, déboguer et éliminer les goulots d'étranglement dans la hiérarchie mémoire GPU, le réseau, les systèmes de fichiers et les opérations multi-GPU
- Collaborer étroitement avec les équipes de recherche en IA pour fournir des performances et une évolutivité de qualité production
COMPÉTENCES ET EXPÉRIENCES SOUHAITÉES
- Programmation système approfondie de bas niveau (C/C++/PTX/SASS)
- Solide expérience avec des clusters GPU à grande échelle ou une infrastructure de calcul distribuée à l'échelle de production
- Travail pratique sur l'optimisation des noyaux GPU (CUTLASS, noyaux personnalisés, profilage Nsight)
- Expérience avérée dans la construction ou l'exploitation d'infrastructures haute performance pour les charges de travail d'IA (plateformes d'entraînement ou d'inférence)
- Capacité à raisonner à partir de principes fondamentaux et à optimiser pour les scénarios liés à la mémoire et à la puissance de calcul
RÉMUNÉRATION ET AVANTAGES
$180,000 - $440,000 USD
Le salaire de base n'est qu'une partie de notre programme de rémunération globale chez SpaceXAI, qui comprend également des actions, une couverture médicale, visuelle et dentaire complète, l'accès à un plan de retraite 401(k), une assurance invalidité courte et longue durée, une assurance vie, ainsi que divers autres rabais et avantages.
SpaceXAI est un employeur qui respecte l'égalité des chances. Pour plus de détails sur le traitement des données, consultez notre Avis de confidentialité de recrutement x.ai/legal/recruitment-privacy-notice.
