Launch Legends
SpaceXAI
Ingénieur Logiciel, Observabilité
À propos du poste
SpaceXAI’s mission is to create AI systems that can accurately understand the universe and aid humanity in its pursuit of knowledge.
Notre équipe est petite, très motivée et axée sur l'excellence en ingénierie. Cette organisation s'adresse aux personnes qui aiment se lancer des défis et qui sont animées par la curiosité. Nous fonctionnons avec une structure organisationnelle plate. Tous les employés doivent être sur le terrain et contribuer directement à la mission de l'entreprise. Le leadership est accordé à ceux qui font preuve d'initiative et qui fournissent constamment d'excellents résultats. L'éthique de travail et de solides compétences en matière de priorisation sont importantes. Tous les employés doivent posséder de solides compétences en communication. Ils doivent être capables de partager des connaissances de manière concise et précise avec leurs coéquipiers.
À PROPOS DU POSTE
L'équipe Observabilité construit et exploite l'infrastructure centrale qui permet aux ingénieurs de surveiller, déboguer et optimiser les performances et la fiabilité de leurs systèmes. Nous gérons la télémétrie à très grande échelle — des milliards de séries temporelles et des pétaoctets de logs — avec des exigences strictes en matière de performance et de disponibilité.
Vous ferez partie de la petite équipe à fort impact responsable de la construction et de la maintenance de la plateforme d'observabilité de SpaceXAI. Vous serez propriétaire de systèmes critiques qui alimentent les métriques, les logs, le traçage et l'alerte, permettant aux équipes d'ingénierie d'exploiter les services à grande échelle, d'identifier les problèmes avant qu'ils n'affectent les utilisateurs et de piloter des améliorations systémiques de la fiabilité.
RESPONSABILITÉS
- Concevoir et mettre en œuvre une infrastructure d'observabilité évolutive pour les métriques, la journalisation et le traçage.
- Construire des pipelines de télémétrie haute performance qui gèrent des volumes d'ingestion massifs.
- Développer des APIs, des moteurs de requête et des interfaces utilisateur qui permettent aux ingénieurs d'obtenir des informations en temps réel sur leurs services.
- Définir et appliquer les meilleures pratiques pour l'instrumentation, l'alerte et la fiabilité dans toute l'entreprise.
- Collaborer avec les équipes d'infrastructure et de produit pour intégrer profondément l'observabilité dans nos plateformes internes.
- Assurer la fiabilité, l'évolutivité et les performances de la pile d'observabilité de bout en bout.
QUALIFICATIONS REQUISES
- Maîtrise en production de Go, Rust, Scala, ou un langage similaire
- Compréhension approfondie des systèmes distribués et de l'architecture de télémétrie.
- Expérience dans la construction et l'exploitation d'infrastructures à grande échelle.
- Familiarité avec les piles d'observabilité telles que Prometheus, Grafana, OpenTelemetry, VictoriaMetrics ou ClickHouse.
- Expérience avec Kafka, Redis, ou des bases de données de séries temporelles à grande échelle.
- Expérience dans l'exploitation de pipelines d'observabilité dans Kubernetes ou des environnements d'orchestration similaires.
RÉMUNÉRATION ET AVANTAGES SOCIAUX
$180,000 - $440,000 USD
Le salaire de base n'est qu'une partie de notre programme de rémunération globale chez SpaceXAI, qui comprend également des actions, une couverture médicale, de vision et dentaire complète, l'accès à un plan de retraite 401(k), une assurance invalidité courte et longue durée, une assurance vie, ainsi que divers autres réductions et avantages.
SpaceXAI est un employeur garantissant l'égalité des chances. Pour plus de détails sur le traitement des données, consultez notre Avis de confidentialité de recrutement x.ai/legal/recruitment-privacy-notice.
