Astreya
Odyssey
Miembro del Staff Técnico, Ingeniero de Infraestructura
Quiénes somos
Odyssey es un laboratorio de IA pionero en modelos mundiales generales: sistemas causales y multimodales que aprenden a predecir e interactuar con el mundo a largo plazo. Esta tecnología fundamental promete revolucionar la robótica, la ciencia, la atención médica, la educación, los videojuegos, la defensa y más allá.
Los fundadores de Odyssey fueron pioneros anteriormente en la aplicación más compleja de IA física: los coches autónomos. Ahora han reunido un equipo de investigación de clase mundial de DeepMind, Tesla, Waymo, Meta, Apple y Wayve, que han realizado contribuciones significativas a modelos de lenguaje (DeepMind Gemini), modelos de vídeo (DeepMind Veo), modelos mundiales (Wayve GAIA) y sistemas autónomos (Tesla FSD).
Odyssey ha recaudado una importante financiación de capital riesgo de GV, Amazon, AMD, EQT, NVIDIA, Natural Capital, In-Q-Tel, Elad Gil, Jeff Dean, Guillermo Rauch, Garry Tan, Kyle Vogt e investigadores de OpenAI, DeepMind, MSL, Recursive y Thinking Machines.
Qué buscamos
Buscamos un ingeniero que prospere construyendo los motores que hacen posibles la investigación y los productos innovadores. Piensas en sistemas, te encanta el rendimiento y te da energía convertir los cuellos de botella teóricos en una realidad bellamente eficiente. Te entusiasma diseñar y dar soporte a una infraestructura no solo para la escala, sino para la velocidad, la creatividad y el descubrimiento. Quieres construir el sustrato informático que permita a los modelos mundiales de Odyssey imaginar, actuar e interactuar en tiempo real.
Qué harás
- Desarrollar y operar nuestra plataforma de inferencia de modelos de baja latencia, garantizando alta disponibilidad, escalabilidad y utilización eficiente de los recursos para los modelos mundiales de Odyssey.
- Diseñar y escalar nuestra infraestructura central de procesamiento de datos (por ejemplo, Flyte, Ray con k8s) para manejar conjuntos de datos a escala de petabytes.
- Diseñar, construir y mantener nuestros clústeres de entrenamiento a gran escala basados en GPU para deep learning, centrándonos en la usabilidad, el alto rendimiento y la fiabilidad.
- Automatizar el aprovisionamiento, la configuración, la monitorización y la alerta de la infraestructura utilizando principios de Infraestructura como Código (IaC).
- Impulsar la optimización del rendimiento, la optimización de costes y las mejoras de fiabilidad en toda la pila.
- Colaborar estrechamente con investigadores y desarrolladores de productos para comprender sus requisitos, optimizar sus flujos de trabajo y mejorar la usabilidad de la plataforma.
Quién eres
- Motivado por construir para la vanguardia: quieres dar forma a la base informática y de infraestructura de un laboratorio que redefine cómo las personas crean e interactúan con los medios.
- Sólidas habilidades de programación (por ejemplo, Python, Go, o similar) y una sólida comprensión de las mejores prácticas de ingeniería de software.
- Experiencia profunda y práctica con la contenerización (por ejemplo, Docker), la orquestación de contenedores (Kubernetes) y la Infraestructura como Código (Terraform).
- Experiencia demostrada en la construcción y gestión de sistemas distribuidos a gran escala con cargas de trabajo computacionales de GPU (por ejemplo, plataformas de cómputo, pipelines de datos o servicios de alta disponibilidad).
- Experiencia en el diseño de infraestructura para cargas de trabajo de ML donde el rendimiento, el paralelismo y el movimiento de datos son críticos.
- Una mentalidad colaborativa y excelentes habilidades de comunicación, con pasión por construir plataformas amigables para desarrolladores.
Se espera que nuestro personal esté en la oficina al menos tres veces por semana. Gran parte de nuestro progreso proviene de resolver problemas juntos, y queremos que estés presente para eso.
