Marks & Spencer
Odyssey
Membro da Equipe Técnica Staff, Engenheiro de Infraestrutura
Quem somos
Odyssey é um laboratório de IA pioneiro em modelos de mundo gerais: sistemas causais e multimodais que aprendem a prever e interagir com o mundo em longos horizontes. Essa tecnologia fundamental promete revolucionar a robótica, a ciência, a saúde, a educação, os jogos, a defesa e muito mais.
Os fundadores da Odyssey foram anteriormente pioneiros na aplicação mais complexa de IA física: carros autônomos. Eles reuniram uma equipe de pesquisa de classe mundial da DeepMind, Tesla, Waymo, Meta, Apple e Wayve, que fizeram contribuições significativas para modelos de linguagem (DeepMind Gemini), modelos de vídeo (DeepMind Veo), modelos de mundo (Wayve GAIA) e sistemas autônomos (Tesla FSD).
Odyssey levantou capital de risco significativo de GV, Amazon, AMD, EQT, NVIDIA, Natural Capital, In-Q-Tel, Elad Gil, Jeff Dean, Guillermo Rauch, Garry Tan, Kyle Vogt e pesquisadores da OpenAI, DeepMind, MSL, Recursive e Thinking Machines.
O que procuramos
Estamos procurando um engenheiro que se destaque na construção dos motores que tornam possíveis pesquisas e produtos inovadores. Você pensa em sistemas, adora desempenho e se energiza ao transformar gargalos teóricos em realidade lindamente eficiente. Você está animado para projetar e dar suporte à infraestrutura não apenas para escala, mas para velocidade, criatividade e descoberta. Você quer construir o substrato de computação que permite que os modelos de mundo da Odyssey imaginem, ajam e interajam em tempo real.
O que você fará
- Desenvolver e operar nossa plataforma de inferência de modelos de baixa latência, garantindo alta disponibilidade, escalabilidade e utilização eficiente de recursos para os modelos de mundo da Odyssey.
- Projetar e escalar nossa infraestrutura central de processamento de dados (por exemplo, Flyte, Ray com k8s) para lidar com conjuntos de dados em escala de petabytes.
- Projetar, construir e manter nossos clusters de treinamento em larga escala baseados em GPU para deep learning, com foco em usabilidade, alto rendimento e confiabilidade.
- Automatizar o provisionamento de infraestrutura, configuração, monitoramento e alertas usando princípios de Infraestrutura como Código (IaC).
- Impulsionar o ajuste de desempenho, a otimização de custos e as melhorias de confiabilidade em toda a pilha.
- Colaborar estreitamente com pesquisadores e desenvolvedores de produtos para entender seus requisitos, otimizar seus fluxos de trabalho e melhorar a usabilidade da plataforma.
Quem você é
- Motivado por construir para a fronteira: você quer moldar a base de computação e infraestrutura de um laboratório que está redefinindo como as pessoas criam e interagem com a mídia.
- Fortes habilidades de programação (por exemplo, Python, Go, ou similar) e uma sólida compreensão das melhores práticas de engenharia de software.
- Experiência profunda e prática com contêineres (por exemplo, Docker), orquestração de contêineres (Kubernetes) e Infraestrutura como Código (Terraform).
- Experiência comprovada na construção e gerenciamento de sistemas distribuídos em larga escala com cargas de trabalho computacionais de GPU (por exemplo, plataformas de computação, pipelines de dados ou serviços de alta disponibilidade).
- Experiência em projetar infraestrutura para cargas de trabalho de ML onde desempenho, paralelismo e movimento de dados são críticos.
- Uma mentalidade colaborativa e excelentes habilidades de comunicação, com paixão por construir plataformas amigáveis para desenvolvedores.
Espera-se que nossa equipe esteja no escritório pelo menos três vezes por semana. Grande parte do nosso progresso vem de resolver problemas juntos, e queremos você na sala para isso.
