Nominal
The Allen Institute for Artificial Intelligence
Engenheiro de Software Sênior, Infraestrutura de IA
Sobre a oportunidade
OS PROFISSIONAIS NESSAS FUNÇÕES DEVEM TRABALHAR EM NOSSOS ESCRITÓRIOS EM SEATTLE. PRESENCIAL
OS REQUISITOS VARIAM DE ACORDO COM A POSIÇÃO E A EQUIPE. SE VOCÊ TIVER DÚVIDAS SOBRE OS ARRANJOS DE TRABALHO PRESENCIAL PARA ESTA FUNÇÃO, POR FAVOR, PERGUNTE AO SEU RECRUTADOR.
Nossa faixa salarial base é de $146,880 - $220,320 e, além disso, temos planos de bônus generosos para oferecer um pacote de remuneração competitivo.
Demandas Físicas e Ambiente de Trabalho
As demandas físicas descritas aqui são representativas daquelas que devem ser atendidas por um membro da equipe para realizar com sucesso as funções essenciais desta posição. Acomodações razoáveis podem ser feitas para permitir que indivíduos com deficiências realizem as funções.
- Deve ser capaz de permanecer em uma posição estacionária por longos períodos de tempo.
- A capacidade de comunicar informações e ideias para que outros entendam. Deve ser capaz de trocar informações precisas nessas situações.
- A capacidade de observar detalhes de perto.
- Pode trabalhar sob prazos.
A Ai2 orgulha-se de ser um empregador de Igualdade de Oportunidades. Não discriminamos com base em raça, religião, cor, origem nacional, sexo (incluindo gravidez, parto ou condições médicas relacionadas), orientação sexual, gênero, identidade de gênero, expressão de gênero, status transgênero, estereótipos sexuais, idade, status como veterano protegido, status como indivíduo com deficiência ou outras características legalmente protegidas aplicáveis. Você pode visualizar o pôster de conformidade Know Your Rights eeoc.gov/sites/default/files/2022-10/EEOC_KnowYourRights_screen_reader_10_20.pdf e a Provisão de Não Discriminação de Transparência Salarial dol.gov/sites/dolgov/files/ofccp/pdf/pay-transp_%20English_formattedESQA508c.pdf clicando em seus links correspondentes.
Este empregador participa do E-Verify e fornecerá ao governo federal suas informações do Formulário I-9 para confirmar que você está autorizado a trabalhar nos EUA. Se o E-Verify não puder confirmar que você está autorizado a trabalhar, este empregador é obrigado a lhe dar instruções por escrito e uma oportunidade de entrar em contato com o Departamento de Segurança Interna (DHS) ou a Administração da Previdência Social (SSA) para que você possa começar a resolver o problema antes que o empregador possa tomar qualquer ação contra você, incluindo a rescisão do seu contrato de trabalho. Os empregadores só podem usar o E-Verify depois que você aceitar uma oferta de emprego e preencher o Formulário I-9.
Estamos comprometidos em fornecer acomodações razoáveis a funcionários e candidatos com deficiências na extensão total exigida pela Lei dos Americanos com Deficiências (ADA). Se você sentir que precisa de uma acomodação razoável de acordo com a ADA, encorajamos você a entrar em contato conosco pelo e-mail [email protected]. [[email protected]]
Nota: Esta descrição de cargo de forma alguma declara ou implica que estas são as únicas funções a serem desempenhadas pelos membros da equipe desta posição. Os membros da equipe serão obrigados a seguir quaisquer outras instruções relacionadas ao trabalho e a realizar quaisquer outras tarefas relacionadas ao trabalho solicitadas por qualquer pessoa autorizada a dar instruções ou atribuições. Todos os deveres e responsabilidades são funções e requisitos essenciais e estão sujeitos a possíveis modificações para acomodar razoavelmente indivíduos com deficiências. Para realizar este trabalho com sucesso, o(s) membro(s) da equipe possuirá(ão) as habilidades, aptidões e capacidades para realizar cada tarefa com proficiência. Alguns requisitos podem excluir indivíduos que representam uma ameaça direta ou risco significativo à saúde ou segurança de si mesmos ou de outros. Os requisitos listados neste documento são os níveis mínimos de conhecimento, habilidades ou capacidades. Este documento não cria um contrato de trabalho, implícito ou não, além de um relacionamento at-will.
Quem é você
Você é um engenheiro de sistemas especialista que ocupa o espaço entre a orquestração de software de alto nível e o desempenho de sistemas de baixo nível. Você é motivado pela ideia de que uma infraestrutura de classe mundial deve ser um catalisador para o bem público, não um segredo proprietário. Você se sente tão confortável projetando um algoritmo de alocação de recursos em Go quanto depurando um timeout de NCCL.
Você lidera pelo exemplo, combinando o rigor de um Engenheiro de Software Sênior com a urgência pragmática e prática de um operador de HPC. Você não apenas constrói sistemas, mas também garante que eles prosperem sob a pressão do treinamento de modelos de IA de classe mundial.
Seu próximo desafio
Na Ai2, acreditamos que os avanços mais importantes em IA devem ser transparentes e acessíveis. Seu desafio é construir a infraestrutura que torna isso possível. Você fará a ponte entre nossos pesquisadores e nossos clusters de GPU.
Você será um colaborador técnico sênior responsável por garantir que, quando um pesquisador enviar um trabalho, o software o agende de forma inteligente e o hardware o execute perfeitamente. Isso envolve:
Quem somos
Enquanto grande parte da indústria de IA se moveu para trás de APIs fechadas, conjuntos de dados proprietários e infraestrutura de "caixa preta", a Ai2 permanece um farol para a Ciência Aberta. Fundado pelo falecido Paul Allen, somos um instituto de pesquisa sem fins lucrativos dedicado a construir IA para o bem comum.
Não temos um preço de ações para defender ou um jardim murado para proteger. Em vez disso, temos uma missão: fornecer à comunidade global de pesquisa as bases transparentes e de alto desempenho de que precisam para alcançar avanços que enriqueçam a humanidade.
O que nos torna diferentes
- Transparência Radical: Não apenas liberamos pesos de modelos; liberamos os dados, o código de treinamento e os insights de infraestrutura. Acreditamos que o "como" é tão importante quanto o "quê".
- Missão acima da Margem: Nosso "resultado final" é o impacto científico. Isso nos dá a liberdade única de priorizar a elegância técnica, a estabilidade de longo prazo e as contribuições de código aberto em vez de metas de lucro trimestrais.
- O melhor dos dois mundos: Operamos no ritmo e na escala de uma startup de tecnologia de classe mundial, mas com a alma intelectual de um laboratório de pesquisa.
- O Ecossistema Beaker: Construímos e operamos sistemas como o Beaker para coordenar o treinamento simultâneo de modelos de fronteira (como o OLMo) em clusters de GPU massivos. Nosso trabalho é garantir que o próximo grande avanço em IA não seja interrompido por um gargalo de recursos ou um guardião proprietário.
Um pouco mais sobre
Ai2: A Ai2 é um instituto de pesquisa de IA sem fins lucrativos com sede em Seattle, fundado em 2014 pelo falecido Paul Allen. Nossa missão é construir IA inovadora para resolver os maiores problemas do mundo. Desenvolvemos pesquisa e inovação fundamentais em IA para oferecer impacto no mundo real por meio de modelos abertos de grande escala, dados, robótica, conservação e muito mais.
Além da missão principal da Ai2, também visamos contribuir para a humanidade através do nosso tratamento de cada membro da Equipe Ai2. Alguns destaques são:
- Somos uma organização de aprendizado – porque tudo o que a Ai2 faz é inovador, estamos aprendendo todos os dias. Da mesma forma, através de palestras semanais da Ai2 Academy, uma grande variedade de especialistas em IA de classe mundial como palestrantes convidados e nosso compromisso com sua educação pessoal contínua, a Ai2 é um lugar onde você terá oportunidades de continuar aprendendo ao lado de seus colegas de trabalho.
- Valorizamos a diversidade - Buscamos contratar, apoiar e promover pessoas de todos os gêneros, etnias e todos os níveis de experiência, independentemente da idade. Incentivamos particularmente candidaturas de mulheres, indivíduos não binários, pessoas de cor, membros da comunidade LGBTQA+ e pessoas com deficiências de qualquer tipo.
- Valorizamos a inclusão - Entendemos o valor que as experiências e perspectivas individuais das pessoas podem trazer para uma organização, e estamos construindo uma cultura na qual todas as vozes são ouvidas, respeitadas e consideradas.
- Enfatizamos um equilíbrio saudável entre vida profissional e pessoal – acreditamos que os membros da nossa equipe são mais felizes e produtivos quando seu equilíbrio entre vida profissional e pessoal é otimizado. Embora valorizemos resultados de pesquisa poderosos que impulsionam nossa missão, também valorizamos o jantar com a família, o tempo de fim de semana e o tempo de férias. Oferecemos férias remuneradas generosas e licença médica, bem como licença familiar.
- Somos colaborativos e transparentes – nos consideramos uma equipe, todos movendo-se com um propósito comum. Somos rápidos em comemorar nossos sucessos e ainda mais rápidos em compartilhar e resolver problemas conjuntamente em nossas falhas.
- Estamos em Seattle – e nosso escritório fica na água! Temos montanhas, temos lagos, temos quatro estações, vamos de bicicleta para o trabalho, temos uma cena teatral vibrante e temos muito mais. Temos até caiaques para você remar bem na frente da nossa porta. Aceitamos o interesse de candidatos de fora dos Estados Unidos.
- Somos amigáveis – é provável que você goste de cada uma das 200+ (e crescendo) pessoas que trabalham aqui. Nós gostamos.
- Projetando para Escala: Projetar e escalar nossa camada de orquestração para garantir que as cargas de trabalho de maior valor recebam tempo de GPU.
- Excelência Operacional: Mover nossas operações de HPC de intervenção manual para automação de alto nível.
- Engenharia de Desempenho: Trabalhar diretamente com pesquisadores para extrair cada bit de desempenho do nosso ambiente de computação acelerado por GPU.
Suas responsabilidades
- Propriedade Full-Stack: Projetar e entregar de forma independente sistemas críticos que abrangem toda a pilha — desde o agendador de trabalhos Beaker até o tempo de execução da execução.
- Automação de Sistemas: Construir ferramentas inovadoras e infraestrutura definida por software para acelerar a velocidade do pesquisador e automatizar o gerenciamento da integridade do cluster.
- Otimização de Desempenho: Conduzir análise de causa raiz em falhas complexas de sistemas distribuídos e implementar otimizações para cargas de trabalho distribuídas.
- Contribuição Técnica e Propriedade: Fornecer contribuições valiosas para o roteiro de gerenciamento de sistemas HPC de grande escala, incluindo a implantação de computação, rede e armazenamento em parceria com a liderança.
- Mentoria e Cultura: Promover uma cultura de alto desempenho revisando códigos/documentos de design, orientando membros da equipe e impulsionando melhorias de processo dentro da equipe.
- Colaboração: Comunicar-se e colaborar efetivamente com a equipe de pesquisa interna para compartilhar designs de sistemas, coletar feedback e apoiar engenheiros em tarefas de implementação.
Requisitos mínimos
O que você precisará
- 8+ anos de experiência profissional desenvolvendo software crítico para os negócios e operando infraestrutura de computação de grande escala. Proficiência em Go e/ou Python preferencial.
- Bacharelado em área relacionada; diploma avançado relevante pode substituir anos equivalentes de experiência de trabalho técnico.
- Especialização em Linux: Conhecimento de nível especialista em internos de Linux e tempos de execução de contêineres como Docker.
- Especialização em Sistemas Distribuídos: Um histórico comprovado de projeto, depuração e otimização de sistemas distribuídos e bancos de dados de alta escala.
- Comunicação: Habilidades de escrita excepcionais e a capacidade de chegar a um consenso entre diversos grupos de pesquisadores e engenheiros.
- Uma abordagem baseada em princípios para a engenharia: Você se preocupa com a forma como os sistemas são construídos e se sente entusiasmado com as restrições e liberdades únicas de um ambiente de pesquisa sem fins lucrativos.
Qualificações Bônus
- Experiência aplicada com agendadores de carga de trabalho (como Kubernetes ou Slurm) e rede de alto desempenho (NCCL e InfiniBand).
- Experiência anterior em treinamento ou ajuste fino de modelos de IA de fronteira.
- Especialização profunda em administração de sistemas ou histórico de "Site Reliability Engineering" (SRE) em um contexto de HPC.
- Experiência contribuindo para projetos de infraestrutura ou orquestração de código aberto.
- Familiaridade com sistemas de armazenamento on-prem como WEKA e Ceph.
Benefícios
- Os membros da equipe e suas famílias são cobertos por planos médico, odontológico, oftalmológico e um programa de assistência ao funcionário.
- Os membros da equipe podem se inscrever em nosso plano de conta poupança de saúde, nosso plano de arranjo de reembolso de saúde e nossos planos de conta de gastos flexíveis para cuidados de saúde e dependentes.
- Os membros da equipe podem se inscrever no plano 401k da nossa empresa.
- Os membros da equipe receberão $125 por mês para ajudar com despesas de deslocamento ou internet e também receberão $200 por mês para despesas de condicionamento físico e bem-estar.
- Os membros da equipe também receberão até dez dias de licença médica por ano, até sete dias pessoais por ano, até 20 dias de férias por ano e doze feriados remunerados ao longo do ano civil.
- Os membros da equipe poderão receber bônus anuais e podem participar do plano de incentivo de longo prazo.
