d-Matrix

Engenheiro(a) Principal de Software de Sistemas, Execução de Inferência de IA

PythonKubernetesC++
Tradução automática. Consulte o original.

Sobre a oportunidade

Na d-Matrix, estamos focados em liberar o potencial da IA generativa para impulsionar a transformação da tecnologia. Estamos na vanguarda da inovação em software e hardware, expandindo os limites do que é possível. Nossa cultura é de respeito e colaboração.

Valorizamos a humildade e acreditamos na comunicação direta. Nossa equipe é inclusiva e nossas diferentes perspectivas permitem melhores soluções. Estamos buscando indivíduos apaixonados por enfrentar desafios e impulsionados pela execução. Pronto para encontrar seu playground? Juntos, podemos ajudar a moldar as infinitas possibilidades da IA.

Política de Igualdade de Oportunidades de Emprego

Localização: Híbrido, com trabalho presencial em nossa sede em Santa Clara, CA, 3 dias por semana.

A d-Matrix tem orgulho de ser um local de trabalho que oferece igualdade de oportunidades e empregador de ação afirmativa. Estamos comprometidos em promover um ambiente inclusivo onde todos se sintam bem-vindos e capacitados a fazer o seu melhor trabalho. Contratamos os melhores talentos para nossas equipes, independentemente de raça, religião, cor, idade, deficiência, sexo, identidade de gênero, orientação sexual, ancestralidade, informações genéticas, estado civil, origem nacional, afiliação política ou status de veterano. Nosso foco é contratar colegas com expertise humilde, gentileza, dedicação e vontade de abraçar desafios e aprender juntos todos os dias.

A d-Matrix não aceita currículos ou submissões de candidatos de agências externas. Agradecemos o interesse e o esforço das empresas de recrutamento, mas pedimos gentilmente que os indivíduos interessados em oportunidades na d-Matrix se candidatem diretamente através de nossos canais oficiais. Essa abordagem nos permite otimizar nossos processos de contratação e manter uma avaliação consistente e justa de todos os candidatos. Obrigado pela sua compreensão e cooperação.

A função: Engenheiro(a) Principal de Software de Sistemas, Execução de Inferência de IA

O que você fará

A função exige que você faça parte da equipe que ajuda a transformar em produto a pilha de software para nosso motor de computação de IA. Como parte da equipe de software, você será responsável pelo desenvolvimento, aprimoramento e manutenção do software de implantação de IA de próxima geração. Você tem experiência anterior trabalhando em todos os aspectos da cadeia de ferramentas full-stack e entende as nuances do que é necessário para otimizar e equilibrar vários aspectos do co-design de hardware-software. Você é capaz de construir e escalar entregas de software em uma janela de desenvolvimento apertada. Você trabalhará com uma equipe de especialistas em software de sistemas para construir a infraestrutura de implantação, trabalhando em estreita colaboração com outros especialistas em software (ML e compiladores) e hardware da empresa.

O que você trará

Mínimo

  1. Bacharelado em Ciência da Computação, Engenharia, Matemática, Física ou área relacionada com 12+ anos de experiência em desenvolvimento de software na indústria e Mestrado em Ciência da Computação, Engenharia, Matemática, Física ou área relacionada é preferível com 6+ anos
  1. Forte domínio de software de sistemas, estruturas de dados, arquitetura de computadores e fundamentos de machine learning
  1. Proficiente em desenvolvimento em C/C++/Python em ambiente Linux e utilizando ferramentas de desenvolvimento padrão
  1. Experiência com design e implementação de software distribuído de alto desempenho
  1. Jogador de equipe automotivado com forte senso de propriedade e liderança.

Preferencial

  1. Mestrado ou Doutorado em Ciência da Computação, Engenharia Elétrica ou áreas relacionadas
  1. Experiência com servidores de inferência/frameworks de serviço de modelos (como TensorRT-LLM, vLLM, SGLang, etc.)
  1. Experiência com frameworks de deep learning (como PyTorch e TensorFlow)
  1. Experiência com runtimes de deep learning (como ONNX Runtime, TensorRT, etc.).
  1. Experiência com coletivos de sistemas distribuídos como NCCL e OpenMPI
  1. Experiência com fundamentos de testes de software
  1. Experiência na implantação de cargas de trabalho de ML (LLMs, VLMs, NLP, etc.) em sistemas distribuídos.
  1. Experiência com Kubernetes, Ray ou outras ferramentas e técnicas de MLOps usadas da definição à implantação
  1. Experiência anterior em startups, equipes pequenas ou incubação
  1. Experiência de trabalho em um provedor de nuvem ou empresa de computação/subsistema de IA

Mais oportunidades com um só perfil

Quer aparecer para várias vagas sem repetir todo o processo? Crie seu perfil e seja encontrado pelas empresas que usam a Nort.

Criar meu perfil

Seu próximo empregojá está te procurando.

Nort

Plataforma de recrutamento reverso para programadores