Roku
NVIDIA
Engenheiro de Software de Sistemas Sênior - Servidor de Inferência Dynamo-Triton
Sobre a oportunidade
Estamos em busca de um Engenheiro de Software de Sistemas Sênior para trabalhar no Dynamo-Triton Inference Server developer.nvidia.com/dynamo-triton.
A NVIDIA está contratando engenheiros de software para sua equipe de software de deep learning acelerado por GPU. Grupos acadêmicos e comerciais ao redor do mundo estão utilizando GPUs para impulsionar uma revolução em IA, permitindo avanços em problemas que vão desde classificação de imagens até reconhecimento de fala e processamento de linguagem natural. Somos uma equipe ágil que desenvolve uma plataforma de inferência de IA de alto desempenho para tornar o design e a implementação de novos modelos de IA mais fáceis e acessíveis a todos os usuários.
O que você fará
- Desenvolver software de inferência de IA acelerado por GPU de classe mundial.
- Contribuir para o desenvolvimento de funcionalidades e impulsionar a ampla adoção pelos clientes.
- Impulsionar a convergência do Triton Inference Server e das pilhas Dynamo da NVIDIA para estabelecer uma plataforma de inferência unificada e de alto desempenho. Esta plataforma garantirá a paridade de recursos e atenderá efetivamente tanto cargas de trabalho de Large Language Model (LLM) quanto cargas de trabalho que não sejam LLM.
- Ser um membro ativo da comunidade de engenharia de software de deep learning de código aberto github.com/triton-inference-server/server.
- Equilibrar uma variedade de objetivos, como construir software robusto projetado para ser implantado em servidores de produção ou ambientes de nuvem, otimizar e equilibrar a taxa de transferência e a latência de predição, e desenvolver e adotar a próxima geração de tecnologias de inferência.
Requisitos mínimos
O que precisamos ver
- Mestrado ou Doutorado em Ciência da Computação ou área relevante (ou experiência equivalente).
- 5+ anos de experiência profissional trabalhando com software de deep learning.
- Excelentes habilidades em Rust e C++, familiaridade com Python, e fortes habilidades de programação e design de software, incluindo depuração, análise de desempenho e design de testes.
- Experiência com sistemas distribuídos de alta escala e sistemas de ML.
- Fortes habilidades de comunicação e capacidade de trabalhar em um ambiente de equipe ágil e de ritmo acelerado.
Formas de se destacar
- Experiência prévia com frameworks e motores de IA, como TensorRT, PyTorch, ONNX, OpenVINO, vLLM ou TRT-LLM.
- Conhecimento de gerenciamento de memória de GPU, gerenciamento de cache ou rede de alto desempenho.
- Experiência com programação de sistemas distribuídos.
- Experiência em contribuir para um grande projeto de código aberto: uso de GitHub, rastreamento de bugs, ramificação e mesclagem de código, tratamento de patches de licenciamento OSS, etc.
Seu salário base será determinado com base em sua localização, experiência e na remuneração de funcionários em cargos similares. A faixa salarial base é de 152,000 USD a 241,500 USD para o Nível 3, e de 184,000 USD a 287,500 USD para o Nível 4.
Você também será elegível para participação acionária e benefícios nvidia.com/en-us/benefits/.
As candidaturas para esta vaga serão aceitas pelo menos até 6 de julho de 2026.
Este anúncio refere-se a uma vaga existente.
A NVIDIA utiliza ferramentas de IA em seus processos de recrutamento.
A NVIDIA está comprometida em promover um ambiente de trabalho inclusivo e orgulha-se de ser uma empregadora que oferece oportunidades iguais. Como valorizamos muito a diversidade em nossos funcionários atuais e futuros, não discriminamos (inclusive em nossas práticas de contratação e promoção) com base em raça, religião, cor, origem nacional, gênero, expressão de gênero, orientação sexual, idade, estado civil, status de veterano, status de deficiência ou qualquer outra característica protegida por lei.
