Launch Legends
NVIDIA
Ingeniero/a de Software de Sistemas Senior - Servidor de Inferencia Dynamo-Triton
Sobre la oportunidad
Buscamos un/a Ingeniero/a de Software de Sistemas Senior para trabajar en el servidor de inferencia Dynamo-Triton developer.nvidia.com/dynamo-triton.
NVIDIA está contratando ingenieros/as de software para su equipo de software de deep learning acelerado por GPU. Grupos académicos y comerciales de todo el mundo están utilizando GPUs para impulsar una revolución en la IA, permitiendo avances en problemas desde la clasificación de imágenes hasta el reconocimiento de voz y el procesamiento del lenguaje natural. Somos un equipo dinámico que construye una plataforma de inferencia de IA de alto rendimiento para facilitar y hacer accesible el diseño e implementación de nuevos modelos de IA a todos los usuarios.
Tus responsabilidades
- Desarrollar software de servicio de inferencia de IA acelerado por GPU de clase mundial.
- Contribuir al desarrollo de funcionalidades e impulsar una amplia adopción por parte de los clientes.
- Impulsar la convergencia de los servidores de inferencia Triton y las pilas de Dynamo de NVIDIA para establecer una plataforma de inferencia unificada y de alto rendimiento. Esta plataforma garantizará la paridad de funcionalidades y servirá eficazmente tanto para cargas de trabajo de modelos de lenguaje grandes (LLM) como no-LLM.
- Ser un miembro activo de la comunidad de ingeniería de software de deep learning de código abierto github.com/triton-inference-server/server.
- Equilibrar una variedad de objetivos, como la creación de software robusto diseñado para ser desplegado en entornos de servidor o nube de producción, la optimización y el equilibrio entre el rendimiento y la latencia de las predicciones, y el desarrollo y la adopción de la próxima generación de tecnologías de inferencia.
Requisitos mínimos
Lo que necesitamos ver
- Máster o Doctorado en Informática o campo relacionado (o experiencia equivalente).
- Más de 5 años de experiencia profesional trabajando en software de deep learning.
- Excelentes habilidades en Rust y C++, familiaridad con Python, y sólidas habilidades de programación y diseño de software, incluyendo depuración, análisis de rendimiento y diseño de pruebas.
- Experiencia con sistemas distribuidos a gran escala y sistemas de ML.
- Sólidas habilidades de comunicación y capacidad para trabajar en un entorno de equipo ágil y dinámico.
Formas de destacar entre la multitud
- Experiencia previa con frameworks y motores de IA, como TensorRT, PyTorch, ONNX, OpenVINO, vLLM o TRT-LLM.
- Conocimiento de gestión de memoria de GPU, gestión de caché o redes de alto rendimiento.
- Experiencia en programación de sistemas distribuidos.
- Experiencia en la contribución a un gran proyecto de código abierto: uso de GitHub, seguimiento de errores, ramificación y fusión de código, gestión de licencias OSS, parches, etc.
Tu salario base se determinará en función de tu ubicación, experiencia y el salario de empleados en puestos similares. El rango salarial base es de 152,000 USD - 241,500 USD para el Nivel 3, y de 184,000 USD - 287,500 USD para el Nivel 4.
También serás elegible para acciones y beneficios nvidia.com/en-us/benefits/.
Las solicitudes para este puesto se aceptarán al menos hasta el 6 de julio de 2026.
Esta oferta corresponde a una vacante existente.
NVIDIA utiliza herramientas de IA en sus procesos de contratación.
NVIDIA se compromete a fomentar un entorno de trabajo inclusivo y se enorgullece de ser un empleador que ofrece igualdad de oportunidades. Dado que valoramos enormemente la diversidad en nuestros empleados actuales y futuros, no discriminamos (incluyendo en nuestras prácticas de contratación y promoción) por motivos de raza, religión, color, origen nacional, género, expresión de género, orientación sexual, edad, estado civil, condición de veterano, condición de discapacidad o cualquier otra característica protegida por la ley.
