NVIDIA

Ingeniero Principal de Software - Infraestructura de Sistemas a Escala de Rack

KubernetesC++RustGo
Traducción automática. Consulta el original.

Sobre la oportunidad

NVIDIA lleva más de 25 años transformando los gráficos por ordenador, los videojuegos de PC y la computación acelerada. Es un legado único de innovación impulsado por una gran tecnología y personas increíbles. Hoy en día, estamos aprovechando el potencial ilimitado de la IA para definir la próxima era de la computación. Una era en la que nuestra GPU actúa como el cerebro de ordenadores, robots y coches autónomos capaces de comprender el mundo. Hacer lo que nunca se ha hecho antes requiere visión, innovación y el mejor talento del mundo. Como NVIDIAN, te sumergirás en un entorno diverso y de apoyo donde todo el mundo se siente inspirado para dar lo mejor de sí mismo. Únete al equipo y descubre cómo puedes dejar una huella duradera en el mundo.

En NVIDIA, como Ingeniero Principal de Infraestructura de Sistemas a Escala de Rack, construirás y guiarás el desarrollo de sistemas de software. Estos sistemas dan soporte a nuestros próximos productos y servicios de infraestructura a escala de rack. Este puesto excepcional se encuentra donde el software se une al hardware. Trabajarás en planos de control, máquinas de estado, sistemas de orquestación, firmware, ciclo de vida del SO y redes de interconexión. Tu tarea es componer software de plano de control de infraestructura como servicio que convierta hardware complejo a escala de rack en infraestructura fiable, manejable y programable para NVIDIA, socios y clientes líderes de la nube y empresariales a nivel mundial.

NVIDIA es ampliamente considerada como uno de los empleadores más deseados del mundo de la tecnología. Tenemos algunas de las personas más innovadoras y trabajadoras del mundo trabajando para nosotros. Si eres creativo y autónomo, ¡queremos saber de ti!

¿Qué harás?

  1. Definir la arquitectura completa de software para productos y servicios de infraestructura a escala de rack, cubriendo servicios de plano de control, gestión de infraestructura, firmware, sistemas operativos, controladores de kernel, redes de interconexión, software de acelerador y software de gestión en modo de usuario.
  1. Utilizar Kubernetes y primitivas nativas de la nube como tejido de infraestructura cuando sea apropiado. Esto incluye controladores, operadores, bucles de reconciliación y componentes de código abierto. Estos componentes pueden operar de forma segura a escala de rack y de flota. Construir software de infraestructura de código abierto que pueda ser adoptado en diferentes formas, incluyendo bibliotecas, servicios, controladores, operadores y APIs de integración para despliegues internos y entornos CSP.
  1. Servir de puente entre equipos de hardware y software en firmware, BMC, BIOS, flujos de arranque, imágenes de SO, controladores, redes, dominios NVLink, InfiniBand, GPUs, DPUs, CPUs e interfaces de gestión de sistemas. Traducir hojas de ruta de infraestructura con visión de futuro en requisitos de software formales, especificaciones de arquitectura y planes de ejecución que alineen a los equipos en toda la organización.
  1. Colaborar directamente con hiperescaladores, CSP, clientes empresariales, líderes de componentes internos, proveedores y socios comerciales para alinear las capacidades de infraestructura con las necesidades reales de despliegue e integración. Establecer estrategias de fiabilidad, seguridad, validación y "left-shift" que reduzcan el riesgo antes de que el hardware llegue a los entornos de producción.
  1. Mentorizar a ingenieros senior y líderes técnicos, elevando el nivel de ingeniería para sistemas en red a gran escala, software fundamental y desarrollo de planos de control a escala de rack.
  1. Tomar decisiones técnicas de alta calidad en entornos ambiguos, equilibrando las necesidades del cliente, el calendario, las realidades del hardware, la mantenibilidad del software, la adopción de código abierto y la evolución a largo plazo de la infraestructura.

¿Qué necesitamos ver?

  1. Grado o Máster en Ingeniería Informática, Ciencias de la Computación, Ingeniería Eléctrica o un campo relacionado, o experiencia equivalente. Experiencia demostrada (15+ años) en arquitectura de sistemas, software de sistemas, sistemas distribuidos, planos de control de infraestructura o ingeniería de infraestructura.
  1. Sólidos conocimientos arquitectónicos de frameworks de coordinación, máquinas de estado, APIs declarativas, bucles de reconciliación, orquestación de ciclo de vida, manejo de fallos, flujos de trabajo de actualización y reversión, y compensaciones de sistemas distribuidos.
  1. Habilidades prácticas de codificación en Go, C++ o Rust, abarcando la capacidad de escribir, revisar y dirigir software de infraestructura de calidad de producción. La experiencia con Rust es muy valorada.
  1. Experiencia con Kubernetes o sistemas de orquestación similares, especialmente como tejido para gestionar infraestructura, recursos de hardware o servicios de infraestructura a gran escala. Experiencia con software de infraestructura basado en Linux, despliegue de SO y gestión de imágenes, interacciones de kernel o controladores, ciclo de vida de firmware y flujos de trabajo de puesta en marcha de hardware.
  1. Sólida comprensión de las tecnologías y protocolos de redes de centros de datos, como Ethernet, InfiniBand, RDMA y gestión a nivel de tejido. Experiencia con sistemas complejos basados en aceleradores, incluyendo GPUs, DPUs, FPGAs, silicio personalizado u otros sistemas de computación de alto rendimiento.
  1. Experiencia en arquitecturas de gestión en banda y fuera de banda, incluyendo BMC, Redfish, IPMI y protocolos de gestión de sistemas relacionados. Capacidad para trabajar con expertos en seguridad para definir compensaciones prácticas entre arranque seguro, atestación, control de acceso, seguridad de actualizaciones, servicio y facilidad de operación.
  1. Experiencia en la creación de software destinado a su publicación como código abierto, incluyendo la estabilidad de API, modularidad, documentación, usabilidad comunitaria y una separación limpia entre el software compartido y las integraciones específicas del despliegue.
  1. Experiencia en el uso responsable de herramientas de desarrollo asistidas por IA como multiplicador de ingeniería para codificación, generación de pruebas, depuración, iteración de compilación y documentación.
  1. Habilidad demostrada para especificar requisitos, guiar la arquitectura y gestionar la entrega a través de diversos equipos y organizaciones de ingeniería. Sólidas habilidades de comunicación escrita y verbal, que permitan explicar claramente compensaciones complejas de hardware/software a líderes de ingeniería, clientes, socios y ejecutivos.

¿Formas de destacar entre la multitud?

  1. Haber creado software que soporte múltiples modelos de adopción: servicios internos, ofertas integradas con CSP, bibliotecas reutilizables y APIs extensibles por el cliente. Sólidas habilidades en Rust en sistemas, infraestructura o software adyacente al hardware.
  1. Haber multiplicado el impacto del equipo a través de implementaciones de referencia, revisiones de diseño, bibliotecas compartidas, documentación de arquitectura, flujos de trabajo de desarrollo e ingeniería asistida por IA. Experiencia práctica en aprovisionamiento a escala de flota, actualizaciones, reversiones, observabilidad, estado y remediación.
  1. Haber liderado a lo largo del ciclo de vida completo del producto del centro de datos: concepción, pre y post silicio, fabricación, despliegue y operaciones. Familiaridad con los ecosistemas de código abierto, modelos de contribución y el equilibrio entre la colaboración comunitaria y las necesidades del producto.
  1. Profunda experiencia con sistemas a escala de rack o clúster que abarcan computación, redes, almacenamiento, aceleradores, firmware y gestión de infraestructura como un único dominio operativo. Habilidad para encontrar abstracciones simples y duraderas en sistemas complejos para alinear equipos, clientes y la dirección a largo plazo.

Tu salario base se determinará en función de tu ubicación, experiencia y el salario de los empleados en puestos similares. El rango salarial base es 272,000 USD - 431,250 USD.

Las solicitudes para este puesto se aceptarán al menos hasta Octubre 8, 2026.

Esta oferta corresponde a una vacante existente.

NVIDIA utiliza herramientas de IA en sus procesos de contratación.

NVIDIA se compromete a fomentar un entorno de trabajo inclusivo y se enorgullece de ser un empleador que ofrece igualdad de oportunidades. Dado que valoramos enormemente la diversidad en nuestros empleados actuales y futuros, no discriminamos (incluyendo en nuestras prácticas de contratación y promoción) por motivos de raza, religión, color, origen nacional, género, expresión de género, orientación sexual, edad, estado civil, condición de veterano, condición de discapacidad o cualquier otra característica protegida por la ley.

También serás elegible para acciones y beneficios nvidia.com/en-us/benefits/.

Más oportunidades con un solo perfil

¿Quieres optar a más puestos sin repetir todo el proceso? Crea tu perfil para que te encuentren las empresas que usan Nort.

Crear mi perfil

Tu próximo empleoya está buscándote.

Nort

Plataforma de reclutamiento inverso para programadores