Roku
d-Matrix
Principal System Software Engineer, AI Inference Execution
Sobre la oportunidad
En d-Matrix estamos centrados en liberar el potencial de la IA generativa para impulsar la transformación de la tecnología. Estamos a la vanguardia de la innovación en software y hardware, superando los límites de lo posible. Nuestra cultura es de respeto y colaboración.
Valoramos la humildad y creemos en la comunicación directa. Nuestro equipo es inclusivo y nuestras diferentes perspectivas permiten mejores soluciones. Buscamos personas apasionadas por afrontar desafíos y motivadas por la ejecución. ¿Listo para encontrar tu espacio de juego? Juntos, podemos ayudar a dar forma a las infinitas posibilidades de la IA.
Política de Igualdad de Oportunidades en el Empleo
Ubicación: Híbrido, trabajando presencialmente en nuestra sede de Santa Clara, CA, 3 días a la semana.
d-Matrix se enorgullece de ser un lugar de trabajo que ofrece igualdad de oportunidades y un empleador que practica la acción afirmativa. Estamos comprometidos a fomentar un entorno inclusivo donde todos se sientan bienvenidos y capacitados para hacer su mejor trabajo. Contratamos al mejor talento para nuestros equipos, independientemente de su raza, religión, color, edad, discapacidad, sexo, identidad de género, orientación sexual, ascendencia, información genética, estado civil, origen nacional, afiliación política o condición de veterano. Nuestro enfoque es contratar compañeros de equipo con experiencia humilde, amabilidad, dedicación y voluntad de aceptar desafíos y aprender juntos cada día.
d-Matrix no acepta currículums ni candidaturas de agencias externas. Agradecemos el interés y el esfuerzo de las empresas de contratación, pero solicitamos amablemente que las personas interesadas en oportunidades con d-Matrix se postulen directamente a través de nuestros canales oficiales. Este enfoque nos permite optimizar nuestros procesos de contratación y mantener una evaluación coherente y justa de todos los solicitantes. Gracias por su comprensión y cooperación.
El puesto: Principal System Software Engineer, AI Inference Execution
Qué harás
El puesto requiere que formes parte del equipo que ayuda a comercializar la pila de software para nuestro motor de computación de IA. Como parte del equipo de software, serás responsable del desarrollo, la mejora y el mantenimiento del software de implementación de IA de próxima generación. Has tenido experiencia previa trabajando en todos los aspectos de la cadena de herramientas full-stack y comprendes los matices de lo que se necesita para optimizar y equilibrar varios aspectos del codiseño de hardware y software. Eres capaz de construir y escalar entregables de software en un plazo de desarrollo ajustado. Trabajarás con un equipo de expertos en software de sistemas para construir la infraestructura de implementación, colaborando estrechamente con otros expertos en software (ML y compiladores) y hardware de la empresa.
Qué aportarás
Mínimo
- Grado BS en Ciencias de la Computación, Ingeniería, Matemáticas, Física o título relacionado con más de 12 años de experiencia en desarrollo de software industrial y se prefiere Grado MS en Ciencias de la Computación, Ingeniería, Matemáticas, Física o título relacionado con más de 6 años.
- Sólido conocimiento de software de sistemas, estructuras de datos, arquitectura de computadoras y fundamentos de machine learning.
- Dominio del desarrollo en C/C++/Python en entorno Linux y uso de herramientas de desarrollo estándar.
- Experiencia con diseño e implementación de software distribuido de alto rendimiento.
- Jugador de equipo automotivado con un fuerte sentido de la propiedad y el liderazgo.
Preferible
- MS o PhD en Ciencias de la Computación, Ingeniería Eléctrica o campos relacionados.
- Experiencia con servidores de inferencia/frameworks de servicio de modelos (como TensorRT-LLM, vLLM, SGLang, etc.).
- Experiencia con frameworks de deep learning (como PyTorch y TensorFlow).
- Experiencia con tiempos de ejecución de deep learning (como ONNX Runtime, TensorRT, etc.).
- Experiencia con colectivos de sistemas distribuidos como NCCL y OpenMPI.
- Experiencia con fundamentos de pruebas de software.
- Experiencia en la implementación de cargas de trabajo de ML (LLMs, VLMs, NLP, etc.) en sistemas distribuidos.
- Experiencia con Kubernetes, Ray u otras herramientas y técnicas de MLOps utilizadas desde la definición hasta la implementación.
- Experiencia previa en startups, equipos pequeños o incubadoras.
- Experiencia laboral en un proveedor de nube o empresa de computación/subsistema de IA.
