Roku
Sustainable Talent
Ingeniero/a de Confiabilidad de Sitios
Sobre la oportunidad
Sustainable Talent se asocia con Nvidia, líder mundial que ha estado transformando los gráficos por computadora, los videojuegos de PC y la computación acelerada durante más de 25 años. Buscamos un Ingeniero/a de Confiabilidad de Sitios para dar soporte al equipo de nuestro cliente con sede en Santa Clara, Ca.
Buscamos un Ingeniero/a de Confiabilidad de Sitios (Contrato) para trabajar en IPP (Infraestructura, Planificación y Procesos). IPP es una organización global dentro de NVIDIA. Este grupo trabaja con varios otros grupos dentro de NVIDIA Software, como Procesadores Gráficos, Procesadores Móviles, Deep Learning, Inteligencia Artificial y Coches sin Conductor para satisfacer sus necesidades de infraestructura. Estos servicios en la nube proporcionan casi medio millón de trabajos automatizados por día en miles de servidores, lo que ayuda a la eficiencia de miles de ingenieros de software de NVIDIA en todo el mundo.
La nube alberga una mezcla heterogénea de máquinas y dispositivos con varios sistemas operativos (Windows/Linux/Android), una multitud de plataformas de hardware, tanto GPUs de NVIDIA como Procesadores Tegra.
¿Te apasiona la infraestructura y buscas problemas sofisticados y relevantes, listo/a para construir la próxima generación de servicios en la nube, crear soluciones creativas, analizar datos para descubrir problemas reales y solucionarlos? Nos encantaría tenerte a bordo.
Este es un puesto de contrato a tiempo completo (W-2). Ofrecemos un salario competitivo
$65/hora - $85/hora basado en factores como la experiencia, la educación, la ubicación, etc., y proporcionamos beneficios completos, PTO y ¡una cultura empresarial increíble!
Sustainable Talent es un empleador que promueve la igualdad de oportunidades de empleo y acción afirmativa para M/F+, personas con discapacidad y veteranos.
Tus responsabilidades
- Monitorización y recuperación de flotas de activos en nuestro entorno de nube privada que alberga varios servidores de cómputo con GPUs de NVIDIA.
- Enfoque específico en la construcción y estabilización de nuestra infraestructura de virtualización de ESXi, KVM y Hyper-V.
- Despliegue y mantenimiento de una gran granja de máquinas utilizando las últimas herramientas de gestión de configuración y automatización de infraestructura (Chef, Ansible, Terraform).
- Participar en el soporte rotatorio y de guardia L1 para la monitorización y remediación ininterrumpida de problemas de infraestructura (PagerDuty)
- Análisis y depuración de problemas de sistema operativo, redes, configuración y rendimiento.
- Asistencia en el despliegue de configuraciones de infraestructura para dar soporte a las últimas tecnologías y hardware de NVIDIA.
- Contribución al desarrollo de sistemas de monitorización para tener un pulso rápido, fiable y en tiempo real de los diversos subsistemas de infraestructura (Zabbix, Big Panda, Grafana).
Requisitos mínimos
Lo que necesitamos ver
- Título de Grado o Máster en Informática o Ingeniería de Software, o experiencia equivalente.
- Experiencia trabajando en sistemas de producción empresariales a gran escala. Se requieren 5+ años de experiencia profesional.
- Capacidad para depurar y analizar problemas del sistema, código para triaje, identificación de la causa raíz y resolución de problemas en la infraestructura. Trabajar en estrecha colaboración con el equipo de ingeniería de plataforma para comprender las configuraciones de hardware.
- Familiaridad con el mantenimiento y la configuración de hosts Linux, Windows.
- Experiencia en scripting con cualquiera de Python, Go. Dominio de la shell de Unix.
- Experiencia con sistemas de control de versiones como Perforce, GIT.
Formas de destacar entre la multitud
- Experiencia con tecnologías de virtualización de VM y hardware como VMware, KVM, Hyper-V, Docker y Kubernetes.
- Experiencia en la automatización del aprovisionamiento de metal desnudo y VM.
- Experiencia en el soporte de GPUs, desarrollo de dispositivos integrados, desarrollo de drivers y aplicaciones CUDA/TensorRT.
- Experiencia en desarrollo en Chef, Ansible y orquestación de infraestructura.
