Etched

Ingeniero/a de Centros de Datos

Python
Traducción automática. Consulta el original.

Acerca de nosotros

Etched Etched está construyendo hardware para inteligencia de vanguardia. Co-diseñamos chips, racks, software y fabricación para ofrecer el mejor rendimiento y latencia en cargas de trabajo de prellenado y decodificación. Nuestros primeros productos se centran en gran medida en la inferencia. Respaldada por cientos de millones de los principales inversores y con un equipo de ingenieros líderes, Etched está redefiniendo la capa de infraestructura para la industria de más rápido crecimiento de la historia.

Resumen del puesto

El despliegue de hardware de inferencia de próxima generación a escala requiere más que grandes chips: exige una infraestructura física de primer nivel. Como Ingeniero/a de Centros de Datos en Etched, serás responsable del ciclo de vida completo de nuestros entornos de centros de datos y laboratorios de hardware: desde la selección de instalaciones y el diseño de racks, la distribución de energía, la disposición de la red, el cableado, la gestión de hardware, las operaciones diarias y la planificación de capacidad a largo plazo. Trabajarás directamente con los equipos de hardware, plataforma y software para poner en línea nuestros sistemas más rápido, mantenerlos funcionando de manera más eficiente y superar los límites de lo que puede hacer la infraestructura de diseño y fabricación de inferencia de IA densa y de alta potencia.

Este no es un puesto tradicional de operaciones de centros de datos. Esperamos que trates la ingeniería de centros de datos con el mismo rigor y artesanía que aplicamos a nuestro diseño de chips, pensando desde los primeros principios sobre densidad de potencia, restricciones térmicas, topología de red y seguridad física. Tomarás decisiones arquitectónicas reales que darán forma directamente a cómo se diseñan, fabrican y llegan nuestros productos a los clientes.

Estarás en nuestras instalaciones de co-ubicación y laboratorios, trabajando directamente con plataformas de servidores personalizadas y redes de alta velocidad. Impulsarás los procesos, las herramientas y las relaciones con los proveedores que nos permitirán escalar nuestra infraestructura tan rápido como lo exija nuestra hoja de ruta de productos.

Responsabilidades clave

  1. Ser responsable del diseño de racks, planificación de capacidad, distribución de energía, diseño de red, cableado y despliegue físico de las plataformas de computación de alto rendimiento de Etched en entornos de centros de datos y laboratorios de hardware.
  1. Diseñar y gestionar arquitecturas de distribución de energía y redundancia —desde las alimentaciones de la red eléctrica y las PDUs hasta los presupuestos de energía y refrigeración por rack— para despliegues de computación de IA de alta densidad que superan los 90 kW por rack.
  1. Colaborar con los equipos de infraestructura física y de instalaciones, así como con proveedores externos, para construir y gestionar laboratorios de hardware altamente sofisticados utilizados para el arranque, EVT y demostraciones para clientes.
  1. Asociarse con proveedores de co-ubicación y equipos internos para evaluar sitios, negociar contratos y hacer cumplir los Acuerdos de Nivel de Servicio (SLAs) en cuanto a energía, refrigeración, seguridad física y conectividad de red.
  1. Diseñar e implementar infraestructura de red de alta velocidad (100G/200G/400G Ethernet) que conecte nodos de computación, almacenamiento y peering ascendente, en coordinación con los equipos de ingeniería de red y plataforma.
  1. Desarrollar y mantener sistemas de gestión de activos, diagramas de racks y procesos de control de cambios para garantizar una visibilidad completa del estado de la infraestructura física en todo momento.
  1. Construir y operar sistemas de monitorización y alertas para la salud ambiental (temperatura, humedad, consumo de energía, estado de la UPS) y dirigir respuestas rápidas a incidentes de hardware e instalaciones.
  1. Definir y ejecutar programas de mantenimiento preventivo y procesos de ciclo de vida del hardware, incluida la coordinación de RMA con proveedores y reparaciones in situ.
  1. Liderar ciclos de planificación de capacidad en sintonía con la hoja de ruta de hardware, pronosticando las necesidades de energía, espacio y red con 6–18 meses de antelación y traduciendo esos pronósticos en acuerdos de instalaciones y planes de adquisición.
  1. Establecer y hacer cumplir procedimientos de seguridad física, políticas de control de acceso y pistas de auditoría en todos los sitios del centro de datos.

Requisitos mínimos

Puede que encajes si

  1. Tienes 5+ años de experiencia práctica en ingeniería u operaciones de centros de datos, con responsabilidad directa sobre el despliegue de hardware físico, arquitectura de energía y gestión de instalaciones.
  1. Has diseñado y desplegado entornos de computación de alta densidad (20 kW/rack y superiores) y tienes experiencia de primera mano gestionando los desafíos térmicos y de energía que conllevan.
  1. Te sientes muy cómodo/a con el cableado estructurado, la gestión de plantas de fibra y cobre, y el hardware de red de alta velocidad a escala.
  1. Puedes leer e interpretar diagramas unifilares eléctricos, planos de suelo técnico y de pasillo caliente/frío, y documentación de instalaciones de co-ubicación sin ayuda.
  1. Has construido u operado herramientas de monitorización y DCIM y consideras la visibilidad de la infraestructura como una propiedad no negociable de cualquier entorno que gestiones.
  1. Eres un/a gestor/a de proveedores sólido/a: sabes cómo redactar una RFP, realizar una evaluación competitiva y exigir el cumplimiento de los compromisos a un proveedor de co-locación o de hardware.
  1. Prosperas en entornos de ritmo rápido donde los requisitos cambian rápidamente y necesitas tomar decisiones seguras con información incompleta.
  1. Te impulsa la responsabilidad y te enorgulleces de entornos que son limpios, documentados y operativamente excelentes, no solo aquellos que están "en funcionamiento".

Los candidatos/as fuertes también pueden tener experiencia con

  1. Despliegue físico y puesta en marcha de plataformas de servidores personalizadas o semipersonalizadas, incluido hardware en fase inicial que no viene con soporte del proveedor.
  1. Sistemas de refrigeración líquida (refrigeración líquida directa, intercambiadores de calor de puerta trasera o refrigeración por inmersión) y los requisitos de las instalaciones que imponen.
  1. Entornos de clústeres de IA o HPC: clústeres de GPU o ASIC, tejidos de switches de alta valencia, redes RDMA.
  1. Scripting y automatización (Python, Bash, Ansible) para seguimiento de activos, integración de monitorización ambiental o flujos de trabajo operativos.
  1. Trabajar dentro de una startup de semiconductores o hardware, donde las hojas de ruta se comprimen y la infraestructura necesita seguir el ritmo del silicio.

Beneficios

  • Paquetes médicos, dentales y de visión con una generosa cobertura de primas.
  • Crédito de $500 al mes por renunciar a los beneficios médicos.
  • Subsidio de vivienda de $2,500 al mes para quienes vivan a poca distancia de la oficina.
  • Soporte de reubicación para quienes se muden a San José (Santana Row).
  • Varios beneficios de bienestar que cubren fitness, salud mental y más.
  • Almuerzo y cena diarios en nuestra oficina.
  • Presupuesto de cómputo ilimitado sujeto a justificación de ROI.

Cómo somos diferentes

Etched cree en la "Bitter Lesson" (Lección Amarga). Somos el primer sistema de IA de vanguardia centrado en la inferencia. Nuestro mercado objetivo es la totalidad de la inferencia, a diferencia de muchos de nuestros competidores.

Somos un equipo completamente presencial en San José (Santana Row), y valoramos enormemente las habilidades de ingeniería. No tenemos límites entre ingeniería e investigación, y esperamos que todo nuestro personal técnico contribuya a ambos y trabaje en diferentes disciplinas según sea necesario.

Más oportunidades con un solo perfil

¿Quieres optar a más puestos sin repetir todo el proceso? Crea tu perfil para que te encuentren las empresas que usan Nort.

Crear mi perfil

Tu próximo empleoya está buscándote.

Nort

Plataforma de reclutamiento inverso para programadores