Nebius

Ingeniero/a de Software Senior (Plataforma de Datos, C++)

PythonSQLKubernetesC++Go
Traducción automática. Consulta el original.

Sobre Nebius

Nebius está liderando una nueva era en infraestructura en la nube para la economía global de la IA. Estamos construyendo una plataforma de nube de IA full-stack que soporta a desarrolladores y empresas desde el entrenamiento de datos y modelos hasta el despliegue en producción, sin el coste y la complejidad de construir una gran infraestructura interna de IA/ML.

Construido por ingenieros, para ingenieros. Desde la orquestación de GPU a gran escala hasta la optimización de la inferencia, nos encargamos de los problemas difíciles en cómputo, almacenamiento, redes e IA aplicada.

Cotizamos en Nasdaq (NBIS) y tenemos nuestra sede en Ámsterdam, contamos con una presencia global con centros de I+D en Europa, Reino Unido, Norteamérica e Israel. Nuestro equipo de más de 1,500 incluye cientos de ingenieros con profunda experiencia en hardware, software e I+D de IA.

EL ROL

#LI-MM1

Buscamos un/a Ingeniero/a de Software con sólida experiencia en C++ para unirse al equipo que construye y opera la Plataforma de Datos de Nebius — una plataforma distribuida de almacenamiento y procesamiento que actúa como la "fuente de la verdad" de la empresa y la columna vertebral de muchos productos internos (y algunos externos).

La Plataforma de Datos de Nebius es un ecosistema multi-inquilino único basado en YTsaurus — en lugar de ejecutar sistemas separados de HDFS/Kafka/HBase, proporcionamos capacidades de almacenamiento, cómputo y análisis dentro de una sola plataforma.

Construida sobre el ecosistema de código abierto YTsaurus, ejecutamos y extendemos nuestra propia distribución de Nebius y desarrollamos una funcionalidad interna significativa (núcleo y nivel de plataforma). Podemos diseñar, implementar y lanzar funcionalidades de extremo a extremo en nuestros clústeres sin esperar aprobaciones externas y contribuir externamente cuando tiene sentido.

A gran escala hoy en día, esto incluye ~500 servidores, ~20k núcleos de CPU y ~10 PB de datos comprimidos en nuestro clúster de producción más grande, soportando cargas de trabajo que van desde pipelines críticos para el negocio y transacciones financieras hasta conjuntos de datos y cómputo de entrenamiento de ML/LLM a gran escala.

QUÉ HAY DENTRO DE LA PLATAFORMA

Trabajarás en un sistema que incluye (y une):

  1. Almacenamiento Distribuido (Cypress): semántica transaccional, almacenamiento por niveles, codificación de borrado, replicación y altas expectativas de fiabilidad.
  1. Cómputo y ETL: un planificador de trabajos a nivel de clúster (decenas de miles de núcleos), MapReduce, YQL para procesamiento de datos similar a SQL, y SPYT (Spark sobre YTsaurus) para ingeniería de datos moderna.
  1. Análisis interactivo (CHYT): instancias de ClickHouse® iniciadas directamente en nodos de cómputo para un rápido análisis SQL sobre datos in situ.
  1. Tablas Dinámicas: KV NoSQL de baja latencia con transacciones ACID distribuidas para cargas de trabajo tipo OLTP y almacenes de características.
  1. Orchestracto: orquestación de flujos de trabajo profundamente integrada con la plataforma (similar a Airflow, pero nativa de la plataforma).

¿Cómo es trabajar en Nebius?

Movimiento rápido - Pensamiento audaz - Crecimiento constante - Impacto significativo - Confianza y propiedad real - Oportunidad de dar forma al futuro de la IA

QUÉ HARÁS

Buscamos ingenieros que combinen sólidas habilidades de sistemas con sentido de producto: entender quién usa la plataforma, por qué ciertas capacidades son importantes y tomar decisiones pragmáticas para maximizar el impacto. En nuestro equipo, se espera que el trabajo de ingeniería esté conectado con usuarios y resultados reales — te alinearás regularmente con las partes interesadas internas, aclararás requisitos y ayudarás a impulsar la priorización.

En este rol, harás lo siguiente:

  1. Diseñar e implementar nueva funcionalidad en el núcleo de YTsaurus (C++) teniendo en cuenta la fiabilidad en producción.
  1. Construir y evolucionar capacidades a nivel de plataforma: arquitectura de plataforma y modelo operativo — crecimiento multi-clúster, primitivas compartidas y una experiencia consistente que escale con nuevos equipos y casos de uso.
  1. Mejorar la experiencia de plataforma de extremo a extremo para usuarios internos (y externos): APIs, salvaguardas, flujos de trabajo de depuración y automatización.
  1. Asegurar la calidad de producción: respuesta a incidentes / rotación de guardia, análisis de causa raíz y convertir los aprendizajes en correcciones duraderas.

PROYECTOS DE EJEMPLO

  1. Desplegar maestros de YTsaurus fragmentados (incluyendo soporte para el operador de Kubernetes) y construir un balanceo automático de metadatos entre las celdas maestras (grupos de consenso) para eliminar cuellos de botella en el plano de control y permitir un crecimiento del clúster de 10 a 100x.
  1. Hacer que el análisis interactivo de CHYT SQL sea más rápido y predecible con alta carga mediante trabajos de rendimiento como índices de salto de datos / estilo min-max y una mejor introspección de la ejecución.
  1. Convertir Orchestracto en un producto de plataforma definiendo los bloques de construcción, la experiencia del desarrollador y la gobernanza para que los equipos creen y compartan flujos de trabajo.
  1. Escalar y endurecer Parquet sobre S3 para cargas de trabajo nativas de YTsaurus abordando la replicación/movimiento, semántica de ciclo de vida consistente y optimizaciones del servidor maestro de metadatos para rendimiento y fiabilidad.
  1. Diseñar y entregar registros de auditoría completos y confiables para cambios de datos (quién/qué/cuándo) a través de rutas de almacenamiento y cómputo heterogéneas.

STACK TECNOLÓGICO

  1. Núcleo: C++ moderno (C++20, primitivas asíncronas + multihilo)
  1. Servicios y herramientas: Go y Python (microservicios, utilidades, pruebas de integración)

QUÉ ESPERAMOS

  1. 5+ años de experiencia en ingeniería de software.
  1. Sólidas habilidades en C++ (escribirás código principal).
  1. Conocimiento práctico de Python y/o Go (no tienes que ser un experto, pero deberías sentirte cómodo navegando por ellos).
  1. Experiencia desarrollando y/u operando servicios distribuidos de alta carga.
  1. Mentalidad de producción: capacidad para usar SSH, leer logs/métricas/trazas y depurar el comportamiento de sistemas distribuidos.
  1. Fundamentos sólidos de CS: algoritmos, estructuras de datos, conceptos básicos de concurrencia.

DESEABLE

  1. Experiencia con sistemas Big Data (ecosistemas tipo YTsaurus/Hadoop/Spark/ClickHouse/Kafka).
  1. Experiencia con plataformas multi-inquilino, planificadores, aislamiento de recursos, cuotas e ingeniería de fiabilidad.
  1. Sólidas habilidades de ingeniería de rendimiento (perfilado, contención de bloqueos, compensaciones de latencia/rendimiento).

Declaración de Igualdad de Oportunidades

Realizamos entrevistas de codificación como parte del proceso.

Nebius es un empleador que ofrece igualdad de oportunidades. Estamos comprometidos a fomentar un lugar de trabajo inclusivo y diverso y a proporcionar igualdad de oportunidades de empleo en todos los aspectos del empleo. No discriminamos por motivos de raza, color, religión, sexo (incluido el embarazo), origen nacional, ascendencia, edad, discapacidad, información genética, estado civil, condición de veterano, orientación sexual, identidad o expresión de género, o cualquier otra característica protegida por la ley aplicable.

Los/as solicitantes deben estar autorizados/as para trabajar en el país en el que solicitan y se les requerirá que proporcionen prueba de elegibilidad de empleo como condición de contratación.

Si necesita adaptaciones durante el proceso de solicitud, por favor háganoslo saber.

Beneficios y Ventajas

  • Compensación competitiva
  • Oportunidades de crecimiento profesional y aprendizaje
  • Flexibilidad y propiedad
  • Cultura colaborativa e innovadora
  • Oportunidad de trabajar en proyectos de IA de impacto
  • Entorno internacional y equipos talentosos

Más oportunidades con un solo perfil

¿Quieres optar a más puestos sin repetir todo el proceso? Crea tu perfil para que te encuentren las empresas que usan Nort.

Crear mi perfil

Tu próximo empleoya está buscándote.

Nort

Plataforma de reclutamiento inverso para programadores