Nebius

Senior Developer Advocate

Traducción automática. Consulta el original.

Acerca de

Nebius: Nebius está liderando una nueva era en la infraestructura de la nube para la economía global de la IA. Estamos construyendo una plataforma de nube de IA full-stack que soporta a desarrolladores y empresas desde el entrenamiento de datos y modelos hasta el despliegue en producción, sin el coste y la complejidad de construir una infraestructura interna de IA/ML. Construida por ingenieros, para ingenieros. Desde la orquestación de GPU a gran escala hasta la optimización de la inferencia, nos encargamos de los problemas difíciles en cómputo, almacenamiento, redes e IA aplicada. Cotizada en Nasdaq (NBIS) y con sede en Ámsterdam, tenemos una presencia global con centros de I+D en Europa, Reino Unido, Norteamérica e Israel. Nuestro equipo de más de 1,500 incluye cientos de ingenieros con profunda experiencia en hardware, software e I+D de IA.

Con base en el Área de la Bahía de San Francisco, o dispuesto a reubicarse.

#LI-LT1

Transparencia salarial

Ofrecemos paquetes competitivos de compensación y beneficios. La compensación real se determinará en función de factores relacionados con el puesto, incluida la experiencia, las habilidades, las cualificaciones, el nivel en el que se contrate al candidato y la ubicación geográfica, de conformidad con la legislación aplicable.

Rango de Compensación Base

$179,500—$224,300 USD

Declaración de Igualdad de Oportunidades

Nebius es un empleador que ofrece igualdad de oportunidades. Estamos comprometidos a fomentar un lugar de trabajo inclusivo y diverso y a proporcionar igualdad de oportunidades de empleo en todos los aspectos del empleo. No discriminamos por motivos de raza, color, religión, sexo (incluido el embarazo), origen nacional, ascendencia, edad, discapacidad, información genética, estado civil, condición de veterano, orientación sexual, identidad o expresión de género, o cualquier otra característica protegida por la ley aplicable.

Los solicitantes deben estar autorizados para trabajar en el país en el que solicitan y se les pedirá que proporcionen prueba de elegibilidad de empleo como condición de contratación.

Si necesita adaptaciones durante el proceso de solicitud, por favor háganoslo saber.

EL ROL

Buscamos un Developer Advocate ingenioso y resolutivo que entienda de inferencia para ayudar a los desarrolladores a ejecutar modelos abiertos en producción en Token Factory, la plataforma de inferencia de alto rendimiento de Nebius.

Cada agente, copilot y producto de IA se ejecuta en una capa de inferencia, y los desarrolladores que eligen esa capa tienen preguntas difíciles: ¿Qué modelo abierto debería ejecutar para este paso? ¿Cuánto cuesta por millón de tokens con mi tráfico? ¿Por qué mi latencia p99 se dispara? ¿Por qué mi agente multi-turno se vuelve más lento y caro a medida que crece el contexto? ¿Cuándo paso de un endpoint sin servidor a uno dedicado, y cuándo el ajuste fino supera a un prompt más largo? Tu trabajo es tener respuestas creíbles y prácticas a esas preguntas, y mostrar el trabajo públicamente.

Estarás integrado en el equipo de producto e ingeniería de Token Factory en San Francisco. Participarás en sus reuniones diarias y sesiones de resolución de errores, les transmitirás las historias de los clientes y arreglarás las lagunas en la documentación tú mismo cuando las encuentres.

Te sentirás igualmente cómodo en la comunidad nativa de IA del Área de la Bahía: los meetups que organizan nuestros clientes y socios, y los proyectos de inferencia de código abierto que los desarrolladores realmente utilizan.

Este es un rol práctico y centrado en el constructor. El contenido que importa aquí es menos "cómo llamar a la API" y más "aquí se explica cómo se monta una pila de inferencia en producción y cuáles son los compromisos". Si tienes fuertes opiniones sobre el servicio de modelos abiertos y quieres una plataforma para demostrarlas, este rol es para ti.

Este rol se basa en el Área de la Bahía de San Francisco. El centro de gravedad del equipo de Token Factory está en San Francisco y esperamos que esta persona forme parte de la comunidad local en persona.

¿Cómo es trabajar en Nebius:

Movimiento rápido - Pensamiento audaz - Crecimiento constante - Impacto significativo - Confianza y propiedad real - Oportunidad de dar forma al futuro de la IA

Tus responsabilidades incluirán:

  1. Ayudar a los desarrolladores y equipos a descubrir, evaluar y adoptar Token Factory para cargas de trabajo de inferencia en producción, desde una primera llamada a la API en un endpoint sin servidor hasta endpoints dedicados y modelos ajustados.
  1. Crear demos, benchmarks y arquitecturas de referencia que hagan concretos los compromisos reales: qué modelo abierto usar para cada paso, latencia frente a coste por token, cómo el crecimiento del contexto afecta a los agentes multi-turno, fiabilidad de la llamada a herramientas y salidas estructuradas, y cuándo el ajuste fino o un especulador personalizado compensan frente a un modelo más grande o un prompt más largo.
  1. Mostrar cómo Token Factory encaja en la pila que los desarrolladores ya utilizan: SDKs compatibles con OpenAI, frameworks de agentes, uso de MCP y herramientas, evaluaciones, embeddings y recuperación, y post-entrenamiento.
  1. Estar integrado con el producto y la ingeniería de Token Factory: unirse a las reuniones diarias y sesiones de resolución de errores, probar nuevos modelos y características antes del lanzamiento, y asegurarse de que las muestras y la documentación correctas existan desde el primer día de cada lanzamiento.
  1. Ser el responsable del bucle de retroalimentación del desarrollador. Recopilar lo que está fallando para los constructores, llevarlo de vuelta como entrada concreta del producto y hacer seguimiento hasta que se envíe o se rechace explícitamente.
  1. Representar a Nebius en la comunidad de inferencia y modelos abiertos del Área de la Bahía: meetups, eventos de socios y clientes, comunidades de código abierto como vLLM, SGLang y Ray, y conferencias de desarrolladores.
  1. Publicar contenido técnico y dar charlas que lleven a los desarrolladores desde la primera vez que oyen hablar de Token Factory hasta ejecutar algo en él, y colaborar con marketing para convertir historias reales de constructores en estudios de caso.
  1. Trabajar estrechamente con el equipo de DevRel y el equipo de marketing de producto de Token Factory en lanzamientos, programas comunitarios y estrategia de contenido.

Requisitos mínimos

Esperamos que tengas:

  1. Experiencia práctica en la ejecución de modelos abiertos en producción o a escala a través de un proveedor de inferencia o una pila de servicio, con un punto de vista claro sobre cómo lo elegiste y qué falló. Si aún no has probado Token Factory, esperamos que lo hayas hecho antes de que hablemos.
  1. Un entendimiento funcional de lo que sucede bajo el capó de un motor de servicio como vLLM o SGLang: batching continuo, caché KV y de prefijo, cuantización, decodificación especulativa, y cómo cada uno se manifiesta en latencia y coste. No estarás ajustando estos en Token Factory, pero necesitas mantener tu nivel con los ingenieros que lo hacen.
  1. Conocimiento actual y de primera mano del ecosistema de modelos abiertos, incluyendo qué modelos merecen la pena recomendar para qué cargas de trabajo y por qué.
  1. Comodidad escribiendo y revisando código, reproduciendo problemas y enviando correcciones a la documentación y ejemplos tú mismo.
  1. Un historial de construcción y explicación pública: charlas, contribuciones a código abierto, escritura o una presencia técnica activa en GitHub, X o LinkedIn. No se requiere un título de DevRel.
  1. La capacidad de explicar sistemas complejos claramente a audiencias técnicas y no técnicas, y de ser un socio técnico creíble para ingenieros, gerentes de producto y clientes.
  1. Con base en el Área de la Bahía de San Francisco, o dispuesto a reubicarse.

Se anima encarecidamente a los candidatos que provienen de roles de ingeniería desplegada, arquitectura de soluciones, ingeniería de ML o roles técnicos de producto a postularse.

Es una ventaja si tienes:

  1. Experiencia práctica con ajuste fino supervisado, destilación o post-entrenamiento RL de modelos abiertos, y una opinión sobre cuándo supera a un prompt más largo o a un modelo más grande.
  1. Contribuciones a proyectos de código abierto de inferencia o cómputo distribuido como vLLM, SGLang o Ray.
  1. Experiencia en un proveedor de nube de inferencia o GPU, o como usuario intensivo de varios.
  1. Una audiencia existente que confía en tus opiniones sobre modelos e infraestructura.

Beneficios clave para empleados en EE. UU.:

  • Seguro médico: Cobertura médica, dental y de visión pagada al 100%% por la empresa para empleados y familias.
  • Plan 401(k): Hasta un 4%% de igualación por parte de la empresa con vesting inmediato.
  • Permiso parental: 20 semanas pagadas para cuidadores principales, 12 semanas para cuidadores secundarios.
  • Reembolso de trabajo remoto: Hasta $85/mes para telefonía e internet.
  • Seguro de incapacidad y de vida: Cobertura de seguro a corto plazo, a largo plazo y de vida pagada por la empresa.

Beneficios y Ventajas

  • Compensación competitiva
  • Oportunidades de crecimiento profesional y aprendizaje
  • Flexibilidad y propiedad
  • Cultura colaborativa e innovadora
  • Oportunidad de trabajar en proyectos de IA de impacto
  • Entorno internacional y equipos talentosos

Más oportunidades con un solo perfil

¿Quieres optar a más puestos sin repetir todo el proceso? Crea tu perfil para que te encuentren las empresas que usan Nort.

Crear mi perfil

Tu próximo empleoya está buscándote.

Nort

Plataforma de reclutamiento inverso para programadores