Launch Legends
Nebius
Senior Developer Advocate
Sobre
Nebius: Nebius está liderando uma nova era em infraestrutura de nuvem para a economia global de IA. Estamos construindo uma plataforma de nuvem de IA full-stack que suporta desenvolvedores e empresas, desde o treinamento de dados e modelos até a implantação em produção, sem o custo e a complexidade de construir uma grande infraestrutura interna de IA/ML. Construído por engenheiros, para engenheiros. Desde a orquestração de GPU em larga escala até a otimização de inferência, nós cuidamos dos problemas difíceis em computação, armazenamento, rede e IA aplicada. Listada na Nasdaq (NBIS) e sediada em Amsterdã, temos uma presença global com centros de P&D na Europa, Reino Unido, América do Norte e Israel. Nossa equipe de mais de 1,500 pessoas inclui centenas de engenheiros com profundo conhecimento em hardware, software e P&D de IA.
Baseado na área da Baía de São Francisco, ou disposto a se mudar.
#LI-LT1
Transparência Salarial
Oferecemos pacotes competitivos de remuneração e benefícios. A remuneração real será determinada com base em fatores relacionados ao trabalho, incluindo experiência, habilidades, qualificações, o nível em que o candidato for contratado e a localização geográfica, de acordo com a lei aplicável.
Faixa de Remuneração Base
$179,500—$224,300 USD
Declaração de Igualdade de Oportunidades
Nebius é um empregador que oferece igualdade de oportunidades. Estamos comprometidos em promover um ambiente de trabalho inclusivo e diversificado e em fornecer oportunidades de emprego iguais em todos os aspectos do emprego. Não discriminamos com base em raça, cor, religião, sexo (incluindo gravidez), origem nacional, ancestralidade, idade, deficiência, informações genéticas, estado civil, status de veterano, orientação sexual, identidade ou expressão de gênero, ou qualquer outra característica protegida pela lei aplicável.
Os candidatos devem ter autorização para trabalhar no país em que se candidatam e serão obrigados a fornecer prova de elegibilidade de emprego como condição de contratação.
Se você precisar de acomodações durante o processo de candidatura, por favor, nos informe.
A VAGA
Estamos procurando um Developer Advocate engenhoso e com recursos, que entenda de inferência, para ajudar desenvolvedores a executar modelos abertos em produção no Token Factory, a plataforma de inferência de alto desempenho da Nebius.
Todo agente, copiloto e produto de IA roda em uma camada de inferência, e os desenvolvedores que escolhem essa camada têm perguntas difíceis: Qual modelo aberto devo usar para esta etapa? Quanto custa por milhão de tokens com meu tráfego? Por que minha latência p99 está aumentando? Por que meu agente multi-turno fica mais lento e caro à medida que o contexto cresce? Quando devo mudar de um endpoint serverless para um dedicado, e quando o fine-tuning supera um prompt mais longo? Seu trabalho é ter respostas credíveis e práticas para essas perguntas, e mostrar o trabalho publicamente.
Você estará integrado à equipe de produto e engenharia do Token Factory em São Francisco. Você participará de suas reuniões diárias (standups) e sessões de correção de bugs (bug bashes), levará histórias de clientes de volta para eles e corrigirá lacunas na documentação você mesmo quando as encontrar.
Você se sentirá igualmente à vontade na comunidade nativa de IA da Bay Area: nos meetups que nossos clientes e parceiros organizam, e nos projetos de inferência de código aberto que os desenvolvedores realmente usam.
Esta é uma função prática, focada em construção. O conteúdo que importa aqui é menos "como chamar a API" e mais "aqui está como uma pilha de inferência em produção é montada, e aqui estão as compensações". Se você tem opiniões fortes sobre servir modelos abertos e quer uma plataforma para prová-las, esta função é para você.
Esta função está baseada na área da Baía de São Francisco. O centro de gravidade da equipe do Token Factory está em São Francisco e esperamos que esta pessoa faça parte da comunidade local presencialmente.
Como é trabalhar na Nebius:
Movimentação rápida - Pensamento ousado - Crescimento constante - Impacto significativo - Confiança e autonomia real - Oportunidade de moldar o futuro da IA
Suas responsabilidades incluirão:
- Ajudar desenvolvedores e equipes a descobrir, avaliar e adotar o Token Factory para cargas de trabalho de inferência em produção, desde uma primeira chamada de API em um endpoint serverless até endpoints dedicados e modelos ajustados (fine-tuned).
- Construir demonstrações, benchmarks e arquiteturas de referência que tornem as compensações reais concretas: qual modelo aberto usar para qual etapa, latência versus custo por token, como o crescimento do contexto afeta agentes multi-turno, confiabilidade da chamada de ferramentas e saídas estruturadas, e quando o fine-tuning ou um especulador customizado compensa em relação a um modelo maior ou um prompt mais longo.
- Mostrar como o Token Factory se encaixa na pilha que os desenvolvedores já usam: SDKs compatíveis com OpenAI, frameworks de agentes, MCP e uso de ferramentas, avaliações (evals), embeddings e recuperação (retrieval), e pós-treinamento.
- Estar integrado ao produto e engenharia do Token Factory: participar de reuniões diárias e sessões de correção de bugs, testar novos modelos e recursos antes do lançamento, e garantir que os exemplos e a documentação corretos existam no dia zero de cada lançamento.
- Ser o responsável pelo ciclo de feedback do desenvolvedor. Coletar o que está quebrando para os construtores, trazer isso como entrada concreta para o produto, e acompanhar até que seja lançado ou explicitamente recusado.
- Representar a Nebius na comunidade de inferência e modelos abertos da Bay Area: meetups, eventos de parceiros e clientes, comunidades de código aberto como vLLM, SGLang e Ray, e conferências de desenvolvedores.
- Publicar conteúdo técnico e dar palestras que levem os desenvolvedores de ouvir falar sobre o Token Factory a executar algo nele, e fazer parceria com o marketing para transformar histórias reais de construtores em estudos de caso.
- Trabalhar em estreita colaboração com a equipe de DevRel e a equipe de marketing de produto do Token Factory em lançamentos, programas comunitários e estratégia de conteúdo.
Requisitos mínimos
Esperamos que você tenha:
- Experiência prática em executar modelos abertos em produção ou em escala através de um provedor de inferência ou uma pilha de serviço, com um ponto de vista claro sobre como você o escolheu e o que deu errado. Se você ainda não experimentou o Token Factory, esperamos que o tenha feito antes de conversarmos.
- Um entendimento funcional do que acontece nos bastidores de um motor de serviço como vLLM ou SGLang: batching contínuo, cache KV e de prefixo, quantização, decodificação especulativa, e como cada um deles afeta a latência e o custo. Você não vai otimizar isso no Token Factory, mas precisa se manter firme com os engenheiros que o fazem.
- Conhecimento atual e de primeira mão do ecossistema de modelos abertos, incluindo quais modelos valem a pena recomendar para quais cargas de trabalho e por quê.
- Conforto em escrever e revisar código, reproduzir problemas e enviar correções para documentação e exemplos você mesmo.
- Um histórico de construção e explicação pública: palestras, contribuições para código aberto, escrita ou uma presença técnica ativa no GitHub, X ou LinkedIn. Um título de DevRel não é necessário.
- A capacidade de explicar sistemas complexos claramente para públicos técnicos e não técnicos, e de ser um parceiro técnico credível para engenheiros, gerentes de produto e clientes.
- Baseado na área da Baía de São Francisco, ou disposto a se mudar.
Candidatos que vêm de engenharia de implantação avançada (forward-deployed engineering), arquitetura de soluções, engenharia de ML ou funções de produto técnico são fortemente encorajados a se candidatar.
É um bônus se você tiver:
- Experiência prática com fine-tuning supervisionado, destilação ou pós-treinamento RL de modelos abertos, e uma opinião sobre quando isso supera um prompt mais longo ou um modelo maior.
- Contribuições para projetos de inferência ou computação distribuída de código aberto, como vLLM, SGLang ou Ray.
- Experiência em um provedor de nuvem de inferência ou GPU, ou como um usuário intensivo de vários deles.
- Uma audiência existente que confia em suas opiniões sobre modelos e infraestrutura.
Benefícios chave para funcionários nos EUA:
- Seguro saúde: 100% de cobertura médica, odontológica e oftalmológica paga pela empresa para funcionários e famílias.
- Plano 401(k): Até 4% de contrapartida da empresa com vesting imediato.
- Licença parental: 20 semanas pagas para cuidadores primários, 12 semanas para cuidadores secundários.
- Reembolso de trabalho remoto: Até $85/mês para celular e internet.
- Seguro contra invalidez e de vida: Cobertura de seguro de curto prazo, longo prazo e de vida paga pela empresa.
Benefícios e Vantagens
- Remuneração competitiva
- Oportunidades de crescimento e aprendizado na carreira
- Flexibilidade e autonomia
- Cultura colaborativa e inovadora
- Oportunidade de trabalhar em projetos de IA impactantes
- Ambiente internacional e equipes talentosas
