Esri
DigitalOcean
Staff Engenheiro de Implantação, IA/ML
Sobre a oportunidade
Mergulhe e faça o melhor trabalho da sua carreira na DigitalOcean. Viaje junto com uma forte comunidade de talentos de ponta que são implacáveis em seu impulso para construir a nuvem escalável mais simples. Se você tem uma mentalidade de crescimento, naturalmente gosta de pensar grande e ousado, e se energiza com o ambiente acelerado de um verdadeiro disruptor da indústria, você encontrará seu lugar aqui. Valorizamos vencer juntos — enquanto aprendemos, nos divertimos e fazemos uma diferença profunda para os sonhadores e construtores do mundo.
Estamos procurando um(a) Staff Engenheiro(a) de Implantação (FDE) apaixonado(a) por operacionalizar cargas de trabalho de produção nativas de IA e agênticas em escala. Esta é uma função de alto impacto projetada para servir como a “ponta de lança técnica” para os clientes nativos de IA e iniciativas de plataforma mais estratégicas da DigitalOcean.
Como FDE, você operará na interseção de Engenharia de Produto, Infraestrutura de IA e Implementação de Clientes. Você fará uma parceria profunda com empresas estratégicas nativas de IA (ANEs), startups, fornecedores de infraestrutura e equipes de engenharia internas para implantar, otimizar e dimensionar sistemas de IA de produção na Nuvem Nativa de IA da DigitalOcean.
Esta função vai além da implantação tradicional de infraestrutura de GPU. Você trabalhará em Motores de Inferência, sistemas de runtime, frameworks de orquestração e aplicativos nativos de IA para ajudar os clientes a operacionalizar IA de produção e sistemas agênticos com forte foco em escalabilidade, confiabilidade, latência e economia de carga de trabalho.
Engenheiros FDE também atuam como o “primeiro cliente” para novas capacidades de plataforma nativas de IA. Você validará produtos sob cargas de trabalho do mundo real, apresentará insights operacionais e lacunas arquitetônicas, e ajudará a acelerar a maturidade do produto através de ciclos de feedback contínuos com as equipes de Engenharia de Produto e Pesquisa.
Você construirá frameworks de implantação escaláveis, sistemas de benchmarking, ferramentas de automação e kits de início de IA que transformam o aprendizado de campo em inteligência de plataforma reutilizável e padrões de implantação repetíveis em todo o ecossistema DigitalOcean.
Sua missão é acelerar a adoção em produção de sistemas nativos de IA enquanto ajuda a moldar o futuro da Nuvem Nativa de IA da DigitalOcean para a era da inferência e agêntica.
O QUE VOCÊ FARÁ
- Operacionalização Estratégica de Cargas de Trabalho de IA: Faça parceria com ANEs estratégicas e startups de IA para projetar, implantar, otimizar e dimensionar sistemas de IA e agênticos de produção na Nuvem Nativa de IA da DigitalOcean. Suporte a migrações complexas, PoCs prontas para produção, aceleração de implantação e expansão de carga de trabalho de longo prazo em plataformas de inferência e runtime.
- Desempenho de IA e Engenharia de Sistemas: Otimize o desempenho de inferência distribuída e runtime através de benchmarking, ajuste de eficiência de GPU, otimização de KV-cache, decodificação especulativa, dissociação de prefill/decode, implantações multi-nó e otimização de latência/custo.
- Validação de Plataforma e Aceleração de Produto: Atue como o “primeiro cliente” para as capacidades de plataforma nativas de IA da DigitalOcean, incluindo Motores de Inferência, runtimes, sistemas de orquestração, plataformas de GPU e fluxos de trabalho de implantação. Apresente insights operacionais do mundo real, lacunas arquitetônicas e gargalos de escalonamento diretamente para as equipes de Engenharia de Produto e Pesquisa.
- Inteligência de Plataforma e Automação: Construa ativos de implantação escaláveis, incluindo sistemas de benchmarking, ferramentas de automação, kits de início de IA, frameworks de implantação, playbooks operacionais, fluxos de trabalho de finetuning e arquiteturas de referência que melhoram a velocidade de implantação e a adoção da plataforma.
- Capacitação de Ecossistema e Técnica: Colabore com fornecedores de GPU, provedores de modelos, parceiros de infraestrutura e ISVs em co-desenvolvimento, validação técnica, otimização e prontidão para lançamento. Capacite equipes técnicas voltadas para o cliente e equipes parceiras através de padrões de implantação validados, insights de benchmarking, playbooks operacionais, arquiteturas de referência, demonstrações e orientação técnica que ajudem a escalar a adoção da plataforma nativa de IA da DigitalOcean.
- Viagens: Capacidade de viajar até 30% para engajamentos com clientes, workshops estratégicos presenciais, parcerias de ecossistema, conferências e colaboração interna.
MÉTRICAS PRINCIPAIS
- Adoção pelo Cliente e Sucesso em Produção: Medido por cargas de trabalho de produção de alto impacto lançadas, redução no tempo de produção, taxas de conversão de piloto para produção e expansão da adoção da plataforma nativa de IA em clientes estratégicos.
- Inteligência de Plataforma e Influência de Produto: Medido por melhorias de produto, influência no roadmap, hipóteses de clientes validadas e insights operacionais gerados a partir de implantações de produção do mundo real.
- Entrega de Ativos e Ferramentas: Medido através da adoção de frameworks construídos por FDE, ferramentas de automação, sistemas de benchmarking, playbooks operacionais e arquiteturas de referência em clientes e equipes internas.
- Capacitação de Campo e Escala do Ecossistema: Medido através da capacitação bem-sucedida de equipes voltadas para o cliente, resultados de colaboração do ecossistema e adoção de padrões de implantação FDE em todo o ecossistema nativo de IA.
O QUE VOCÊ AGREGARÁ À DIGITALOCEAN
- Expertise em Sistemas e Arquitetura Nativos de IA: Experiência em projetar e operacionalizar sistemas de IA de produção, incluindo cargas de trabalho de inferência, runtimes agênticos, frameworks de orquestração e aplicativos nativos de IA. Forte experiência prática com frameworks de inferência e serving como vLLM, SGLang, Ray Serve, NVIDIA Dynamo, llm-d, ou sistemas equivalentes, juntamente com técnicas de otimização LLM incluindo batching contínuo, quantização, otimização de KV-cache e decodificação especulativa.
- Domínio de Sistemas Distribuídos e Infraestrutura: Profundo conhecimento em plataformas NVIDIA e AMD GPU e seus ecossistemas de software, incluindo CUDA, ROCm, TensorRT, Triton, NCCL, RCCL, NVLink, XGMI e RoCE. Forte proficiência com Kubernetes (K8s), sistemas distribuídos, redes, sistemas de armazenamento, Infraestrutura como Código e arquiteturas de infraestrutura de IA em larga escala.
- Runtimes e Sistemas de Orquestração: Experiência com frameworks de orquestração de IA e agentes como LangGraph, CrewAI, ecossistemas MCP, LlamaIndex, OpenAI Agents SDK, ou sistemas de runtime similares. Compreensão de orquestração de fluxo de trabalho, sistemas de implantação, padrões de memória e arquiteturas de aplicativos nativos de IA.
- Engenharia de Software e Automação: Fortes habilidades de codificação de produção em Python ou Go com experiência na construção de ferramentas, sistemas de automação, fluxos de trabalho de implantação, frameworks de benchmarking e plataformas operacionais.
- Inteligência Operacional e de Desempenho: Capacidade comprovada de benchmark e otimizar infraestrutura de IA com forte foco em escalabilidade, confiabilidade, eficiência de GPU, desempenho de runtime, otimização de latência e economia de carga de trabalho.
- Execução Consultiva e Multifuncional: Capacidade de estabelecer credibilidade técnica com CTOs, arquitetos principais, equipes de Engenharia de Produto e parceiros do ecossistema, ao mesmo tempo em que gerencia implantações de produção de alto impacto e iniciativas técnicas estratégicas.
QUALIFICAÇÕES PREFERENCIAIS
- Experiência em Infraestrutura de IA e Engenharia de Implantação: Experiência trabalhando em Engenharia de Implantação, Infraestrutura de IA, Consultoria Técnica, Engenharia de Plataforma de IA ou funções de engenharia equivalentes voltadas para o cliente, apoiando sistemas de IA de produção.
- Capacitação de Plataforma e Experiência em Ecossistema: Experiência na construção de padrões de implantação, programas de capacitação técnica, frameworks de adoção de plataforma ou estratégias de integração de ecossistema entre organizações voltadas para o cliente e de engenharia.
- Envolvimento em Código Aberto e Ecossistema de IA: Contribuidor ativo para ecossistemas de IA, infraestrutura, orquestração ou ferramentas de desenvolvedor de código aberto.
- Colaboração com Fornecedores e Parcerias Estratégicas: Experiência em colaboração com fornecedores de GPU, provedores de infraestrutura, fornecedores de modelos ou parceiros do ecossistema em benchmarking, otimização, validação técnica ou iniciativas de prontidão para lançamento.
FAIXA DE COMPENSAÇÃO
- $220,000 - $239,000
*Esta é uma função híbrida
JR: 2026-7748
#LI-Hybrid
- A DigitalOcean é um empregador que oferece igualdade de oportunidades. Não discriminamos com base em raça, religião, cor, ancestralidade, origem nacional, casta, sexo, orientação sexual, gênero, identidade ou expressão de gênero, idade, deficiência, condição médica, gravidez, constituição genética, estado civil ou serviço militar.
Limite de Inscrição: Você pode se inscrever em um máximo de 3 posições em qualquer período de 180 dias. Esta política promove uma melhor correspondência entre função e candidato e incentiva inscrições ponderadas onde suas qualificações se alinham mais fortemente.
POR QUE VOCÊ VAI GOSTAR DE TRABALHAR NA DIGITALOCEAN
- Inovamos com propósito. Você fará parte de uma empresa de tecnologia de ponta com uma trajetória ascendente, que se orgulha de simplificar a nuvem e a IA para que os construtores possam gastar mais tempo criando software que muda o mundo. Como membro da equipe, você será um Tubarão que pensa grande, ousado e ágil, como um proprietário com viés para ação e um poderoso senso de responsabilidade por clientes, produtos, funcionários e decisões.
- Priorizamos o desenvolvimento de carreira. Na DO, você fará o melhor trabalho da sua carreira. Você trabalhará com algumas das pessoas mais inteligentes e interessantes da indústria. Somos uma organização de alto desempenho que sempre o desafiará a pensar grande. Nossa equipe de desenvolvimento organizacional fornecerá recursos para garantir que você continue crescendo. Fornecemos aos funcionários reembolso para conferências, treinamentos e educação relevantes. Todos os funcionários têm acesso a mais de 10,000 cursos do LinkedIn Learning para apoiar seu crescimento e desenvolvimento contínuos.
- Cuidamos do seu bem-estar. Independentemente da sua localização, forneceremos um conjunto competitivo de benefícios para apoiá-lo, desde nosso Programa de Assistência ao Empregado até Encontros Locais de Funcionários e política de tempo flexível, para citar alguns. Embora a filosofia em torno de nossos benefícios seja a mesma em todo o mundo, benefícios específicos podem variar de acordo com regulamentações e preferências locais.
- Recompensamos nossos funcionários. A faixa salarial para esta posição é baseada em dados de mercado, anos de experiência relevantes e habilidades. Você pode se qualificar para um bônus além do salário base; os valores do bônus são determinados com base no desempenho da empresa e individual. Também fornecemos remuneração em ações para funcionários elegíveis, incluindo concessões de ações na contratação e a opção de participar de nosso Programa de Compra de Ações para Funcionários.
