ComTec Solutions LLC
DigitalOcean
Staff Engenheiro de Implantação Avançada, IA/ML
Sobre a oportunidade
Mergulhe e faça o melhor trabalho da sua carreira na DigitalOcean. Viaje junto com uma forte comunidade de talentos de ponta que são implacáveis em seu impulso para construir a nuvem escalável mais simples. Se você tem uma mentalidade de crescimento, naturalmente gosta de pensar grande e ousado, e se energiza com o ambiente acelerado de um verdadeiro disruptor da indústria, você encontrará seu lugar aqui. Valorizamos vencer juntos — enquanto aprendemos, nos divertimos e fazemos uma diferença profunda para os sonhadores e construtores do mundo.
Estamos procurando um Staff Engenheiro de Implantação Avançada (FDE) apaixonado por operacionalizar cargas de trabalho de produção nativas de IA e agênticas em escala. Esta é uma função de alto impacto projetada para servir como a “ponta de lança técnica” para os clientes nativos de IA e iniciativas de plataforma mais estratégicas da DigitalOcean.
Como FDE, você operará na interseção de Engenharia de Produto, Infraestrutura de IA e Implementação de Clientes. Você fará parcerias profundas com empresas estratégicas nativas de IA (ANE), startups, fornecedores de infraestrutura e equipes de engenharia internas para implantar, otimizar e escalar sistemas de IA de produção na Nuvem Nativa de IA da DigitalOcean.
Esta função se estende além da implantação tradicional de infraestrutura de GPU. Você trabalhará em Motores de Inferência, sistemas de runtime, frameworks de orquestração e aplicativos nativos de IA para ajudar os clientes a operacionalizar IA de produção e sistemas agênticos com forte foco em escalabilidade, confiabilidade, latência e economia de carga de trabalho.
Engenheiros FDE também atuam como o “primeiro cliente” para novas capacidades de plataforma nativas de IA. Você validará produtos sob cargas de trabalho do mundo real, apresentará insights operacionais e lacunas arquitetônicas, e ajudará a acelerar a maturidade do produto por meio de loops de feedback contínuos com as equipes de Engenharia de Produto e Pesquisa.
Você construirá frameworks de implantação escaláveis, sistemas de benchmarking, ferramentas de automação e kits de início de IA que transformam o aprendizado de campo em inteligência de plataforma reutilizável e padrões de implantação repetíveis em todo o ecossistema DigitalOcean.
Sua missão é acelerar a adoção de produção de sistemas nativos de IA enquanto ajuda a moldar o futuro da Nuvem Nativa de IA da DigitalOcean para a era de inferência e agêntica.
O QUE VOCÊ FARÁ *
- Operacionalização Estratégica de Cargas de Trabalho de IA: Faça parceria com ANEs estratégicas e startups de IA para arquitetar, implantar, otimizar e escalar sistemas de IA e agênticos de produção na Nuvem Nativa de IA da DigitalOcean. Suporte a migrações complexas, PoCs prontas para produção, aceleração de implantação e expansão de carga de trabalho de longo prazo em plataformas de inferência e runtime. *
- Engenharia de Desempenho e Sistemas de IA: Otimize o desempenho de inferência distribuída e runtime por meio de benchmarking, ajuste de eficiência de GPU, otimização de cache KV, decodificação especulativa, desagregação de prefill/decode, implantações multi-nó e otimização de latência/custo. *
- Validação de Plataforma e Aceleração de Produto: Atue como o “primeiro cliente” para as capacidades de plataforma nativas de IA da DigitalOcean, incluindo Motores de Inferência, runtimes, sistemas de orquestração, plataformas de GPU e fluxos de trabalho de implantação. Apresente insights operacionais do mundo real, lacunas arquitetônicas e gargalos de escalonamento diretamente para as equipes de Engenharia de Produto e Pesquisa. *
- Inteligência de Plataforma e Automação: Construa ativos de implantação escaláveis, incluindo sistemas de benchmarking, ferramentas de automação, kits de início de IA, frameworks de implantação, playbooks operacionais, fluxos de trabalho de ajuste fino e arquiteturas de referência que melhoram a velocidade de implantação e a adoção da plataforma. *
- Habilitação de Ecossistema e Técnica: Colabore com fornecedores de GPU, provedores de modelos, parceiros de infraestrutura e ISVs em co-desenvolvimento, validação técnica, otimização e prontidão de lançamento. Capacite equipes técnicas voltadas para o cliente e equipes parceiras por meio de padrões de implantação validados, insights de benchmarking, playbooks operacionais, arquiteturas de referência, demonstrações e orientação técnica que ajudem a escalar a adoção da plataforma nativa de IA da DigitalOcean. *
- Viagens: Capacidade de viajar até 30% para engajamentos de clientes, workshops estratégicos presenciais, parcerias de ecossistema, conferências e colaboração interna.
MÉTRICAS PRINCIPAIS *
- Adoção pelo Cliente e Sucesso na Produção: Medido por cargas de trabalho de produção de alto impacto lançadas, redução no tempo de produção, taxas de conversão de piloto para produção e expansão da adoção da plataforma nativa de IA em clientes estratégicos. *
- Inteligência de Plataforma e Influência de Produto: Medido por melhorias de produto, influência no roadmap, hipóteses de clientes validadas e insights operacionais gerados a partir de implantações de produção do mundo real. *
- Entrega de Ativos e Ferramentas: Medido pela adoção de frameworks criados por FDE, ferramentas de automação, sistemas de benchmarking, playbooks operacionais e arquiteturas de referência em clientes e equipes internas. *
- Habilitação de Campo e Escala de Ecossistema: Medido por habilitação bem-sucedida de equipes voltadas para o cliente, resultados de colaboração de ecossistema e adoção de padrões de implantação de FDE em todo o ecossistema nativo de IA.
O QUE VOCÊ AGREGARÁ À DIGITALOCEAN *
- Expertise em Sistemas e Arquitetura Nativos de IA: Experiência em projetar e operacionalizar sistemas de IA de produção, incluindo cargas de trabalho de inferência, runtimes agênticos, frameworks de orquestração e aplicativos nativos de IA. Forte experiência prática com frameworks de inferência e serving como vLLM, SGLang, Ray Serve, NVIDIA Dynamo, llm-d, ou sistemas equivalentes, juntamente com técnicas de otimização de LLM, incluindo batching contínuo, quantização, otimização de cache KV e decodificação especulativa. *
- Domínio de Sistemas Distribuídos e Infraestrutura: Profundo conhecimento de plataformas de GPU NVIDIA e AMD e seus ecossistemas de software, incluindo CUDA, ROCm, TensorRT, Triton, NCCL, RCCL, NVLink, XGMI e RoCE. Forte proficiência com Kubernetes (K8s), sistemas distribuídos, redes, sistemas de armazenamento, Infraestrutura como Código e arquiteturas de infraestrutura de IA em larga escala. *
- Runtimes e Sistemas de Orquestração: Experiência com orquestração de IA e frameworks de agentes como LangGraph, CrewAI, ecossistemas MCP, LlamaIndex, OpenAI Agents SDK, ou sistemas de runtime semelhantes. Compreensão de orquestração de fluxo de trabalho, sistemas de implantação, padrões de memória e arquiteturas de aplicativos nativos de IA. *
- Engenharia de Software e Automação: Fortes habilidades de codificação de produção em Python ou Go com experiência na construção de ferramentas, sistemas de automação, fluxos de trabalho de implantação, frameworks de benchmarking e plataformas operacionais. *
- Desempenho e Inteligência Operacional: Capacidade comprovada de benchmark e otimizar infraestrutura de IA com forte foco em escalabilidade, confiabilidade, eficiência de GPU, desempenho de runtime, otimização de latência e economia de carga de trabalho. *
- Execução Consultiva e Multifuncional: Capacidade de estabelecer credibilidade técnica com CTOs, arquitetos principais, equipes de Engenharia de Produto e parceiros de ecossistema, ao mesmo tempo em que gerencia implantações de produção de alto impacto e iniciativas técnicas estratégicas.
QUALIFICAÇÕES PREFERENCIAIS *
- Experiência em Infraestrutura de IA e Engenharia de Implantação Avançada: Experiência trabalhando em Engenharia de Implantação Avançada, Infraestrutura de IA, Consultoria Técnica, Engenharia de Plataforma de IA ou funções de engenharia equivalentes voltadas para o cliente, apoiando sistemas de IA de produção. *
- Experiência em Habilitação de Plataforma e Ecossistema: Experiência na construção de padrões de implantação, programas de habilitação técnica, frameworks de adoção de plataforma ou estratégias de integração de ecossistema entre organizações voltadas para o cliente e de engenharia. *
- Envolvimento em Código Aberto e Ecossistema de IA: Contribuidor ativo para ecossistemas de IA, infraestrutura, orquestração ou ferramentas de desenvolvedor de código aberto. *
- Colaboração com Fornecedores e Parcerias Estratégicas: Experiência em colaboração com fornecedores de GPU, provedores de infraestrutura, fornecedores de modelos ou parceiros de ecossistema em benchmarking, otimização, validação técnica ou iniciativas de prontidão de lançamento.
FAIXA DE COMPENSAÇÃO: *
- $220,000 - $239,000
*Esta é uma função remota
JR: 2026-7748
#LI-Remote
- DigitalOcean é um empregador que oferece igualdade de oportunidades. Não discriminamos com base em raça, religião, cor, ancestralidade, origem nacional, casta, sexo, orientação sexual, gênero, identidade ou expressão de gênero, idade, deficiência, condição médica, gravidez, constituição genética, estado civil ou serviço militar.
Limite de Candidatura: Você pode se candidatar a um máximo de 3 posições em qualquer período de 180 dias. Esta política promove uma melhor correspondência candidato-vaga e incentiva candidaturas ponderadas onde suas qualificações se alinham mais fortemente.
POR QUE VOCÊ VAI GOSTAR DE TRABALHAR PARA A DIGITALOCEAN *
- Nós inovamos com propósito. Você fará parte de uma empresa de tecnologia de ponta com uma trajetória ascendente, que se orgulha de simplificar a nuvem e a IA para que os construtores possam gastar mais tempo criando software que muda o mundo. Como membro da equipe, você será um Tubarão que pensa grande, ousado e ágil, como um proprietário com viés para ação e um forte senso de responsabilidade por clientes, produtos, funcionários e decisões. *
- Priorizamos o desenvolvimento de carreira. Na DO, você fará o melhor trabalho da sua carreira. Você trabalhará com algumas das pessoas mais inteligentes e interessantes da indústria. Somos uma organização de alto desempenho que sempre o desafiará a pensar grande. Nossa equipe de desenvolvimento organizacional fornecerá recursos para garantir que você continue crescendo. Oferecemos aos funcionários reembolso para conferências, treinamentos e educação relevantes. Todos os funcionários têm acesso a mais de 10,000 cursos da LinkedIn Learning para apoiar seu crescimento e desenvolvimento contínuos. *
- Nós nos preocupamos com o seu bem-estar. Independentemente da sua localização, forneceremos um conjunto competitivo de benefícios para apoiá-lo, desde nosso Programa de Assistência ao Empregado até Encontros Locais de Funcionários e política de tempo flexível, para citar alguns. Embora a filosofia em torno de nossos benefícios seja a mesma em todo o mundo, benefícios específicos podem variar de acordo com regulamentações e preferências locais. *
- Recompensamos nossos funcionários. A faixa salarial para esta posição é baseada em dados de mercado, anos relevantes de experiência e habilidades. Você pode se qualificar para um bônus além do salário base; os valores do bônus são determinados com base no desempenho da empresa e individual. Também fornecemos remuneração em ações para funcionários elegíveis, incluindo concessões de ações na contratação e a opção de participar de nosso Programa de Compra de Ações para Funcionários. *
