Steampunk

Engenheiro Sênior de LLMOps

PythonAWSGCPDockerKubernetesTerraform
Tradução automática. Consulte o original.

Visão Geral

Estamos procurando um Engenheiro Sênior de LLMOps experiente para projetar, implementar e manter pipelines de modelos de linguagem grandes (LLM) em nível de produção, arquiteturas de implantação e sistemas de monitoramento em ambientes corporativos. O Engenheiro Sênior de LLMOps desempenhará um papel crítico na operacionalização de recursos de IA generativa, garantindo que aplicativos baseados em LLM sejam escaláveis, seguros, confiáveis e em conformidade com as estruturas emergentes de risco e governança de IA. Esta função abrange implantação de modelos, orquestração, avaliação, otimização e pipelines de Geração Aumentada por Recuperação (RAG).

Contribuições

  1. Arquitetar, construir e manter pipelines escaláveis de LLM e Geração Aumentada por Recuperação (RAG), incluindo hospedagem de modelos, otimização de inferência, camadas de recuperação e estruturas de gerenciamento de contexto.
  1. Liderar o projeto e a implementação de infraestrutura segura de GenAI em ambientes de nuvem, garantindo confiabilidade, desempenho, escalabilidade e eficiência de custos.
  1. Construir e gerenciar sistemas automatizados de avaliação que avaliam a qualidade da saída do LLM, segurança, latência e adesão aos requisitos de governança de IA.
  1. Desenvolver fluxos de trabalho de CI/CD adaptados para aplicativos baseados em LLM e GenAI, incluindo versionamento de conjuntos de dados, linhagem de modelos e testes automatizados de comportamentos de prompt e modelo.
  1. Colaborar com Engenheiros de Produto de IA e Cientistas de Dados para produzir protótipos baseados em LLM em sistemas manteníveis de nível corporativo.
  1. Integrar bancos de dados vetoriais, gateways de modelos, filtros de conteúdo e estruturas de guardrail em soluções completas de LLM e RAG.
  1. Implementar soluções de observabilidade e monitoramento que rastreiam métricas de desempenho, taxas de alucinação, perfis de custo e padrões de interação do usuário.
  1. Liderar a solução de problemas e a análise de causa raiz para problemas relacionados à implantação de LLM, desempenho de inferência, pipelines de recuperação ou confiabilidade geral do pipeline.
  1. Desenvolver e manter serviços, integrações e automação baseados em Python que suportam pipelines de LLM e RAG.
  1. Manter-se atualizado sobre arquiteturas emergentes de LLM, otimizações de inferência, técnicas de ajuste fino e padrões relevantes de MLSecOps.
  1. Garantir a conformidade com privacidade de dados, IA ética, segurança e estruturas de governança de IA em todo o projeto e operações de pipeline.
  1. Orientar engenheiros juniores e contribuir para as melhores práticas de engenharia de IA, ferramentas e padrões de infraestrutura reutilizáveis.

Você contribuirá para o crescimento de nossa Prática de Exploração de Dados e IA!

Qualificações

  1. Capacidade de obter e manter uma autorização de segurança do governo dos EUA.
  1. Bacharelado e 10+ anos de experiência total.
  1. 5+ anos de experiência em engenharia de software, engenharia de dados, MLOps ou engenharia de nuvem, com 2+ anos focados especificamente em operações de LLM ou GenAI.
  1. Experiência prática no projeto, construção e manutenção de pipelines de Geração Aumentada por Recuperação (RAG).
  1. Fluência em Python.
  1. Forte experiência em implantação de modelos usando frameworks como Hugging Face Transformers, vLLM, TensorRT-LLM ou similares.
  1. Experiência com ferramentas e frameworks operacionais como FastAPI, PyTorch, LangChain, LlamaIndex e bancos de dados vetoriais como FAISS, Milvus, Pinecone ou similares.
  1. Conhecimento avançado de plataformas de nuvem como AWS, Azure ou GCP, incluindo hospedagem de modelos, computação distribuída e padrões de rede segura.
  1. Experiência prática na construção de pipelines de CI/CD, frameworks de teste automatizados e provisionamento de ambiente para cargas de trabalho de IA/ML.
  1. Experiência com Docker, Kubernetes e ferramentas de infraestrutura como código como Terraform ou CloudFormation.
  1. Familiaridade com MLSecOps, governança de IA, endurecimento de modelos, defesas contra injeção de prompt e monitoramento de segurança de conteúdo.
  1. Forte compreensão de logging, observabilidade e profiling de desempenho para sistemas de inferência de LLM de alta taxa de transferência.
  1. Excelentes habilidades de comunicação escrita e verbal, com capacidade de explicar trade-offs e decisões arquiteturais para stakeholders técnicos e não técnicos.
  1. Capacidade comprovada de equilibrar o pensamento de plataforma de longo prazo com operações práticas e resolução rápida de problemas.
  1. Experiência em ambientes de desenvolvimento Ágil e uso de ferramentas modernas de gerenciamento de projetos.

Sobre steampunk

Steampunk depende de vários fatores para determinar o salário, incluindo, mas não se limitando a, localização geográfica, requisitos contratuais, educação, conhecimento, habilidades, competências e experiência. A faixa de remuneração projetada para esta posição é

$145,000 a $185,000. A estimativa exibida representa uma faixa salarial anual típica para esta posição. O salário anual é apenas um aspecto do pacote total de remuneração da Steampunk para os funcionários. Saiba mais sobre os benefícios adicionais da Steampunk aqui.

Declaração de Identidade

Como parte do processo de inscrição, espera-se que você esteja na câmera durante as entrevistas e avaliações. Reservamo-nos o direito de tirar sua foto para verificar sua identidade e prevenir fraudes.

Somos um empregador que oferece igualdade de oportunidades e todos os candidatos qualificados receberão consideração para emprego sem distinção de raça, cor, religião, sexo, origem nacional, deficiência, status de veterano protegido ou qualquer outra característica protegida por lei. Steampunk participa do programa E-Verify.

Steampunk é um Agente de Mudança na indústria de contratação Federal, trazendo novas ideias para clientes nos setores Homeland, Federal Civilian, Health e DoD. Através de nossa metodologia de entrega Human-Centered, estamos mudando fundamentalmente as expectativas que nossos clientes Federais têm de responsabilidade compartilhada real na solução de seus desafios de missão mais difíceis. Se você quiser saber mais sobre nossa história, visite steampunk.com.

Mais oportunidades com um só perfil

Quer aparecer para várias vagas sem repetir todo o processo? Crie seu perfil e seja encontrado pelas empresas que usam a Nort.

Criar meu perfil

Seu próximo empregojá está te procurando.

Nort

Plataforma de recrutamento reverso para programadores