Nominal
Deepgram
Engenheiro(a) de Plataforma - Infraestrutura de IA/ML (Kubernetes & Terraform)
Sobre a Empresa
Deepgram é a plataforma líder que sustenta a emergente economia de IA de Voz de trilhões de dólares, fornecendo APIs em tempo real para speech-to-text (STT), text-to-speech (TTS) e para a construção de agentes de voz em escala de produção. Mais de 200,000 desenvolvedores e 1,300+ organizações criam ofertas de voz que são ‘Powered by Deepgram’, incluindo Twilio, Cloudflare, Sierra, Decagon, Vapi, Daily, Cresta, Granola e Jack in the Box. A base de modelos de voz nativa da Deepgram é acessada através de APIs na nuvem ou como software auto-hospedado e on-premises, com precisão inigualável, baixa latência e eficiência de custo. Apoiada por um recente Series C liderado por investidores globais líderes e parceiros estratégicos, a Deepgram processou mais de 50,000 anos de áudio e transcreveu mais de 1 trilhões de palavras. Não há organização no mundo que entenda de voz melhor do que a Deepgram.
Ritmo Operacional da Empresa
Na Deepgram, esperamos uma mentalidade orientada por IA — o uso e o conforto com IA não são opcionais, são centrais para como operamos, inovamos e medimos o desempenho.
Espera-se que cada membro da equipe que trabalha na Deepgram use e experimente ativamente ferramentas avançadas de IA, e até mesmo construa suas próprias em seu trabalho diário. Medimos a eficácia com que a IA é aplicada para entregar resultados, e o uso consistente e criativo das mais recentes capacidades de IA é fundamental para o sucesso aqui. Os candidatos devem se sentir confortáveis em adotar novos modelos e modos rapidamente, integrando IA em seus fluxos de trabalho e expandindo continuamente os limites do que essas tecnologias podem fazer.
Além disso, nos movemos no ritmo da IA. A mudança é rápida, e você pode esperar que seu trabalho diário evolua tão rapidamente. Este pode não ser o papel certo se você não estiver animado para experimentar, adaptar, pensar rapidamente e aprender constantemente, ou se estiver buscando algo altamente prescritivo com um ritmo tradicional de 9 para 5.
Oportunidade
Estamos procurando um(a) Engenheiro(a) de Plataforma experiente para construir e operar a base de infraestrutura híbrida para nossa pesquisa avançada de IA/ML e desenvolvimento de produtos. Você irá projetar, construir e executar a plataforma que abrange AWS e nossos data centers bare metal, capacitando nossas equipes a treinar e implantar modelos complexos em escala. Este papel foca na criação de um ambiente robusto e de autoatendimento usando Kubernetes, AWS e Infraestrutura como Código (Terraform), e orquestrando cargas de trabalho de GPU de alta demanda usando agendadores como Slurm.
O Que Você Fará
- Projetar e manter nossa plataforma de computação principal usando Kubernetes na AWS e on-premise, fornecendo um ambiente estável e escalável para todas as aplicações e serviços.
- Desenvolver e gerenciar toda a nossa infraestrutura usando princípios de Infraestrutura como Código (IaC) com Terraform, garantindo que nossos ambientes sejam reproduzíveis, versionados e automatizados.
- Projetar, construir e otimizar nossos sistemas de agendamento e orquestração de jobs de IA/ML, integrando Slurm com nossos clusters Kubernetes para gerenciar eficientemente recursos de GPU.
- Provisionar, gerenciar e manter nossa infraestrutura de servidores bare metal on-premise para computação de GPU de alta performance.
- Implementar e gerenciar as soluções de rede (CNI, service mesh) e armazenamento (CSI, S3) da plataforma para suportar cargas de trabalho de alta taxa de transferência e baixa latência em ambientes híbridos.
- Desenvolver uma pilha de observabilidade abrangente (monitoramento, logging, tracing) para garantir a saúde da plataforma e criar automação para tarefas operacionais, resposta a incidentes e ajuste de performance.
- Colaborar com pesquisadores de IA e engenheiros de ML para entender suas necessidades de infraestrutura e construir as ferramentas e fluxos de trabalho que aceleram seu ciclo de desenvolvimento.
- Automatizar o ciclo de vida de implantações gerenciadas de tenant único
Você Vai Amar Este Papel Se
- For apaixonado por construir plataformas que capacitam desenvolvedores e pesquisadores.
- Gostar de criar soluções elegantes e automatizadas para desafios complexos de infraestrutura em ambientes de nuvem e data center.
- Se destacar na otimização de infraestrutura híbrida para performance, custo e confiabilidade.
- Estiver animado para trabalhar na interseção da engenharia de plataforma moderna e IA de ponta.
- Gostar de tratar a infraestrutura como um produto, melhorando continuamente a experiência do desenvolvedor.
Seria Ótimo Se Você Tivesse
- Experiência com agendadores de jobs de computação de alta performance (HPC), especificamente Slurm, para gerenciar cargas de trabalho de IA intensivas em GPU.
- Experiência no gerenciamento de infraestrutura bare metal, incluindo provisionamento de servidores (por exemplo, boot PXE, MAAS), configuração e gerenciamento de ciclo de vida.
- Familiaridade com princípios de FinOps e estratégias de otimização de custos na nuvem.
- Conhecimento de soluções de rede (por exemplo, Calico, Cilium) e armazenamento (por exemplo, Ceph, Rook) em Kubernetes.
- Experiência em um ambiente multi-região ou nuvem híbrida.
É Importante Para Nós Que Você Tenha
- 5+ anos de experiência em Engenharia de Plataforma, DevOps ou Engenharia de Confiabilidade de Site (SRE).
- Experiência comprovada e prática na construção e gerenciamento de infraestrutura de produção com Terraform.
- Conhecimento de nível especialista em arquitetura e operações de Kubernetes em um ambiente de larga escala.
- Fortes habilidades de scripting e automação (por exemplo, Python, Go, Bash).
- Experiência com sistemas de CI/CD (por exemplo, GitLab CI, Jenkins, ArgoCD) e na construção de ferramentas para desenvolvedores.
Aviso: Estamos cientes de indivíduos que se passam por recrutadores da Deepgram. Toda comunicação legítima de recrutamento da Deepgram vem de um endereço de e-mail @deepgram.com. Se você recebeu uma mensagem alegando ser da Deepgram, por favor, encaminhe-a para [email protected].
