Groq

Engenheiro(a) Sênior/Staff de Design de Rede, IA/HPC

PythonAWSGCP
Tradução automática. Consulte o original.

MISSÃO

Groq está construindo infraestrutura de IA de alta performance projetada para tornar a inferência rápida, previsível e escalável. Nossas equipes de infraestrutura projetam e operam os sistemas que conectam computação, dados e serviços em grande escala. Estamos procurando um(a) Engenheiro(a) de Rede Sênior/Staff de IA/HPC para ajudar a arquitetar, projetar, validar e evoluir a infraestrutura de rede que suporta os ambientes de computação de IA em rápido crescimento da Groq.

Como Engenheiro(a) de Design de Rede Sênior/Staff, você será responsável pela arquitetura e design de rede em ambientes de data center de alta performance e infraestrutura de IA. Você traduzirá requisitos de capacidade, performance, confiabilidade e negócios em designs de rede escaláveis que podem ser implantados e operados de forma consistente.

Esta função exige profundo conhecimento em redes de data center, protocolos de roteamento, arquitetura de rede, automação e infraestrutura de grande escala. Você trabalhará em estreita colaboração com as equipes de operações de rede, engenharia de data center, computação, plataforma, segurança e infraestrutura para levar os designs do conceito à validação e implantação em produção. Você também ajudará a estabelecer os padrões de engenharia, padrões de design, ferramentas e direção técnica que permitem que a infraestrutura de rede da Groq escale.

Nesta função, o sucesso significa construir arquiteturas de rede que permitam que a infraestrutura da Groq cresça sem sacrificar performance, confiabilidade ou simplicidade operacional. Você criará designs repetíveis em vez de soluções únicas, automatizará sempre que prático, identificará limites de escalabilidade antes que se tornem problemas de produção e fará da rede uma camada habilitadora para a infraestrutura de computação da Groq.

Você combinará profundo conhecimento em redes com uma mentalidade de engenharia de sistemas — considerando não apenas se uma rede funciona, mas como ela se comporta em escala, como falha, como é validada e quão eficientemente pode ser operada.

Remuneração

Localização: Esta função será baseada em um de nossos três hubs de contratação: a área de Dallas, São Francisco ou Nova York. A pessoa contratada para esta função deve residir em uma dessas três áreas. Você terá a flexibilidade de trabalhar remotamente enquanto estabelecemos nosso escritório local da Groq, com a expectativa de que esta função transite para o trabalho presencial assim que o escritório for inaugurado.

Groq está comprometida em fornecer remuneração competitiva através de nossa filosofia de Caixa Total, que incorpora o valor potencial do bônus diretamente na remuneração base. A faixa salarial total em dinheiro para esta posição, que inclui o valor potencial do bônus, é de US$270,400-US$401,600, com a colocação individual determinada por sua localização geográfica, experiência, habilidades e alinhamento com os padrões internos de remuneração. Esta faixa é específica para candidatos localizados nos Estados Unidos. A remuneração para candidatos internacionais variará com base nas dinâmicas do mercado local. Além da remuneração em dinheiro, a Groq também oferece um Programa de Incentivo de Longo Prazo (LTI) e um conjunto robusto de benefícios para funcionários.

RESPONSABILIDADES E OPORTUNIDADES NESTA FUNÇÃO: *

  1. Ser responsável pelo processo de design de rede de ponta a ponta, traduzindo requisitos de computação, carga de trabalho, escala e tenência do cliente em arquiteturas prontas para produção para treinamento e inferência de IA. *
  1. Trabalhar em estreita colaboração com as equipes de software que desenvolvem stacks de inferência e treinamento para alinhar a topologia de rede com a arquitetura do stack. *
  1. Desenvolver arquiteturas de rede, designs de alto nível (HLDs), designs de baixo nível (LLDs), revisar lista de materiais (BOMs) e padrões de implementação aproveitando arquiteturas de referência da indústria e de fornecedores. *
  1. Projetar fabrics de rede spine-leaf/Clos para redes front-end, back-end e de armazenamento, com foco em performance, resiliência, escalabilidade e simplicidade operacional. *
  1. Avaliar e implementar tecnologias como BGP, EVPN, VXLAN, ECMP, IPv4/IPv6, QoS. *
  1. Desenvolver estratégias para interconexão de data center, conectividade WAN, borda de internet, conectividade em nuvem e peering externo. *
  1. Realizar planejamento de capacidade de rede e engenharia de tráfego para cargas de trabalho de IA e computação distribuída de alta largura de banda. *
  1. Colaborar com as equipes de engenharia de computação e infraestrutura para entender os padrões de comunicação de carga de trabalho e traduzi-los em requisitos de rede. *
  1. Estabelecer padrões para plataformas de hardware de rede, topologia, endereçamento, política de roteamento, configuração e gerenciamento de ciclo de vida. *
  1. Avaliar switches, ópticos, arquiteturas de cabeamento, sistemas operacionais de rede e tecnologias de rede emergentes. *
  1. Construir ambientes de laboratório, provas de conceito e frameworks de validação de design antes de introduzir novas arquiteturas em produção. *
  1. Definir cenários de falha e validar o comportamento da rede durante falhas de link, dispositivo, plano de controle e site. *
  1. Impulsionar a automação de rede e práticas de infraestrutura como código usando tecnologias como Python, Ansible, Git, APIs e pipelines de CI/CD. *
  1. Desenvolver validação de design automatizada, geração de configuração, conformidade e capacidades de teste. *
  1. Estabelecer requisitos de observabilidade de rede, incluindo telemetria, métricas de performance, alertas e visibilidade de capacidade. *
  1. Liderar revisões técnicas e fornecer orientação sobre decisões complexas de arquitetura e design de rede. *
  1. Solucionar problemas complexos de performance e confiabilidade que abrangem rede, computação, hardware e sistemas distribuídos. *
  1. Colaborar com equipes de operações para garantir que os designs sejam suportáveis, observáveis e seguros para operar em escala. *
  1. Orientar engenheiros e elevar o nível técnico para arquitetura de rede, automação, documentação e práticas de engenharia.

CANDIDATOS IDEAIS TÊM/SÃO: *

  1. 8+ anos de experiência em engenharia de rede, arquitetura ou engenharia de infraestrutura, com experiência significativa no design de redes de data center em larga escala. *
  1. Profundo entendimento de TCP/IP, BGP e arquiteturas modernas de roteamento de data center. *
  1. Forte experiência em design de fabrics de rede leaf-spine / Clos. *
  1. Experiência com EVPN/VXLAN e arquiteturas modernas de virtualização de rede. *
  1. Forte entendimento de ECMP, convergência de roteamento, domínios de falha, engenharia de tráfego e resiliência de rede. *
  1. Experiência em projetar redes com plataformas Ethernet de alta largura de banda, incluindo interfaces de 100G, 400G ou de maior velocidade. *
  1. Forte conhecimento dos fundamentos de redes ópticas, transceptores, infraestrutura de fibra e cabeamento de data center. *
  1. Experiência com plataformas e sistemas operacionais de rede de fornecedores como Arista, Cisco, Juniper, NVIDIA ou equivalentes. *
  1. Experiência com automação de rede e desenvolvimento de software usando Python e APIs. *
  1. Familiaridade com infraestrutura como código, controle de versão, testes automatizados e práticas de engenharia de CI/CD. *
  1. Experiência com tecnologias de telemetria e observabilidade de rede, como telemetria de streaming, SNMP, dados de fluxo e monitoramento de séries temporais. *
  1. Forte entendimento de redes Linux e fundamentos de TCP/IP. *
  1. Capacidade demonstrada de desenvolver documentos de arquitetura, padrões de design, planos de implementação e especificações técnicas. *
  1. Capacidade de analisar sistemas complexos e tomar decisões arquiteturais sólidas envolvendo trade-offs de performance, confiabilidade, custo e operacionais. *
  1. Fortes habilidades de comunicação e capacidade de influenciar decisões técnicas em organizações de engenharia. *
  1. Experiência em projetar redes para clusters de IA/ML, ambientes de HPC, sistemas de computação distribuída ou implantações de grande escala de GPUs/aceleradores. *
  1. Experiência com fabrics Ethernet de escala muito grande e padrões de tráfego east-west de alta vazão. *
  1. Conhecimento de RDMA, Priority Flow Control (PFC), ECN, gerenciamento de congestionamento e design de Ethernet sem perdas ou quase sem perdas. *
  1. Experiência em projetar redes que suportam treinamento distribuído ou inferência de IA em larga escala. *
  1. Familiaridade com SONiC ou outras plataformas de rede desassociadas/abertas. *
  1. Experiência com arquitetura de data center multi-site e interconexão de data center. *
  1. Experiência trabalhando com ambientes de rede em nuvem como AWS, GCP ou Azure. *
  1. Familiaridade com plataformas de fonte de verdade e automação de rede como NetBox, Nautobot ou sistemas equivalentes. *
  1. Experiência em projetar e operar infraestrutura em escala hiperscalável ou em ambientes de tecnologia em rápido crescimento.
  1. Familiaridade com tecnologias backend como Infiniband/RoCE/ Spectrum-X é fortemente preferível. *

Por que se juntar a nós: *

  • Contratação com Propósito: Você não está aqui por acidente, e ninguém mais também. Cada membro da equipe é escolhido a dedo com intenção porque com quem construímos importa. *
  • Construtores Procurados: Você não está apenas pegando carona no foguete, você está construindo-o. Seu trabalho molda diretamente a trajetória da nossa empresa. *
  • Trabalho Orientado por Missão: Estamos aqui para causar um impacto real. Nossa missão impulsiona tudo o que fazemos. *
  • Enfrentando Problemas Difíceis: Se o fácil não é sua praia, você está no lugar certo. Resolvemos alguns dos desafios mais complexos e empolgantes em nosso setor. *
  • Excelência é o Padrão: Alta performance não é apenas encorajada, é o padrão. E é contagiante.

Mais oportunidades com um só perfil

Quer aparecer para várias vagas sem repetir todo o processo? Crie seu perfil e seja encontrado pelas empresas que usam a Nort.

Criar meu perfil

Seu próximo empregojá está te procurando.

Nort

Plataforma de recrutamento reverso para programadores