3M Consultancy

Desenvolvedor Databricks (Java & Apache Spark) com liberação IRS MBI necessária

PythonJavaSQLKubernetes
Tradução automática. Consulte o original.

Título da Vaga: Desenvolvedor Databricks (Java & Apache Spark)

Esta é uma posição remota.

Localização: Remoto

Duração: Tempo Integral

Requisitos mínimos

NECESSÁRIO Liberação IRS MBI.

O que procuramos

  1. Liberação ativa de background federal (laptop emitido pelo cliente é um plus)
  1. Bacharelado em Ciência da Computação ou área relacionada
  1. 8+ anos de experiência prática em engenharia de dados ou desenvolvimento de big data

Habilidades Técnicas

Dados e Sistemas

  1. Experiência trabalhando com sistemas de dados empresariais ou governamentais de grande porte
  1. Bom entendimento de estruturas de dados, segurança e conformidade

Java

  1. Forte experiência com Java 8 ou mais recente
  1. Confortável com Streams, Lambdas e design orientado a objetos

Apache Spark

  1. Experiência prática com Spark Core, Spark SQL e DataFrames
  1. Entendimento de RDDs e quando usá-los
  1. Experiência com processamento em lote e streaming
  1. Fortes habilidades em ajuste de desempenho de Spark
  1. Capaz de depurar jobs usando a UI e logs do Spark

Ferramentas de Big Data

  1. Experiência com ferramentas como HDFS, Hive ou HBase
  1. Familiaridade com Kafka, S3 ou data lakes baseados em nuvem
  1. Experiência com formatos Parquet, Avro ou ORC

ETL e Processamento de Dados

  1. Experiência na construção de pipelines ETL em lote e em tempo real
  1. Habilidade em limpeza, transformação e enriquecimento de dados

DevOps e Implantação

  1. Experiência executando Spark em YARN, Kubernetes ou plataformas de nuvem
  1. Familiaridade com ferramentas de CI/CD como Jenkins ou Ações GitHub
  1. Experiência com ferramentas de monitoramento e logs de produção

Testes e Qualidade de Código

  1. Testes unitários usando JUnit ou TestNG
  1. Experiência com Mockito ou ferramentas similares
  1. Confortável validando dados e testando jobs Spark

Como você terá sucesso

  1. Você está acostumado a trabalhar em equipes Ágeis
  1. Você documenta seu trabalho claramente
  1. Você se mantém calmo e focado ao solucionar problemas de produção

Estamos procurando um Desenvolvedor Databricks que possa projetar, construir e dar suporte a soluções de processamento de dados em larga escala. Esta função se concentra no trabalho com dados complexos e de alto volume em um ambiente seguro. Você deve se sentir confortável escrevendo código Java limpo, construindo jobs Spark e melhorando o desempenho em sistemas distribuídos.

Você trabalhará em estreita colaboração com engenheiros, analistas e equipes de negócios para entregar pipelines de dados confiáveis que escalam bem e atendem aos requisitos de segurança e conformidade.

O que você fará

  1. Construir e manter pipelines de dados usando Apache Spark no Databricks
  1. Escrever código Java limpo e eficiente (Java 8 ou superior) seguindo as melhores práticas de codificação
  1. Trabalhar com grandes conjuntos de dados estruturados e semiestruturados
  1. Ajustar jobs Spark para melhorar o desempenho, a estabilidade e o custo
  1. Colaborar com outras equipes para entender os requisitos e entregar soluções
  1. Garantir que o manuseio de dados siga os padrões de segurança e governança
  1. Investigar e corrigir problemas em ambientes de produção

Seria bom ter

  1. Experiência com Scala ou Python em Spark
  1. Experiência prática com Databricks ou Google Dataproc
  1. Conhecimento de Delta Lake ou Apache Iceberg
  1. Experiência em modelagem de dados e design de desempenho

Mais oportunidades com um só perfil

Quer aparecer para várias vagas sem repetir todo o processo? Crie seu perfil e seja encontrado pelas empresas que usam a Nort.

Criar meu perfil

Seu próximo empregojá está te procurando.

Nort

Plataforma de recrutamento reverso para programadores