3M Consultancy

Databricks Developer (Java y Apache Spark) con autorización IRS MBI requerida

PythonJavaSQLKubernetes
Traducción automática. Consulta el original.

Título del puesto: Databricks Developer (Java y Apache Spark)

Este es un puesto remoto.

Ubicación: Remoto

Duración: Tiempo Completo

Requisitos mínimos

SE REQUIERE Autorización IRS MBI.

Lo que buscamos

  1. Autorización federal activa de antecedentes (un portátil proporcionado por el cliente es un plus)
  1. Título de Grado en Informática o un campo relacionado
  1. 8+ años de experiencia práctica en ingeniería de datos o desarrollo de big data

Habilidades Técnicas

Datos y Sistemas

  1. Experiencia trabajando con sistemas de datos empresariales o gubernamentales a gran escala
  1. Buen entendimiento de estructuras de datos, seguridad y cumplimiento

Java

  1. Sólida experiencia con Java 8 o versiones más recientes
  1. Comodidad con Streams, Lambdas y diseño orientado a objetos

Apache Spark

  1. Experiencia práctica con Spark Core, Spark SQL y DataFrames
  1. Comprensión de RDDs y cuándo usarlos
  1. Experiencia con procesamiento por lotes y streaming
  1. Sólidas habilidades en la optimización del rendimiento de Spark
  1. Capacidad para depurar trabajos utilizando la interfaz de usuario y los registros de Spark

Herramientas de Big Data

  1. Experiencia con herramientas como HDFS, Hive o HBase
  1. Familiaridad con Kafka, S3 o data lakes basados en la nube
  1. Experiencia con formatos Parquet, Avro u ORC

ETL y Procesamiento de Datos

  1. Experiencia en la construcción de pipelines ETL por lotes y en tiempo real
  1. Experto en limpieza, transformación y enriquecimiento de datos

DevOps y Despliegue

  1. Experiencia ejecutando Spark en YARN, Kubernetes o plataformas en la nube
  1. Familiaridad con herramientas de CI/CD como Jenkins o GitHub Actions
  1. Experiencia con herramientas de monitorización y registros de producción

Pruebas y Calidad del Código

  1. Pruebas unitarias utilizando JUnit o TestNG
  1. Experiencia con Mockito o herramientas similares
  1. Comodidad validando datos y probando trabajos de Spark

Formas de tener éxito

  1. Estás acostumbrado a trabajar en equipos Agile
  1. Documentas tu trabajo claramente
  1. Mantienes la calma y te concentras al solucionar problemas de producción

Buscamos un desarrollador Databricks que pueda diseñar, construir y dar soporte a soluciones de procesamiento de datos a gran escala. Este rol se centra en trabajar con datos complejos y de gran volumen en un entorno seguro. Deberías sentirte cómodo escribiendo código Java limpio, creando trabajos Spark y mejorando el rendimiento en sistemas distribuidos.

Trabajarás en estrecha colaboración con ingenieros, analistas y equipos de negocio para entregar pipelines de datos fiables que escalen bien y cumplan con los requisitos de seguridad y cumplimiento.

Qué harás

  1. Construir y mantener pipelines de datos utilizando Apache Spark en Databricks
  1. Escribir código Java limpio y eficiente (Java 8 o superior) siguiendo las mejores prácticas de codificación
  1. Trabajar con grandes conjuntos de datos estructurados y semiestructurados
  1. Ajustar trabajos de Spark para mejorar el rendimiento, la estabilidad y el coste
  1. Colaborar con otros equipos para comprender los requisitos y entregar soluciones
  1. Asegurarse de que el manejo de datos sigue los estándares de seguridad y gobernanza
  1. Investigar y solucionar problemas en entornos de producción

A tener en cuenta

  1. Experiencia con Scala o Python en Spark
  1. Experiencia práctica con Databricks o Google Dataproc
  1. Conocimiento de Delta Lake o Apache Iceberg
  1. Experiencia en modelado de datos y diseño de rendimiento

Más oportunidades con un solo perfil

¿Quieres optar a más puestos sin repetir todo el proceso? Crea tu perfil para que te encuentren las empresas que usan Nort.

Crear mi perfil

Tu próximo empleoya está buscándote.

Nort

Plataforma de reclutamiento inverso para programadores