Roku
CyberMedia Technologies
Ingeniero/a de Datos
Sobre la oportunidad
CTEC es una empresa tecnológica líder que proporciona servicios de modernización, transformación digital y desarrollo de aplicaciones al Gobierno Federal de EE. UU. Con sede en McLean, VA, CTEC cuenta con más de 300 miembros de equipo trabajando en sistemas y proyectos críticos para misiones en agencias como el Departamento de Seguridad Nacional, el Servicio de Impuestos Internos y la Oficina de Gestión de Personal. El trabajo que realizamos afecta a millones de ciudadanos estadounidenses a diario cuando interactúan con los sistemas que construimos. Nuestras soluciones comerciales de primera clase, modificadas para los requisitos de misión específicos de nuestros clientes, están impulsando este futuro cada día.
La empresa ha experimentado un rápido crecimiento durante los últimos 3 años y recientemente recibió una inversión estratégica de Main Street Capital Corporation (NYSE: MAIN). Además de nuestro reciente crecimiento en agencias federales civiles, buscamos expandir nuestras capacidades en desarrollo en la nube y nuestra presencia en agencias centradas en la seguridad nacional dentro del Departamento de Defensa y la Comunidad de Inteligencia de EE. UU.
Cliente
CTEC desarrolla y entrega tecnologías y soluciones innovadoras centradas en el cliente que apoyan a la unidad de negocio de Salud y Seguros de la Oficina de Gestión de Personal (OPM) y a la Oficina del Director de Información (OCIO).
¡Buscamos incorporar un/a Ingeniero/a de Datos a nuestro equipo!
Funciones y Responsabilidades
- Desarrollo de Pipelines de Datos y ETL: Diseñar, desarrollar y mantener pipelines de ETL escalables y flujos de trabajo de datos para ingerir, transformar e integrar datos de sistemas heredados y fuentes externas en plataformas de datos modernas basadas en la nube.
- Implementación de Plataforma de Datos en la Nube y Databricks: Crear, optimizar y mantener soluciones de procesamiento de datos utilizando arquitecturas de nube Azure Databricks y lakehouse para soportar casos de uso analíticos, operativos y de informes.
- Soporte de Migración de Datos: Apoyar la migración por fases de bases de datos heredadas y herramientas ETL a entornos de nube Azure Databricks, incluyendo la documentación de transformaciones y el mapeo de datos.
- Diseño de Lakehouse y Capa de Datos: Implementar arquitecturas de datos lakehouse en capas (por ejemplo, capas bronce, plata, oro) en Databricks para soportar la calidad de los datos, el rendimiento y las necesidades de informes posteriores.
- Desarrollo de Python y PySpark: Desarrollar notebooks de procesamiento de datos, flujos de trabajo y transformaciones de datos distribuidas utilizando Python y PySpark dentro de entornos Databricks.
- Calidad y Validación de Datos: Desarrollar procesos de validación, reconciliación y pruebas de datos para garantizar la precisión, integridad y consistencia de los datos en todos los dominios.
- Integración e Interoperabilidad de Datos: Integrar plataformas de datos Databricks con herramientas de análisis e informes para habilitar la inteligencia empresarial y los paneles operativos.
- Gobernanza y Seguridad de Datos: Apoyar iniciativas de gobernanza de datos, incluyendo la gestión de metadatos, la integración de catálogos de datos, el cifrado, los controles de acceso y el cumplimiento de los requisitos federales de protección de datos.
- Soporte de DevOps y CI/CD: Mantener el control de código fuente y los pipelines de CI/CD para flujos de trabajo de Databricks y de ingeniería de datos, apoyando la promoción automatizada entre entornos.
- Colaboración Técnica: Trabajar en estrecha colaboración con arquitectos de datos, arquitectos de soluciones, analistas de negocio y equipos de informes para implementar soluciones de datos aprobadas.
- Soporte Operativo y Resolución de Problemas: Proporcionar soporte continuo para flujos de trabajo de Databricks, resolver fallos de pipelines y solucionar problemas complejos de procesamiento de datos.
- Mentoría y Compartir Conocimiento: Proporcionar orientación a ingenieros de datos junior y contribuir a la documentación y la capacitación del equipo.
- Trabaja bajo supervisión mínima con poca orientación del personal senior.
Habilidades y Experiencia Laboral
- Experiencia Profesional: Más de 7 años de experiencia en ingeniería de datos, desarrollo ETL o entornos de integración de datos a gran escala.
- Sólida experiencia en el diseño y desarrollo de pipelines ETL y transformaciones de datos en entornos de nube Azure Databricks.
- Sólida competencia en SQL y Python, con experiencia práctica en el uso de PySpark para el procesamiento de datos distribuido.
- Experiencia trabajando con plataformas de datos basadas en la nube, lagos de datos y entornos lakehouse, preferiblemente en Microsoft Azure.
- Experiencia en la implementación de arquitecturas de datos lakehouse en capas (bronce, plata, oro) para análisis empresariales.
- Familiaridad con frameworks de procesamiento de big data basados en Spark.
- Experiencia en el soporte de migración de datos desde bases de datos heredadas y herramientas ETL a plataformas basadas en Databricks.
- Experiencia en la integración de plataformas Databricks con herramientas de inteligencia empresarial e informes como Power BI.
- Familiaridad con las mejores prácticas de gobernanza de datos, gestión de metadatos y seguridad de datos.
- Experiencia con control de código fuente y pipelines de CI/CD para ingeniería de datos y flujos de trabajo de Databricks.
- Conocimiento práctico de metodologías de SDLC y entrega Ágil.
- Excelentes habilidades organizativas, de comunicación y colaboración.
Educación
Título de Grado en Ciencias de la Computación, Ingeniería, Sistemas de Información o una disciplina técnica relacionada. Se considerará educación o experiencia profesional equivalente en lugar de un título.
Permiso de Trabajo
Debe ser ciudadano/a de EE. UU. y poder obtener un permiso de Confianza Pública (Public Trust).
Preferible
- Experiencia práctica con flujos de trabajo de Azure Databricks, tablas Delta y orquestación de trabajos de Databricks.
- Experiencia con Azure Data Lake, Azure Data Factory o servicios de datos similares de Azure.
- Experiencia en el soporte de modernización de TI federal o iniciativas de transformación de datos empresariales a gran escala.
- Familiaridad con entornos de datos de atención médica, seguros o administración de beneficios.
- Experiencia en la implementación de plataformas de gobernanza de datos o catálogos de datos.
Si buscas un entorno divertido y desafiante con personas talentosas y motivadas con las que trabajar, CTEC es el lugar adecuado para ti. Además del salario del empleado, ofrecemos una variedad de beneficios para empleados que incluyen:
- Vacaciones pagadas y baja por enfermedad
- Cobertura de seguro médico
- Formación profesional
- Programas de bonificación por rendimiento
- Contribución de 401K y Cobertura del Empleador
- 11 Días Festivos Federales
