Hybrid Data Engineer: Build Scalable Data Pipelines
Summary
Build and optimize scalable data pipelines using PySpark, SQL, and orchestration tools to ensure reliable data for analytics and advanced models in a hybrid environment.
Capgemini México busca un Data Engineer para diseñar, construir y optimizar pipelines de datos confiables y escalables, asegurando la disponibilidad y calidad de datos para análisis, reporting y modelos avanzados. Trabajarás con PySpark, SQL y herramientas de orquestación en un entorno híbrido.
El candidato ideal debe dominar Python y SQL, experiencia en ETL/ELT, Databricks y Azure Data Factory, modelado de datos en Data Warehouse o Data Lake y gestión de bases de datos como SQL Server,