freehire launches on Product Hunt on 26 August.

Follow →

Data Engineer Semi Senior

Summary

Build and maintain automated data pipelines, Data Lakes, and cloud-based ETL processes using Python, PySpark, and AWS services to process large datasets efficiently.

Descri4pto del puesto

Buscamos un Data Engineer Semi Senior para participar en el diseño, desarrollo e implementaci f3n de soluciones de datos que permitan recopilar, almacenar, procesar y analizar grandes vol famenes de informaci f3n de forma eficiente, automatizada y confiable.

El rol est e1 orientado a perfiles con experiencia en ingenier eda de datos, construcci f3n de pipelines, Data Lake, procesamiento de datos y optimizaci f3n de flujos de informaci f3n en entornos cloud.

Funciones principales

  • Desarrollar y mantener procesos de extracci f3n, transformaci f3n y carga de datos desde distintas fuentes hacia el Data Lake.
  • Construir y optimizar pipelines de datos automatizados y escalables.
  • Diser y administrar repositorios de datos eficientes para grandes vol famenes de informaci f3n.
  • Implementar procesos de transformaci f3n, limpieza y validaci f3n de datos.
  • Optimizar tiempos de procesamiento, consultas y uso de recursos computacionales.
  • Asegurar la calidad de los datos mediante validaciones, controles y m e9tricas.
  • Apoyar en la observabilidad de los flujos de datos mediante monitoreo, alertas y trazabilidad.
  • Colaborar con equipos de negocio, anal edtica, tecnolog eda y arquitectura.

Requisitos

  • Profesional universitario de Ingenier eda de Sistemas, Inform e1tica, Computaci f3n, Ciencia de Datos, Estad edstica, Matem e1tica, Ingenier eda Industrial o carreras afines.
  • Experiencia de 2 a 4 a f1os como Data Engineer o en roles similares.
  • Experiencia en proyectos de Big Data, Data Management o construcci f3n de pipelines de datos.
  • Manejo de Python a nivel intermedio.
  • Manejo de SQL a nivel intermedio, deseable PostgreSQL.
  • Conocimiento de Linux a nivel b e1sico o intermedio.
  • Conocimiento de PySpark.
  • Conocimientos b e1sicos de AWS: RDS, EC 2 y S 3.
  • Conocimiento b e1sico de GitHub.

Conocimientos deseables

  • Databricks.
  • MongoDB.
  • Kafka.
  • Data Lake.
  • Observabilidad de datos.
  • Calidad de datos.
  • Optimizaci f3n de procesos en cloud.

See also