Data Engineer AI
Summary
Data Engineer joining the AI team to drive Generative AI and Big Data initiatives: designing vendor-agnostic data/ML architectures, building ETL for massive datasets, and taking ML models to production. Core stack is Python, PySpark, Docker, TensorFlow/Scikit-Learn with CI tooling, on a fully remote global team.
En este rol te incorporarás al equipo de Inteligencia Artificial para impulsar iniciativas de IA Generativa y proyectos de Big Data. Trabajarás con plataformas y ML para diseñar arquitecturas robustas y escalar soluciones de datos en un entorno global y remoto. Colaborarás con áreas cross-funcionales y proveedores, aportando tu experiencia para definir estrategias de datos y gobernanza de IA. Buscamos a alguien orientado a impacto, con foco en innovación y resultados medibles.
Compensaciones / Beneficios- Salario competitivo
- 100% remoto
- Plan de retribución flexible (transporte, seguro médico, guardería)
- Formación a medida y cursos de idiomas
- Horario flexible
- Jornada intensiva en viernes y verano
- Gobernar iniciativas globales de AI Generativa y mantener dashboards de seguimiento
- Brindar soporte técnico en POCs Globales de T&O y colaborar con proveedores
- Contribuir a la definición del Blueprint Global de Adopción de AI Generativa
- Diseñar arquitecturas agnósticas para proyectos de IA y IA Generativa
- Participar en el Foro de Gobierno y definir el COE de AI
- Asesorar a la PMO y liderar partnerships con Gartner
- Definir la taxonomía de ML y colaborar en la estrategia de datos
- Interactuar con equipos en todos los niveles y liderar equipos cuando sea necesario
- Mantener capacidad de comunicación en inglés y portugués
- Trabajar en entornos con regulación y buenas prácticas de datos
- Mínimo 4 años de experiencia en entornos Big Data
- Python con pruebas unitarias, empaquetado y gestión de dependencias
- Conocimientos de Programación Orientada a Objetos
- Experiencia con Docker, PySpark, TensorFlow, Scikit-Learn, Numpy y Pandas
- Diseño de software con patrones de diseño
- Amplia experiencia en ETL para datos masivos
- Git y flujo de desarrollo continuo
- Experiencia en CI (Jenkins, Artifactory, etc.)
- Sistemas Unix y manejo por consola
- Conocimientos de ML (clasificación, regresión, clustering) y llevar modelos a producción
- Capacidad para interactuar y liderar equipos cuando sea necesario
- Buen dominio de inglés y portugués (comunicativo)
- Colaboración y trabajo en equipo
- Capacidad de comunicación clara
- Adaptabilidad y proactividad
- Docker
- PySpark
- TensorFlow