Engenheiro(a) Dados Pleno | Data Management
Sobre a vaga:
A pessoa nessa posição fará parte do time de Data Management, tendo o papel de disponibilização, entendimento e sustentação de projetos e processos de gerenciamento de dados da empresa, usando boas práticas e identificando melhorias técnicas para os processos internos da área, voltadas para qualidade, segurança e descoberta dos dados. Essa pessoa trabalhará de forma sincronizada e autônoma para destravar necessidades da empresa, empoderar os usuários a tomada de decisão baseada em dados e fornecer ferramentas para prover dados estáveis, com qualidade e consistentes.
Responsabilidade e atribuições:
Atuar na plataforma de dados com o foco em Data Management;
Atuar em projetos, processos e desenvolvimento de automações e serviços em torno do gerenciamento de dados como Qualidade de Dados, Linhagem, Monitoramento, Usabilidade de Dados, Ownership, Metadados, etc;
Atuar em criações e manutenções de guidelines de dados a serem seguidos por todo o time de dados;
Documentar entregas e projetos em páginas internas.
Requisitos e qualificações
Conhecimento em Python (orientação a objetos, design patterns, etc);
Conhecimento em APIs (exemplo: FastAPI, Flask);
Conhecimento em linguagens de modelagem de dados: SQL, PySpark e/ou Pandas;
Experiência trabalhando em uma base de código com colaboradores, de preferência com um sistema de versionamento (exemplo: GitHub);
Conhecimento em arquitetura em cloud, preferencialmente AWS, utilizando as features de IAM, Lambda, S3, Glue, EMR, CloudWatch e outros;
Conhecimento em lógica de programação: como escrever queries em banco de dados, usar parâmetros, criar variáveis;
Conhecimento em alguma ferramenta de gerenciamento de fluxo de trabalho (exemplo: Apache Airflow);
Conhecimento nos componentes de gerenciamento de dados como custos, linhagem, qualidade e monitoramento dos dados;
Inglês básico (no dia a dia para interpretação de documentações e artigos em inglês).
São diferenciais para essa vaga:
Conhecimento em desenvolvimento, manutenção e melhoria de microsserviços;
Conhecimento em desenvolvimento de software;
Ter conhecimento de Databricks ou Snowflake;
Conhecimento em práticas de governança de dados;
Alguma experiência na implementação da plataforma Data Lake / Hadoop, e/ou ETL;
Boas práticas em armazenamento de dados, estruturação de Data Lake e em otimizações de pipelines;
Conhecimento em arquitetura e Mapeamento/Modelagem de dados;
Conhecimento em LGPD.
#VemserPicpayLover #Picpay #LI-CF1 #LI-Remote