Engenheiro de dados Pleno
Randstad
Descrição da vaga
Missão do Cargo: Executar e sustentar pipelines de dados e machine learning (ML), garantindo a qualidade, a organização e a disponibilidade das bases para consumo analítico das demais frentes da empresa.
Principais Atividades
- Construir e manter pipelines no Databricks utilizando Delta Lake, Workflows e Jobs.
- Desenvolver rotinas de ingestão e transformação de dados de diversas origens.
- Preparar datasets estruturados para consumo em ferramentas parceiras e de BI (Emblem, Power BI, Tableau, Radar).
- Apoiar a criação e a manutenção da Feature Store de dados para suporte às frentes de modelagem.
- Operar pipelines de Machine Learning com suporte do MLflow.
- Implementar verificações básicas de qualidade e integridade de dados.
- Monitorar a execução diária de jobs e atuar preventivamente ou reativamente em casos de falhas.
- Garantir o correto versionamento, documentação e organização do código-fonte.
Requisitos Técnicos e Formação Acadêmica
- Formação: Ensino superior completo em áreas quantitativas como Estatística, Matemática, Engenharia, Ciência da Computação ou afins.
- Experiência prática de trabalho com Databricks, Apache Spark e linguagem SQL.
- Sólidos conhecimentos em programação Python voltada para manipulação de dados.
- Experiência no desenvolvimento e manutenção de pipelines de dados (ETL/ELT).
- Noções de conceitos de MLOps e de ferramentas de orquestração de fluxos (como Airflow ou similares).
- Conhecimento básico sobre boas práticas de governança e qualidade de dados.
Perfil Comportamental
- Forte senso de organização e extrema atenção aos detalhes.
- Boa comunicação interpessoal para colaborar com times multidisciplinares.
- Proatividade operacional para identificação e correção ágil de falhas.
- Vontade constante de aprender e de se atualizar com novas tecnologias de dados.
