Engenheiro de dados Pleno

Randstad

📍 São Paulo, SP/SP· Tempo integral

Descrição da vaga

Missão do Cargo: Executar e sustentar pipelines de dados e machine learning (ML), garantindo a qualidade, a organização e a disponibilidade das bases para consumo analítico das demais frentes da empresa.


Principais Atividades

  • Construir e manter pipelines no Databricks utilizando Delta Lake, Workflows e Jobs.
  • Desenvolver rotinas de ingestão e transformação de dados de diversas origens.
  • Preparar datasets estruturados para consumo em ferramentas parceiras e de BI (Emblem, Power BI, Tableau, Radar).
  • Apoiar a criação e a manutenção da Feature Store de dados para suporte às frentes de modelagem.
  • Operar pipelines de Machine Learning com suporte do MLflow.
  • Implementar verificações básicas de qualidade e integridade de dados.
  • Monitorar a execução diária de jobs e atuar preventivamente ou reativamente em casos de falhas.
  • Garantir o correto versionamento, documentação e organização do código-fonte.

Requisitos Técnicos e Formação Acadêmica

  • Formação: Ensino superior completo em áreas quantitativas como Estatística, Matemática, Engenharia, Ciência da Computação ou afins.
  • Experiência prática de trabalho com Databricks, Apache Spark e linguagem SQL.
  • Sólidos conhecimentos em programação Python voltada para manipulação de dados.
  • Experiência no desenvolvimento e manutenção de pipelines de dados (ETL/ELT).
  • Noções de conceitos de MLOps e de ferramentas de orquestração de fluxos (como Airflow ou similares).
  • Conhecimento básico sobre boas práticas de governança e qualidade de dados.

Perfil Comportamental

  • Forte senso de organização e extrema atenção aos detalhes.
  • Boa comunicação interpessoal para colaborar com times multidisciplinares.
  • Proatividade operacional para identificação e correção ágil de falhas.
  • Vontade constante de aprender e de se atualizar com novas tecnologias de dados.

Mais vagas em São Paulo, SP

Todas as vagas em São Paulo, SP/SP →Vagas em São Paulo →