Para Isso, buscamos:
Obrigatórios:
- Graduação completa em Ciência da Computação, Ciência de Dados, Estatística, Engenharia, Sistemas de Informação ou áreas correlatas.
- Conhecimento notório em Python (pandas, manipulação de arquivos, consumo de APIs REST).
- SQL intermediário (joins, agregações, subqueries, window functions básicas).
- Noções de ETL: extração, transformação e carga de dados.
- Docker: consegue rodar, construir e depurar containers existentes.
- Familiaridade com pelo menos um banco de dados relacional.
Desejáveis:
- Experiência com o SQL Server e arquitetura medallion (design de dados).
Como será o seu dia a dia:
- Desenvolver e manter pipelines de ingestão de dados a partir de fontes variadas: planilhas (Excel/CSV), APIs externas e bancos de dados relacionais.
- Escrever, testar e documentar scripts Python para transformação e limpeza de dados.
- Construir e otimizar queries SQL para extração, validação e carga de dados.
- Participar da construção de fluxos ETL sob orientação do Engenheiro Sênior, sendo responsável por etapas específicas e bem delimitadas.
- Containerizar e manter scripts e serviços usando Docker.
- Documentar processos, fontes de dados e transformações realizadas.