Sobre a Vaga
Gft Brasil busca Engenheiro de Dados AWS Pleno/Sênior remoto para atuar com dados e arquitetura Lakehouse na AWS, garantindo governança, qualidade e segurança no acesso às informações.
Responsabilidades
- Organizar, coletar e processar grandes volumes de dados com ferramentas de ETL
- Traduzir objetivos de negócio do cliente em estratégia de gerenciamento de informações e inteligência de negócios
- Manter pipelines de dados e garantir segurança no acesso às informações
- Criar e expor métricas (painéis) sobre os dados obtidos, assegurando qualidade e integridade
- Atuar em modernização da plataforma de dados com foco em arquitetura Lakehouse, governança e preparação de dados para consumo analítico e de IA
- Estruturar modelagem dimensional para consumo por times de negócio, dashboards e relatórios
- Dominar o ciclo de vida completo do dado: ingestão, processamento, armazenamento, transformação, consumo e governança
Requisitos
- Experiência com coleta, transformação e carga de dados (ETL)
- Python e/ou PySpark
- Cloud AWS: Glue, EMR, Athena, SNS, Lambda, Step Functions, S3, Lake Formation, IAM e CloudWatch
- Modelagem e bancos de dados NoSQL: MongoDB, DynamoDB e Hadoop
- Arquitetura Lakehouse com Apache Iceberg (gerenciamento de tabelas analíticas, versionamento, evolução de schema, particionamento e otimização de performance)
- Query engines para grandes volumes: Athena, Trino, Presto ou Spark SQL (otimização de consultas e formatos colunares como Parquet e ORC)
- Modelagem dimensional (fato e dimensão, granularidade, chaves, hierarquias, métricas e indicadores)
- Testes unitários e testes de performance, além de boas práticas de segurança, controle de acesso e monitoramento em nuvem
Desejável
- Certificações AWS Practitioner e AWS Data Engineer
- Experiência com data quality e observability (validações, completude, consistência, unicidade, integridade e acurácia; monitoramento e detecção de anomalias)
- Infra as code com Terraform e CloudWatch
- Conhecimento em Data Mesh (dados como produto, ownership por domínio, governança federada, self-service, contratos de dados e catálogo)
- Conhecimento em IA aplicada a dados (feature stores e integração de pipelines com modelos de IA)
Perfil comportamental
- Trabalho em equipe e colaboração
- Coragem para se desafiar e buscar crescimento
- Resolução de problemas e capacidade de trabalhar de forma independente, gerenciando o próprio tempo
- Interesse em lidar com situações adversas e inovadoras no âmbito tecnológico