#VemPraLuby💙
Aqui você terá a oportunidade de:
- Evoluir em um ambiente de alta performance: Uma cultura onde o desenvolvimento é contínuo, com autonomia e envolvimento em projetos nacionais e internacionais que realmente testam suas habilidades e impulsionam seu potencial.
- Integrar um time apaixonado por tecnologia: Aqui, você vai trabalhar ao lado de talentos experientes em um ambiente colaborativo e disruptivo, utilizando as tecnologias mais avançadas do mercado.
- Deixar sua marca no mundo: Nossas soluções digitais impactam diretamente a vida de milhares de pessoas, e é a sua chance de ser parte ativa na construção de um futuro mais digital e conectado.
- Trabalhar de forma remota e com flexibilidade: Seja qual for o seu lugar, estamos prontos para te receber no nosso time!
Sua Missão:
Buscamos um Engenheiro de Dados Sênior para projetar, construir e manter pipelines de dados escaláveis no Google Cloud Platform. Você será responsável por desenvolver a ingestão, a modelagem e a garantia de qualidade dos dados de ponta a ponta, integrando novas fontes aos padrões já estabelecidos e entregando dentro da infraestrutura e do processo de mudança mantidos pelo time do cliente, com documentação e runbooks como parte do trabalho.
Principais Atividades
- Desenvolver modelos e consultas no BigQuery com particionamento, clustering e modelos incrementais, com atenção a performance e custo.
- Construir transformações modulares em dbt, com testes, documentação e metadados.
- Desenvolver e manter DAGs no Cloud Composer/Airflow, com agendamento, dependências, retries e alertas.
- Escrever código de pipeline em Python para ingestão e desenvolvimento de conectores.
- Implementar diferentes padrões de ingestão e modelar os dados em estruturas dimensionais e normalizadas.
- Garantir a qualidade dos dados e registrar metadados e lineage no Dataplex/Data Catalog.
- Atuar com Git e CI/CD, documentando runbooks como parte da entrega.
Requisitos essenciais:
- Experiência sólida com BigQuery: particionamento, clustering, modelos incrementais, tuning de performance e SQL com consciência de custo.
- Experiência com dbt e SQL avançado, incluindo modelagem dimensional e lógica de reconciliação.
- Vivência com Cloud Composer ou Airflow na criação e operação de DAGs.
- Proficiência em Python para pipelines em nível de produção, utilitários de ingestão e conectores.
- Experiência com múltiplos padrões de ingestão: file drop/SFTP, CDC (Datastream), APIs SaaS, Pub/Sub e planilhas para o warehouse.
- Domínio de modelagem dimensional e normalizada, com mapeamento origem-destino, slowly changing dimensions e histórico de eventos.
- Conhecimento em qualidade de dados (freshness, completude, integridade referencial, schema drift) e em metadados e lineage.
- Proficiência em Git e CI/CD, GCS (landing zone, lifecycle, raw-to-standardized)
- Fundamentos de IAM.
- Inglês avançado/fluente para comunicação com o cliente.
Será um diferencial:
- Experiência com Terraform, contribuindo com módulos sobre um padrão já existente.
- Familiaridade com camada semântica de Power BI ou com Looker.
- Experiência com entrega de APIs no GCP (Cloud Run, API Gateway) para serviços baseados em data marts.
- Uso de desenvolvimento assistido por IA para scaffolding de conectores e geração de testes.
- Vivência em domínios de dados de real estate comercial ou serviços financeiros.
O que oferecemos
- Trabalho Remoto: Desfrute da flexibilidade de trabalhar de qualquer lugar do Brasil, com total autonomia e organização.
- Saúde e Bem estar: Plano de Saúde e Odontológico, Seguro de Vida e Wellhub (Gympass).
- +Educação: Descontos em cursos da FIAP e MBA USP Esalq para você continuar aprendendo e se desenvolvendo.
- Diferenciais exclusivos: Descontos em lojas Multilaser, bonificação por indicação de profissionais e negócios, horário adaptável e bônus anual.