Skills
Sobre a Vaga
Na Dock, você vai atuar no time de Database Reliability Engineering (DBRE), responsável por definir, construir, administrar e evoluir a infraestrutura de dados. O foco da função é garantir alta disponibilidade, desempenho, segurança e confiabilidade dos ambientes SQL Server, incluindo cenários críticos e com grande volume de dados.
Responsabilidades
- Administrar e sustentar ambientes críticos de SQL Server, assegurando disponibilidade, desempenho e segurança
- Planejar e executar migrações, upgrades, aplicação de patches e modernização de ambientes
- Configurar e realizar troubleshooting de alta disponibilidade e recuperação de desastres
- Conduzir análise avançada de performance (consultas, índices, planos de execução, bloqueios, deadlocks, waits, CPU, memória, armazenamento e rede)
- Atuar na resolução técnica de incidentes críticos e executar análise de causa raiz com ações corretivas e preventivas
- Elaborar e revisar planos de mudança com rollback, contingência e validação em produção
- Definir e acompanhar estratégias de backup, restore, retenção, point-in-time recovery e disaster recovery
- Realizar testes periódicos de recuperação e evoluir monitorações, alertas e observabilidade
- Desenvolver automações para rotinas operacionais, provisionamento e validações
- Apoiar iniciativas de segurança, auditoria, compliance e boas práticas
- Produzir documentação técnica, procedimentos operacionais e post-mortems
- Atuar em conjunto com times de Desenvolvimento, Infraestrutura, Cloud, Segurança, Observabilidade e Arquitetura
- Contribuir com mentoria e compartilhamento de conhecimento para profissionais juniores e plenos
- Participar dos processos de gestão de incidentes, problemas, mudanças e atendimento seguindo práticas ITIL
Requisitos
- Experiência sólida com instalação, configuração, administração e troubleshooting de SQL Server
- Atuação em ambientes produtivos críticos, com alta disponibilidade e grande volume de dados
- Conhecimento avançado em Always On Availability Groups, Failover Cluster Instances, replicação ou tecnologias equivalentes
- Experiência com troubleshooting avançado de performance e análise de planos de execução, bloqueios, deadlocks e waits
- Domínio de backup, restore, point-in-time recovery e disaster recovery
- Experiência com migrações, upgrades de versão e manutenção com aplicação de patches
- Conhecimentos em segurança no SQL Server (permissões, autenticação, criptografia e auditoria)
- Experiência com monitoramento, observabilidade e capacidade
- Experiência com cloud, preferencialmente Microsoft Azure (também com AWS/RDS e OCI)
- Capacidade de conduzir incidentes críticos e documentar planos de mudança, rollback e contingência
- Vivência com gestão de incidentes, problemas e mudanças
- Disponibilidade para atuar em escala 12x36
Beneficios
- Auxílio alimentação (mercado & restaurante)
- Plano de saúde e odontológico
- Hospital digital
- Suporte psicológico para psicoterapia online
- Wellhub e TotalPass
- Auxílio mensal para despesas remote first
- Previdência privada após 6 meses de trabalho
- Licença parental estendida e auxílio creche
- Plataforma de idiomas e disponibilidade de coworking no Brasil inteiro