123Vagas
Vagas Vagas Remotas Vagas Híbridas Cidades Skills Blog 123Vagas Plus Para Empresas

Ferramentas

Salário Líquido (CLT) CLT vs PJ Calculadora de Rescisão

Institucional

Sobre Como Funciona FAQ Contato Privacidade Termos de Uso

Sou candidato

Entrar / Criar conta

Sou empresa

Entrar como empresa Cadastrar empresa grátis
EX

Especialista em SRE (Site Reliability Engineering) Sênior II | Híbrido

Híbrido CLT Tecnologia 0 visualizações
SRE Observabilidade Kubernetes Terraform AWS

Sobre a Vaga

Buscamos um(a) Especialista em SRE para liderar tecnicamente a disciplina de Engenharia de Confiabilidade em um produto crítico. Você será responsável por definir a estratégia técnica de SRE, evoluir padrões de confiabilidade, observabilidade e automação, atuando como referência para o time e para a gestão de pessoas.

Responsabilidades

  • Conduzir tecnicamente e gerencialmente a equipe de SRE, apoiando desenvolvimento e evolução de carreira
  • Definir e aprimorar a estratégia de confiabilidade, observabilidade e excelência operacional
  • Atuar como referência em incidentes críticos, coordenando respostas e análises de causa raiz
  • Trabalhar em conjunto com Arquitetura, Desenvolvimento, Segurança e Produto para evolução de plataformas
  • Conduzir rituais operacionais, revisão de incidentes, capacity planning e gestão de riscos
  • Promover cultura de automação e melhoria contínua, com foco em prevenção
  • Garantir adoção de boas práticas de SRE, DevOps e Engenharia de Plataforma
  • Apoiar a priorização de débitos técnicos e iniciativas de confiabilidade junto às áreas de negócio

Requisitos

  • Experiência comprovada liderando equipes técnicas de SRE, DevOps ou Plataforma
  • Vivência com gestão de pessoas e influência entre áreas sem autoridade direta
  • Experiência em gestão de incidentes críticos e crises
  • Forte capacidade analítica e decisões orientadas por dados
  • Conhecimentos em Kubernetes (EKS/OpenShift), Docker e AWS
  • Experiência com Terraform e pipelines CI/CD (GitHub Actions, Jenkins ou similares)
  • Domínio de observabilidade (Dynatrace, Datadog, Grafana, Prometheus, ELK, OpenTelemetry)
  • Conhecimento de Linux, redes e protocolos (DNS, HTTP, TLS) e balanceadores
  • Automação com Python, Go ou Shell Script e práticas de Infraestrutura como Código (IaC)
  • Experiência com alta disponibilidade, performance, resiliência, disaster recovery e chaos engineering
  • Familiaridade com DevSecOps e gestão de vulnerabilidades

Beneficios

  • Ambiente de trabalho com foco em bem-estar e cultura inclusiva
  • Oportunidades de desenvolvimento profissional e evolução técnica
  • Reconhecimentos como Great Place To Work e Top Employers
Esta vaga foi curada e enriquecida pelo 123Vagas para facilitar sua busca. A candidatura é feita no site original: jobs.smartrecruiters.com. Saiba como funciona.
Publicada em 30 de julho de 2026
Compartilhar:
Candidatar-se