123Vagas
Vagas Vagas Remotas Vagas Híbridas Cidades Skills Blog 123Vagas Plus Para Empresas

Ferramentas

Gerador de Currículo Novo Salário Líquido (CLT) CLT vs PJ Calculadora de Rescisão

Institucional

Sobre Como Funciona FAQ Contato Privacidade Termos de Uso

Sou candidato

Entrar / Criar conta

Sou empresa

Entrar como empresa Cadastrar empresa grátis
EX

Especialista de SRE II (Site Reliability Engineering) | Liderança | Híbrido

Híbrido CLT Tecnologia 0 visualizações
SRE e Engenharia de Confiabilidade Observabilidade (OpenTelemetry, Prometheus, Grafana, ELK) Kubernetes (EKS/OpenShift) e AWS

Sobre a Vaga

Buscamos um profissional para liderar tecnicamente a disciplina de Engenharia de Confiabilidade (SRE) em um produto crítico. Você será responsável por definir a estratégia técnica de SRE, evoluir padrões de engenharia, observabilidade e automação, além de atuar como referência para incidentes críticos e para o desenvolvimento do time.

Responsabilidades

  • Liderar técnica e gerencialmente o time de SRE, apoiando desenvolvimento e evolução de carreira
  • Definir e aprimorar a estratégia de confiabilidade, observabilidade e excelência operacional
  • Atuar como referência técnica em incidentes críticos, coordenando respostas e análises de causa raiz
  • Trabalhar em parceria com Arquitetura, Desenvolvimento, Segurança e Produto para evolução de plataformas
  • Impulsionar cultura de automação e melhoria contínua
  • Garantir adoção de boas práticas de SRE, DevOps e Engenharia de Plataforma
  • Apoiar a priorização de débitos técnicos e iniciativas de confiabilidade com as áreas de negócio

Requisitos

  • Experiência comprovada liderando equipes técnicas de SRE, DevOps ou Plataforma
  • Experiência com gestão de pessoas e habilidade para influenciar times sem autoridade direta
  • Capacidade de conduzir gestão de incidentes críticos e crises com tomada de decisão baseada em dados
  • Conhecimentos em Kubernetes (EKS/OpenShift), Docker e AWS
  • Vivência com Terraform e ferramentas de CI/CD (GitHub Actions, Jenkins ou similares)
  • Experiência em observabilidade (Dynatrace, Datadog, Grafana, Prometheus, ELK, OpenTelemetry)
  • Domínio de Linux e redes (DNS, HTTP, TLS, balanceadores)
  • Automação com Python, Go ou Shell Script e práticas de Infraestrutura como Código (IaC)
  • Conhecimento em engenharia de performance, resiliência, alta disponibilidade, disaster recovery e chaos engineering
  • Práticas de DevSecOps e gestão de vulnerabilidades

Beneficios

  • Ambiente colaborativo com foco em pessoas e bem-estar
  • Oportunidade de atuar em produto crítico com impacto direto em disponibilidade e eficiência
  • Programas de desenvolvimento e cultura de melhoria contínua
Esta vaga foi curada e enriquecida pelo 123Vagas para facilitar sua busca. A candidatura é feita no site original: jobs.smartrecruiters.com. Saiba como funciona.
Publicada em 31 de julho de 2026
Compartilhar:
Candidatar-se