# Staff Platform Engineer

**Empresa:** Cobli
**Local:** São Paulo, SP
**Modalidade:** Presencial
**Contrato:** CLT
**Publicada em:** 2026-10-05

## Descrição

Sobre a vaga

Se voc&ecirc; curte construir a plataforma sobre a qual dezenas de engenheiros entregam produto, e quer ver o efeito disso em milh&otilde;es de km rodados e na seguran&ccedil;a de motoristas reais, esse desafio &eacute; pra voc&ecirc;.

Como Staff Engineer de Infra &amp; DevTools, voc&ecirc; vai liderar a execu&ccedil;&atilde;o t&eacute;cnica dos projetos mais importantes da Cobli. Voc&ecirc; prop&otilde;e e implementa solu&ccedil;&otilde;es de infraestrutura em nuvem e de ferramentas internas que tornam o desenvolvimento f&aacute;cil, r&aacute;pido, eficiente e escal&aacute;vel para as squads de Produto, Hardware e Dados.

No dia a dia, o foco do time est&aacute; nos aspectos comuns a toda a plataforma: custo, seguran&ccedil;a e observabilidade.

Na pr&aacute;tica, isso significa cuidar de clusters Kubernetes na AWS que processam telemetria e v&iacute;deo de frotas em tempo real, dos caminhos padronizados (Golden Paths) da nossa Internal Developer Platform, da observabilidade e do custo da nuvem.

Responsabilidades e atribui&ccedil;&otilde;es

Propor e evoluir a arquitetura da plataforma (Kubernetes/EKS, rede, IaC, CI/CD, IDP), usando dados para priorizar melhorias alinhadas &agrave;s metas da &aacute;rea.

Liderar a execu&ccedil;&atilde;o t&eacute;cnica de projetos importantes da plataforma, coordenando com as squads impactadas, como upgrades de EKS, migra&ccedil;&otilde;es de Karpenter e de ingress e mudan&ccedil;as no modelo de gest&atilde;o de cargas.

Escrever e revisar design docs e ADRs, explicitando trade-offs entre confiabilidade, custo, seguran&ccedil;a e velocidade de entrega.

Identificar gaps nos fluxos de desenvolvimento e propor padr&otilde;es de plataforma (Golden Paths, templates, pol&iacute;ticas), apoiando (e liderando) a ado&ccedil;&atilde;o pelas squads.

Evoluir a Internal Developer Platform com base nas dores dos times, propondo o que construir, adotar ou descontinuar (build vs. buy)

Evoluir a observabilidade (Datadog) e as pr&aacute;ticas de FinOps: ownership de alertas e de custo por squad, cobertura de tags e redu&ccedil;&atilde;o de custo AWS.

Implementar e evoluir pr&aacute;ticas de seguran&ccedil;a na infraestrutura e do ciclo de desenvolvimento junto a SecOps (IAM, segredos, Cognito, desenvolvimento seguro).

Ser a refer&ecirc;ncia de escala&ccedil;&atilde;o t&eacute;cnica em problemas complexos de infraestrutura e performance

Elevar o n&iacute;vel t&eacute;cnico do time por meio de revis&atilde;o de c&oacute;digo e de design, pareamento e mentoria t&eacute;cnica.

Ser agente ativo na ado&ccedil;&atilde;o de IA na opera&ccedil;&atilde;o da plataforma: automa&ccedil;&atilde;o operacional, investiga&ccedil;&atilde;o de incidentes e ferramentas que aumentem a produtividade das squads.

Seguir hands-on, implementando as partes mais cr&iacute;ticas das iniciativas que lidera.

Requisitos obrigat&oacute;rios

Experi&ecirc;ncia s&oacute;lida em infraestrutura, SRE, DevOps ou Platform Engineering, com parte relevante em produ&ccedil;&atilde;o de alto volume.

Hist&oacute;rico de liderar a execu&ccedil;&atilde;o t&eacute;cnica de projetos de plataforma complexos, coordenando com outras equipes do design &agrave; ado&ccedil;&atilde;o.

Experi&ecirc;ncia propondo solu&ccedil;&otilde;es de arquitetura com trade-offs documentados (design docs, ADRs).

Dom&iacute;nio profundo de AWS (EKS, EC2, VPC, IAM, S3, RDS ou equivalentes), incluindo desenho de rede, multi-conta e modelo de permiss&otilde;es.

Dom&iacute;nio de Kubernetes em produ&ccedil;&atilde;o: opera&ccedil;&atilde;o multi-cluster, upgrades sem downtime, autoscaling, networking e troubleshooting avan&ccedil;ado.

Infraestrutura como c&oacute;digo com Terraform e empacotamento de aplica&ccedil;&otilde;es com Helm, incluindo m&oacute;dulos e padr&otilde;es reutiliz&aacute;veis por outros times.

CI/CD (CircleCI ou similar), com experi&ecirc;ncia evoluindo fluxos de deploy usados por v&aacute;rios times, e no&ccedil;&otilde;es de GitOps.

Experi&ecirc;ncia construindo ou evoluindo uma plataforma interna de desenvolvimento (self-service, templates, cat&aacute;logo), tratando outros engenheiros como clientes.

Confiabilidade e observabilidade: SLIs/SLOs, error budgets, estrat&eacute;gia de alertas e an&aacute;lise de logs, m&eacute;tricas e traces (Datadog ou equivalente), usando esses dados para priorizar melhorias.

Programa&ccedil;&atilde;o para automa&ccedil;&atilde;o e ferramentas internas (Python, Go ou similar) com qualidade de c&oacute;digo de produ&ccedil;&atilde;o.

Lideran&ccedil;a de incidentes de alta severidade e de post-mortems.

Fundamentos s&oacute;lidos de Linux, redes (DNS, TLS, load balancing) e seguran&ccedil;a em nuvem.

Experi&ecirc;ncia pr&aacute;tica usando IA para acelerar a engenharia, elevando a produtividade do time e n&atilde;o apenas a pr&oacute;pria.

Ingl&ecirc;s avan&ccedil;ado para leitura t&eacute;cnica.

Diferenciais

Experi&ecirc;ncia com Karpenter, Emissary-ingress/Envoy ou service mesh.

Experi&ecirc;ncia pr&aacute;tica com Flux ou outra ferramenta de GitOps (ex.: ArgoCD).

Opera&ccedil;&atilde;o de bancos distribu&iacute;dos (ScyllaDB, Cassandra) ou sistemas de streaming (Kafka, Kinesis).

Pr&aacute;tica de FinOps em AWS: aloca&ccedil;&atilde;o de custo por time, tagging, Savings Plans e rightsizing.

Conhecimento de DevSecOps: scanning de imagens e depend&ecirc;ncias, pol&iacute;ticas de admiss&atilde;o, gest&atilde;o de segredos.

Viv&ecirc;ncia com o ecossistema JVM em produ&ccedil;&atilde;o (tuning de mem&oacute;ria, heap dumps, profiling).

Contato com plataformas de dados (Snowflake, data warehouses) do ponto de vista de infraestrutura.

Gest&atilde;o de infraestrutura para IA: controle de consumo e custo de tokens de LLMs (gateways, quotas e observabilidade de uso por squad) e MLOps (pipelines de treino e deploy de modelos, serving com GPU no Kubernetes, versionamento e monitoramento de modelos em produ&ccedil;&atilde;o).

## Habilidades

- Infraestrutura
- DevOps
- Kubernetes
- AWS
- Terraform
- CI/CD
- Python
- Go

**Página original:** https://www.123vagas.com.br/vaga/staff-platform-engineer-sao-paulo-sp-95846
