Especialista de SRE II

ExperianSão PauloJob.bopublished 07/31/2026
Must-have:PythonGitAWSDockerKubernetesDevOpsCI/CDPrincipal

A Experian é uma empresa global de dados e tecnologia que impulsiona oportunidades para pessoas e empresas ao redor do mundo. Atuamos em diversos mercados, como serviços financeiros, saúde, automotivo, agronegócio, seguros, entre outros. A Experian investe em pessoas e em novas tecnologias avançadas para liberar o poder dos dados. Contamos com uma equipe incrível de 25.200 colaboradores em 32 países.

Nossa singularidade é valorizar a sua. A cultura da Experian, centrada nas pessoas, inclusiva e orientada por propósito, é reconhecida por diversos prêmios — incluindo World’s Best Workplaces™ 2025 (Top 25 global da Fortune) e Great Place To Work™ em 26 países, entre outros. Confira o Experian Life nas redes sociais ou explore nosso site de carreiras para entender o porquê. A Experian também se orgulha de ser uma empregadora que promove igualdade de oportunidades e ação afirmativa.

Descrição do trabalho Estamos à procura de um Principal Site Reliability Engineer para liderar tecnicamente a disciplina de Engenharia de Confiabilidade de um produto crítico da companhia.  Esse profissional será responsável por definir a estratégia técnica de SRE, evoluir padrões de engenharia, confiabilidade, observabilidade e automação, além de atuar como referência técnica para o time e gestor das pessoas que compõem a equipe.  Esperamos um profissional com forte capacidade de liderança, visão sistêmica, excelente tomada de decisão e habilidade para influenciar diferentes áreas de tecnologia e negócio, garantindo alta disponibilidade, resiliência e eficiência operacional dos serviços.  Responsabilidades Diárias  Liderar técnica e gerencialmente o time de SRE, promovendo desenvolvimento técnico e de carreira dos engenheiros;  

Definir e evoluir a estratégia de confiabilidade, observabilidade e excelência operacional dos produtos;  

Atuar como principal referência técnica em incidentes críticos, coordenando respostas e análises de causa raiz;  

Trabalhar em conjunto com Arquitetura, Desenvolvimento, Segurança e Produto na evolução das plataformas;  

Conduzir rituais de operação, revisão de incidentes, capacity planning e gestão de riscos;  

Promover cultura de automação e melhoria contínua;  

Garantir adoção de boas práticas de SRE, DevOps e Engenharia de Plataforma;  

Apoiar a priorização de débitos técnicos e iniciativas de confiabilidade junto às áreas de negócio.  

Principais Entregas  Evolução dos indicadores de disponibilidade, confiabilidade e performance dos produtos;  

Definição e acompanhamento de SLIs, SLOs e Error Budgets;  

Evolução da plataforma de observabilidade (Logs, Métricas, Traces e APM);  

Automação de processos operacionais reduzindo atividades manuais;  

Redução do MTTR e aumento da capacidade de prevenção de incidentes;  

Estruturação de Post Mortems sem culpabilização (Blameless);  

Implantação de práticas de Chaos Engineering, Disaster Recovery e Capacity Planning;  

Definição de padrões técnicos para infraestrutura, monitoramento e operação;  

Desenvolvimento técnico da equipe através de mentoring, feedbacks, dojos e comunidades técnicas.  

O que estamos buscando em você  Liderança  Experiência comprovada liderando equipes técnicas de SRE, DevOps ou Plataforma;  

Experiência como gestor de pessoas;  

Capacidade de influenciar diferentes áreas sem autoridade direta;  

Excelente comunicação executiva e técnica;  

Experiência na gestão de incidentes críticos e crises;  

Forte capacidade analítica e tomada de decisão baseada em dados.  

Qualificações

Conhecimentos Técnicos  Kubernetes (EKS/OpenShift)  

Docker  

AWS  

Terraform  

GitHub Actions, Jenkins ou outras ferramentas CI/CD  

Observabilidade (Dynatrace, Datadog, Grafana, Prometheus, ELK, OpenTelemetry)  

Linux  

Redes, DNS, HTTP, TLS e balanceadores  

Automação utilizando Python, Go ou Shell Script  

Infraestrutura como Código (IaC)  

Engenharia de Performance  

Resiliência e Alta Disponibilidade  

Gestão de Capacidade  

Disaster Recovery  

Chaos Engineering  

Gestão de Vulnerabilidades  

Práticas DevSecOps  

Será um diferencial  Certificações AWS Professional ou Specialty;  

Certificação Kubernetes (CKA/CKS);  

Experiência com Service Mesh (Istio);  

Experiência com Backstage ou Platform Engineering;  

Conhecimento em FinOps;  

Experiência em ambientes regulados e produtos de missão crítica;  

Vivência com arquitetura orientada a eventos (Kafka, RabbitMQ). 

A Serasa Experian é muito mais do que você imagina. Com o propósito de criar um futuro melhor, ampliando oportunidades para pessoas e empresas, no Brasil somos mais de 4 mil pessoas que atuam em diversos times e especialidades. Aqui, cada conhecimento e diversidade se complementa e você pode trabalhar no que mais ama, estamos comprometidos a construir uma cultura inclusiva e um ambiente no qual pessoas possam equilibrar a carreira com seus compromissos e interesses pessoais, prezando pelo bem-estar. A gente se dedica muito em ser uma das melhores e mais inovadoras empresas para se trabalhar do país, possibilitando experiências e carreiras incríveis para nossas pessoas. Nossa forte abordagem de pessoas em primeiro lugar é reconhecida externamente por meio de diversas certificações de mercado: fomos premiados pelo Great Place To Work™ em 24 países e pela certificação internacional Top Employers, além de sermos reconhecidos como uma das melhores empresas para jovens profissionais e contarmos com uma avaliação de 4,6 no Glassdoor. Cada reconhecimento nos indica que estamos no caminho certo, proporcionando um ambiente de trabalho cada vez melhor para nossos talentos.

Experian Careers - Creating a better tomorrow together Find out what its like to work for Experian by clicking here