Plataforma Serasa

De uma arquitetura acoplada a uma plataforma capaz de sustentar escala

Liderança de uma transformação que combinou performance, confiabilidade, arquitetura e modelo operacional para produtos como Limpa Nome, eCred e Premium.

43 miusuários registrados
260 miacessos por mês
20 mil/spico sustentado por 10 min
0–1incidente/mês após a mudança

O desafio

Produtos estratégicos cresceram rapidamente, mas integrações críticas, dependências de mainframe e capacidades duplicadas criaram uma arquitetura altamente acoplada. Campanhas de marketing frequentemente causavam incidentes e algumas jornadas levavam quase quatro minutos.

Antes

  • Escala reativa e cara durante incidentes
  • Responsabilidade difusa entre plataforma e verticais
  • Operações pesadas dentro da jornada síncrona
  • Falhas recorrentes em campanhas
→

Ambição

  • Capacidades comuns centralizadas e reutilizáveis
  • Ownership claro ponta a ponta
  • Processamento assíncrono e observável
  • Capacidade planejada antes das campanhas

O que eu liderei pessoalmente

Plataforma compartilhada

Liderança direta de oito engenheiros responsáveis pela base usada por Limpa Nome, eCred e Premium.

Coordenação transversal

Alinhamento de SRE, DevOps, infraestrutura, produto, segurança e gestores das unidades de negócio.

Direção e prioridades

Estratégia da plataforma, jornadas críticas e requisitos de LGPD, fraude, acesso, performance e confiabilidade.

A decisão-chave

Parar de tratar cada falha como um incidente isolado. Mapeamos as jornadas ponta a ponta e priorizamos gargalos por impacto no cliente, risco operacional, escalabilidade e potencial de reutilização.
1

Mapear

Latência, mainframe, integrações, duplicações e ownership.

2

Priorizar

Impacto, risco, escala e capacidade de reuso.

3

Desacoplar

Cache, Go, Redis, filas, retries e observabilidade.

4

Operar

Capacity planning e contingência antes das campanhas.

Execução em duas frentes

1 · Cadastro Positivo

Cache escalável, enriquecimento com Redis e serviços cloud em Go reduziram a dependência do processamento remoto em São Paulo e do mainframe.

Entrega: ≈ 1 mês

2 · Limpa Nome

Operações pesadas saíram do caminho síncrono; entraram processamento assíncrono, retries seguros, tratamento de falhas e melhor observabilidade.

Transformação: ≈ 2 meses

3 · Campanhas

Produto, SRE, DevOps e infraestrutura passaram a revisar tráfego, escala, monitoramento e contingência antecipadamente.

Modelo: planejamento contínuo

Resultados mensuráveis

Latência da jornada crítica≈ 4 min → 200 ms
Incidentes operacionais≈ 20/mês → 0–1/mês
Capacidade de campanha2× o tráfego anterior

Escala comprovada

Picos de aproximadamente 20 mil acessos por segundo durante dez minutos.

Campanhas estáveis

Produção deixou de cair durante campanhas de marketing.

Custo evitado

Fim da dependência de escaladas emergenciais de até dez máquinas por dez horas.

Valores aproximados conforme registros do projeto.

Aprendizado de liderança

O problema não era apenas performance. Era arquitetura, ownership e modelo operacional. Centralizar capacidades compartilhadas, esclarecer responsabilidades e substituir escala reativa por planejamento permitiu crescer com mais confiança, menor custo e maior confiabilidade.
Case de liderança em engenharia e plataformasSerasa Experian · 2021

Rolar para cima