Pular para conteúdo

Runbook — Redis (Down, MemoryExhausted)

Severidade: P0/P1 · Impacto: cache/sessões indisponíveis; aplicações degradadas.

Verificação

  1. docker ps | grep redis; docker logs --tail 100 redis.
  2. Memória: docker exec redis redis-cli -a "$REDIS_PASSWORD" info memory | grep -E 'used_memory_human|maxmemory_human|maxmemory_policy'.

Causas prováveis

  • Down: container parado; OOM do host; disco cheio impedindo persistência.
  • Memória: chaves sem TTL acumulando; maxmemory subdimensionado.

Ação

  1. Down: subir via compose em /opt/pagesaude/services/cache/redis.
  2. Memória: verificar maxmemory_policy; se noeviction, escritas falharão — identificar chaves grandes (redis-cli --bigkeys) e aplicar TTL/limpeza com o time da aplicação; ajustar maxmemory no compose se subdimensionado.

Escalonamento

Aplicações tratam falha de cache como fatal? Se sim e Redis não voltar em 10 min, incidente de aplicação em paralelo.