Comece medindo
- Monitoramento externo: um serviço que acessa o sistema a cada minuto e avisa quando cai
- Horários: as quedas coincidem com horário de pico, rotinas noturnas, backups?
- Recursos: uso de memória, CPU e disco no servidor no momento da queda
- Logs: erros da aplicação, do servidor web e do banco de dados
Causas frequentes
| Causa | Sinal típico |
|---|---|
| Falta de memória | Processos encerrados pelo sistema operacional, quedas sob carga |
| Disco cheio | Logs ou uploads acumulados; erros ao gravar |
| Consultas pesadas | Banco de dados com uso alto antes da queda |
| Tarefas longas na requisição | Relatórios e importações travando o servidor |
| Pico de acessos | Quedas em campanhas, datas ou horários específicos |
| Serviço externo | Sistema espera uma API que não responde |
Correção: causa, não sintoma
Reiniciar o servidor resolve por algumas horas, mas não corrige nada. Aumentar o servidor às vezes ajuda, outras vezes só adia o problema. Veja servidor mais potente resolve a lentidão?. As correções duradouras costumam envolver otimizar consultas, mover tarefas pesadas para filas e limitar o tempo de espera por serviços externos.
Leia também
Se o sistema fica lento antes de cair, veja sistema trava quando muitos usuários acessam e sistema consome muita memória. Para evitar novas quedas, veja manutenção preventiva.
Investigamos e corrigimos quedas em sistemas existentes no nosso serviço de manutenção de sistemas PHP e Laravel.