Resposta direta: diferencie lentidão, intermitência e indisponibilidade medindo sucesso, erro e tempo de resposta durante um intervalo. Lentidão mantém a função acessível fora do desempenho esperado; intermitência alterna resultados; indisponibilidade impede a função. Classificar corretamente orienta prioridade, testes e comunicação.
Revisão técnica: 08/09/2026.
Defina a função observada
Especifique página, API, e-mail, banco ou outra operação e descreva o resultado esperado. Um servidor pode responder a ping enquanto a aplicação está indisponível. Avalie a jornada necessária ao usuário, com autenticação e dependências, em vez de usar apenas o estado de uma máquina.
Meça desempenho e sucesso
Registre latência por percentis, taxa de erro, volume e tempo de espera. Compare com linha de base no mesmo horário e perfil. Médias podem esconder picos. Use testes sintéticos e telemetria real com cuidado para distinguir uma experiência ampla de um único cliente ou rota.
Reconheça intermitência
Repita o teste com identificadores e horários precisos. Procure alternância por nó, processo, sessão, origem ou tipo de requisição. Balanceadores, pools e réplicas podem fazer uma tentativa funcionar e outra falhar. Preserve a sequência; um teste posterior bem-sucedido não invalida o erro anterior.
Correlacione recursos e logs
Compare CPU, memória, disco, rede, workers, conexões e filas ao período. Consulte logs conforme o guia de análise de registros do servidor. Se houver PHP e banco, aplique também o diagnóstico de erro 500 intermitente para isolar as camadas.
Comunique estado e impacto
Informe a função afetada, início, abrangência conhecida, mitigação e próximo boletim. Não use “fora do ar” quando parte das solicitações funciona nem “lentidão” para uma operação que sempre falha. Atualize a classificação quando novas evidências mostrarem impacto diferente e preserve o histórico.
Valide a recuperação
Repita testes por tempo e carga representativos e confirme as regiões e funções atingidas. Verifique filas acumuladas e efeitos residuais, como e-mails atrasados. Registre causa e ações no relatório pós-incidente e ajuste alertas para detectar tanto erros totais quanto degradação gradual.