Status de Servidores

Lentidão, intermitência ou indisponibilidade?

Aprenda a distinguir lentidão, intermitência e indisponibilidade por métricas, escopo e testes para diagnosticar e comunicar corretamente.

Resposta direta: diferencie lentidão, intermitência e indisponibilidade medindo sucesso, erro e tempo de resposta durante um intervalo. Lentidão mantém a função acessível fora do desempenho esperado; intermitência alterna resultados; indisponibilidade impede a função. Classificar corretamente orienta prioridade, testes e comunicação.

Revisão técnica: 08/09/2026.

Defina a função observada

Especifique página, API, e-mail, banco ou outra operação e descreva o resultado esperado. Um servidor pode responder a ping enquanto a aplicação está indisponível. Avalie a jornada necessária ao usuário, com autenticação e dependências, em vez de usar apenas o estado de uma máquina.

Meça desempenho e sucesso

Registre latência por percentis, taxa de erro, volume e tempo de espera. Compare com linha de base no mesmo horário e perfil. Médias podem esconder picos. Use testes sintéticos e telemetria real com cuidado para distinguir uma experiência ampla de um único cliente ou rota.

Reconheça intermitência

Repita o teste com identificadores e horários precisos. Procure alternância por nó, processo, sessão, origem ou tipo de requisição. Balanceadores, pools e réplicas podem fazer uma tentativa funcionar e outra falhar. Preserve a sequência; um teste posterior bem-sucedido não invalida o erro anterior.

Correlacione recursos e logs

Compare CPU, memória, disco, rede, workers, conexões e filas ao período. Consulte logs conforme o guia de análise de registros do servidor. Se houver PHP e banco, aplique também o diagnóstico de erro 500 intermitente para isolar as camadas.

Comunique estado e impacto

Informe a função afetada, início, abrangência conhecida, mitigação e próximo boletim. Não use “fora do ar” quando parte das solicitações funciona nem “lentidão” para uma operação que sempre falha. Atualize a classificação quando novas evidências mostrarem impacto diferente e preserve o histórico.

Valide a recuperação

Repita testes por tempo e carga representativos e confirme as regiões e funções atingidas. Verifique filas acumuladas e efeitos residuais, como e-mails atrasados. Registre causa e ações no relatório pós-incidente e ajuste alertas para detectar tanto erros totais quanto degradação gradual.