O que um software de monitoramento de sites realmente faz
Um software de monitoramento de sites é um conjunto de máquinas fora da sua infraestrutura que abrem o seu site em um cronograma, em seu nome, e avisam você no momento em que a resposta deixa de ser a que você espera. Essa é toda a ideia. Tudo o mais nesta página é um detalhe sobre o que conta como a resposta: um código de status, um trecho de texto na página, um tempo de resposta, um campo JSON, uma data de expiração de certificado, uma leitura de CPU, ou o resultado de um checkout de cinco etapas.
O motivo de ele precisar ser executado de fora é que as falhas sobre as quais você mais precisa saber são invisíveis de dentro. Um servidor cujo disco está cheio ainda se reporta saudável ao seu próprio painel. Um registro DNS que aponta para um endereço desativado resolve perfeitamente bem a partir do escritório onde o cache está aquecido. Um certificado que expirou às 2 da manhã quebra todo navegador do mundo enquanto o seu próprio balanceador de carga continua respondendo. O monitoramento externo de uptime é o que fecha essa lacuna, porque ele vê exatamente o que um visitante vê.
O segundo motivo é a evidência. Quando sua hospedagem diz que a interrupção durou quatro minutos e seus clientes dizem que durou uma hora, um registro independente de cada verificação, de cada local, com carimbos de data e hora, resolve a discussão. Esse registro também é a base de um relatório mensal de uptime e de uma página de status pública.
- Etapa 1VerificarUm checkpoint executa sua verificação no intervalo que você definir, com até uma vez por minuto, a partir dos locais que você escolheu.
- Etapa 2ConfirmarUma falha é reverificada a partir de outros checkpoints antes que algo seja declarado como fora do ar, para que uma única rota ruim não seja considerada uma indisponibilidade.
- Etapa 3AlertarOs contatos inscritos naquele monitor são notificados pelos canais que escolheram, e novamente quando o site se recupera.
- Etapa 4RegistrarCada resultado é mantido com seu local e tempo, alimentando os números de uptime, o histórico de incidentes e os relatórios.