Antes de começar
Você precisa de uma conta de monitoramento e uma URL para monitorar. Só isso. Sem código para implantar. Sem agente para instalar. Sem arquivos de configuração para editar.
Se você ainda não tem uma conta, o plano gratuito do PingWatchdog oferece 15 monitores, verificações a cada 5 minutos, monitoramento SSL, monitoramento heartbeat e uma página de status com sua marca. Sem necessidade de cartão de crédito.
Passo 1: Adicione seu primeiro monitor
Vá ao seu painel e clique em “Adicionar monitor”. Você verá um formulário com alguns campos.
URL: Insira a URL completa que você deseja monitorar. Use o endpoint exato que seus usuários acessam. Para um site, é https://seusite.com. Para uma API, use o endpoint específico como https://api.seusite.com/v1/health.
Tipo de verificação: Escolha HTTP para sites e APIs. Escolha TCP para bancos de dados, servidores de e-mail ou portas personalizadas. Escolha UDP para servidores de jogos ou DNS (disponível em planos pagos).
Intervalo de verificação: Com que frequência devemos verificar? Comece com 5 minutos enquanto você testa. Você pode reduzir isso depois. Planos pagos chegam a 30 segundos.
Regiões: Escolha de onde verificar. Mais regiões dão mais confiança de que um alerta significa “o site está fora do ar globalmente” em vez de “o site está lento de um local”.
Canais de alerta: Escolha para onde os alertas vão. E-mail funciona para testes. Adicione Slack ou Discord para sua equipe. Adicione PagerDuty para plantão.
Clique em “Criar monitor”. Pronto. Seu site agora está sendo monitorado.
Passo 2: Teste seus alertas
Não espere uma queda real para descobrir se seus alertas funcionam. Teste-os agora.
A maioria das ferramentas de monitoramento tem um botão “testar alerta”. Clique nele. Você deve receber uma notificação no canal que configurou. Se não receber, verifique a configuração do canal de alerta.
Para Slack ou Discord, certifique-se de que a URL do webhook está correta e que o bot tem permissão para postar naquele canal. Para e-mail, verifique sua pasta de spam e coloque o endereço de envio do serviço de monitoramento na lista de permissões.
Passo 3: Configure as definições de alerta
Alertas só são úteis se alcançam as pessoas certas sem causar fadiga de alertas. Reserve alguns minutos para ajustar suas configurações.
Escalonamento de alertas: Defina um limite para não ser notificado a cada pico transitório. Um limite de 2 ou 3 falhas consecutivas filtra interrupções de rede de 30 segundos. Você só é alertado quando o problema persiste.
Horas de silêncio: Se você faz manutenção programada aos domingos às 3h da manhã, defina horas de silêncio para que sua equipe não seja acordada por trabalho planejado. As horas de silêncio são por monitor, então você pode suprimir alertas em monitores não críticos fora do horário mantendo os críticos ativos.
Roteamento de canais: Monitores diferentes, canais diferentes. Monitores críticos de produção vão para o PagerDuty. Monitores de staging vão para um canal do Slack. Monitores de baixa prioridade vão por e-mail. Isso mantém seus canais principais de alerta limpos.
Passo 4: Adicione mais monitores
Seu primeiro monitor foi sua página inicial. Bom começo. Agora adicione os endpoints que importam.
Sua API: Se sua aplicação depende de uma API, monitore a API diretamente. Uma página inicial saudável não significa uma API saudável.
Seus fluxos de login e checkout: Monitore as páginas onde os usuários agem, não apenas navegam. Um checkout quebrado custa dinheiro. Um login quebrado bloqueia os usuários.
Seu banco de dados e cache: Adicione monitores TCP para a porta do seu banco de dados (geralmente 5432 para PostgreSQL, 6379 para Redis). Eles informam se o serviço está aceitando conexões, não apenas se o servidor está no ar.
Seus jobs em segundo plano: Adicione monitores heartbeat para tarefas agendadas críticas. Backups de banco de dados, filas de e-mail, sincronizações de dados. Eles rodam silenciosamente. Se falharem, você pode não perceber por semanas. Saiba mais sobre monitoramento heartbeat.
Seus certificados SSL: Adicione monitores SSL para cada domínio que você possui. Você recebe alertas 30, 14 e 7 dias antes da expiração. A expiração de certificados é uma das causas mais evitáveis de tempo de inatividade. Saiba mais sobre monitoramento SSL.
Passo 5: Compartilhe sua página de status
Se sua ferramenta de monitoramento incluir páginas de status, configure uma. Uma página de status responde à pergunta “caiu ou é só comigo?” antes que seus usuários entrem em contato.
Escolha quais monitores aparecem na página. Geralmente são seus serviços voltados ao público: site, API, painel. Monitores internos (banco de dados, jobs em segundo plano) permanecem privados.
Personalize a página com seu logo e cores. Em planos pagos, use seu próprio domínio (status.suaempresa.com). Compartilhe a URL no rodapé do seu app, na documentação de suporte e na sua bio do Twitter.
Quando um incidente acontece, sua página de status se atualiza automaticamente. Os usuários veem o estado atual sem entrar em contato com você. Durante o incidente, publique atualizações para que os usuários saibam que você está trabalhando nisso. Saiba mais sobre páginas de status.
O que fazer quando receber um alerta
Seu telefone vibra. Um monitor caiu. E agora?
Primeiro, verifique. Acesse o site você mesmo. Às vezes, é realmente só com você. Se o site carrega para você, mas a sonda reporta que está fora do ar, pode haver um problema de rede regional.
Se o site estiver realmente fora do ar, verifique as coisas óbvias: seu provedor de hospedagem teve um incidente? Você implantou recentemente? Um certificado expirou? Você atingiu um limite de taxa ou ficou sem espaço em disco?
Corrija o problema. Depois atualize sua página de status para que os usuários saibam que você está cuidando disso. Após a recuperação, revise a linha do tempo do incidente. O que falhou? Quanto tempo levou para detectar? Quanto tempo para corrigir? Use esses dados para melhorar.
Próximos passos
Agora você tem o monitoramento configurado. Seu site está sendo verificado. Você recebe alertas quando algo dá errado. Aqui está o que fazer a seguir:
- Compare o PingWatchdog com o UptimeRobot para ver como nos comparamos com a ferramenta gratuita mais popular
- Configure o monitoramento de certificados SSL se ainda não o fez
- Saiba mais sobre gerenciamento de incidentes para rastrear eventos de queda automaticamente
Comece com 15 monitores gratuitos. Veja nossos planos quando estiver pronto para verificações mais rápidas e mais recursos.