Políticas de escalonamento de incidentes que alertam até alguém responder.
Um alerta sem resposta tem de chegar a outra pessoa. Uma política de escalonamento faz o incidente subir pelos níveis, ao seu ritmo, parando assim que alguém o confirma.
Dry run
example incident · recomputed as you editO alerta a que ninguém respondeu
Uma terça-feira à noite: o checkout deixa de funcionar e o incidente é confirmado. O engenheiro de plantão está dormindo, o celular está virado para baixo, e passam cinco minutos sem resposta.
Uma cadeia, qualquer monitor
Uma política de escalonamento se associa a tudo o que você monitora — disponibilidade, fluxos de checkout, certificados, DNS, servidores e tarefas agendadas. Cada incidente confirmado neles sobe os mesmos níveis.
Crie a cadeia uma vez, reutilize-a em todo lugar
Dê um nome à política, adicione passos temporizados e escolha quem cada um alerta — das suas equipes, pessoas e contatos individuais. Uma simulação ao vivo mostra exatamente quem é alcançado antes de salvar.
- Nível após nível — alertar estas pessoas agora, estas em 5 minutos, todos em 15
- Qualquer destinatário — equipes, membros individuais, operadores ou contatos únicos
- Uma simulação ao vivo resolve cada passo para pessoas reais, e avisa sobre um passo que não alcançaria ninguém
Escalonar, confirmar, recuperar
Um toque confirma — sem sessão iniciada
Os alertas enviados por e-mail, SMS, Slack, Microsoft Teams, Discord, Mattermost, Telegram e Twilio incluem um link de confirmação assinado. Toque nele a partir do alerta — sem Dashboard, sem senha — e a primeira confirmação interrompe a subida para todos no incidente.
- Um toque a partir do alerta — um link assinado, sem sessão iniciada e sem aplicativo abrindo
- A primeira confirmação interrompe a subida — ninguém mais acima nos níveis é alertado
- Tempo até à confirmação registado em cada incidente escalonado, para que o tempo de resposta seja medido, não adivinhado
Quanto tempo até alguém responder
"Respondemos depressa" não passa de uma esperança até haver um número ao lado. Cada incidente escalonado fica marcado com os minutos entre a confirmação do incidente e a primeira confirmação, e com o nome de quem respondeu.
- Minutos até à confirmação — contados desde o momento em que o incidente foi confirmado até à primeira confirmação
- Quem respondeu, e de onde — o dashboard, ou o link assinado no próprio alerta
- Os incidentes sem resposta ficam assinalados — a linha do histórico diz "recuperado antes do passo 2", indicando onde a cadeia parou
Estado, próximo passo e MTTA
A página do incidente abre com uma faixa de estatísticas pensada para o meio de uma interrupção: se a cadeia ainda está escalonando, a que horas aciona o próximo passo, quem confirmou e quanto tempo demorou.
- Escalonando, Confirmado ou Resolvido — o estado da cadeia num único emblema
- Próximo escalonamento com contagem decrescente — "Passo 3 · 5 min", ou "Pausado" assim que alguém confirma
- MTTA em minutos — da confirmação do incidente até à primeira confirmação, na mesma faixa
Recuperação só a quem foi alertado
Quando o monitor recupera, a cadeia cancela de imediato todos os alertas pendentes — e o aviso de recuperação chega apenas às pessoas que foram realmente alertadas, não à equipe mais alargada que poderia ter sido alertada três níveis depois.
- A recuperação cancela todos os passos pendentes e a repetição, no instante em que o monitor volta
- Só os destinatários que foram alertados recebem o aviso de recuperação — mais ninguém é notificado
- O horário de silêncio é respeitado em cada nível, por pessoa — uma cadeia nunca o sobrepõe
O próximo incidente das 3 da manhã devia acordar a pessoa certa.Não todo mundo.
Cadeias de plantão sem preços de plantão — o escalonamento, a confirmação e os lugares de equipe vêm incluídos no preço fixo do plano, nunca faturados por usuário.
Como funcionam as políticas de escalonamento
Crie uma cadeia uma vez, associe-a aos seus monitores e deixe que um incidente sem resposta a escalone sozinho.
Crie a cadeia
Adicione passos temporizados — alertar estas pessoas agora, estas em 5 minutos, toda a equipe em 15 — escolhendo destinatários entre as suas equipes, membros e contatos.
Associe-a a monitores
Associe a política a qualquer monitor — disponibilidade, transação, SSL, heartbeat. Uma cadeia pode cobrir toda a frota; um monitor sem política simplesmente alerta todos ao mesmo tempo.
Escalona até alguém responder
Quando um incidente é confirmado, o passo 1 é acionado de imediato. Se ninguém confirmar, a cadeia alerta o nível seguinte segundo o horário definido — até alguém confirmar, ou o monitor recuperar.
No preço do plano, nunca por usuário
Tantos níveis quantos o incidente precisar
Encadeie passos temporizados, cada um alertando equipes, membros ou contatos individuais. Uma repetição limitada volta a acionar o último passo — ou todos eles — durante o número de rondas que permitir, e para aí.
Confirmação num toque
Um link assinado no alerta confirma o incidente — sem dashboard, sem senha.
Tempo até à confirmação
Cada incidente escalonado regista os minutos até à primeira confirmação, e quem a deu.
A pausa silencia a cadeia
Pausar um monitor cancela o seu escalonamento ativo e limpa todos os alertas pendentes.
Janelas de manutenção
Uma janela de manutenção suprime os alertas, para que o trabalho planejado nunca inicie uma cadeia.
Uma política para todos os tipos de monitor
Associe a mesma cadeia aos monitores de disponibilidade, SSL, transação, DNS e heartbeat — reutilizada em toda a frota, não reconstruída por monitor.
Todos os níveis, os 12 canais
Uma cadeia alerta pela mesma lista de contatos e pelos mesmos 12 canais que qualquer monitor da Uptimia já usa — sem um segundo diretório para manter.
12 canais, uma lista de contatos — cada nível de uma cadeia alerta através do mesmo encaminhamento.
Ver o diretório completo de integrações →O que é uma política de escalonamento de incidentes?
Uma política de escalonamento de incidentes é uma cadeia reutilizável e temporizada de passos de alerta: assim que um incidente é confirmado, alerta o primeiro interveniente e, se ninguém confirmar, alerta automaticamente as pessoas seguintes segundo o horário definido — até alguém responder ou o monitor recuperar. Transforma um alerta isolado e sem seguimento numa cadeia com responsabilidade, para que um incidente nunca fique esquecido numa única caixa de entrada por ler.
Como funciona uma política de escalonamento?
O passo 1 é acionado no instante em que o incidente é confirmado. Uma confirmação para a cadeia de imediato, e nenhum nível seguinte é alertado.
Sobe e depois alarga
sem confirmação em 5 min → a cadeia alerta o nível seguinte, depois repete até alguém responder
Tudo de uma vez ou em cadeia
Alertar todos ao mesmo tempo funciona — até a única pessoa capaz de resolver o problema estar dormindo, fora de serviço ou ter silenciado o canal. Uma cadeia alerta primeiro a pessoa certa, e só alarga se ninguém responder.
Ver alertas & notificações →| O que acontece | Alertar todos de uma vez | Cadeia de escalonamento |
|---|---|---|
| O incidente é confirmado | ✓ Alertado | ✓ Alertado |
| O primeiro interveniente não responde | Silenciar | ✓ Nível seguinte alertado |
| A pessoa de plantão está dormindo às 3 da manhã | Sem resposta | ✓ Sobe para o apoio |
| O incidente continua aberto | Sem nova tentativa | ✓ Tentar novamente, com limite |
| O monitor recupera | Alerta de recuperação para todos | ✓ Só para quem foi alertado |
Perguntas frequentes sobre escalonamento
01O que é uma política de escalonamento de incidentes?+
02Em que é que isto difere de alertar todos ao mesmo tempo?+
03O que é a confirmação num toque, sem sessão iniciada?+
04O que acontece se ninguém confirmar?+
05Quem recebe o aviso de recuperação?+
06Uma política pode cobrir vários monitores?+
07O escalonamento respeita o horário de silêncio?+
08E se eu excluir uma política, ou um passo não tiver ninguém atribuído?+
09Pausar um monitor interrompe o seu escalonamento?+
10A cadeia pode repetir para sempre?+
11Que canais pode um passo alertar?+
12Que planos incluem políticas de escalonamento?+
Chegue a alguém que o consiga resolver
Crie uma cadeia de escalonamento reutilizável em minutos, associe-a a todos os monitores que tiver e deixe de esperar que o primeiro alerta tenha chegado a alguém.