Pular para o conteúdo

Monitoramento de servidores que avisa você antes da interrupção.

A maioria dos servidores não avaria — fica sem alguma coisa. Uma linha de bash instala o agente, 30 segundos depois já está reportando, e o disco é corrigido aos 90%, não aos 100%.

Teste gratuito de 30 dias Não é necessário cartão de crédito Linux · instala em menos de um minuto
Intervalo de reporte
30s
Métricas por servidor
17
Assinalado como offline em
90s
Histórico de métricas
1year

De um disco enchendo a um alerta em 30 segundos

Os registros acumulam-se durante a noite e um dos seus servidores começa a ficar sem espaço em disco. Nada está ainda indisponível — um pequeno agente reporta a cada 30 segundos, por isso o alerta indica o servidor e a partição enquanto ainda há tempo para liberá-la.

02:14:03 O /var ultrapassa 90% num servidorO reporte de 30 segundos mostra 92% — os alertas de disco são instantâneos, sem janela de tempo a máquina: ainda operacional
02:14:03 O alerta indica a partição"/var a 92%" logo na primeira linha — Slack, e-mail; não um alarme vago de "disco" a máquina: ainda operacional
02:29 Registros antigos limpos — espaço liberadoO reporte seguinte do agente, 30 segundos depois, mostra o /var a 62% a máquina: ainda operacional
02:29:31 Resolvido automaticamente — você é avisado de que passouUm alerta de recuperação vai para os mesmos canais que soaram o alarme a máquina: nunca caiu
15 minultrapassar → normalizar
A avaria que nunca aconteceu.02:29:31
Um /var cheio derruba a máquina toda — bancos de dados, registros, sites, tudo. Este chegou a um pico de 92%, porque o alerta chegou enquanto ainda havia margem de manobra.
partição exata + valor realinstantâneo, por partiçãoalerta de recuperação na normalizaçãoCPU · RAM · carga · disco — a cada 30 s
E sem o agente? Um disco enchendo não dá sintomas até os 100% — e depois tudo na máquina falha de uma vez. A subida das 2 da manhã transforma-se numa descoberta às 7, com cinco horas mortas pelo meio. máquina parada

17 métricas, um agente bash

Um agente em bash reporta 17 métricas a cada 30 segundos — já em gráficos, para que você consiga ver o estado de um servidor sem ter de entrar para verificar.

CPU e cargaUtilização e média de carga a 1·5·15 min
Memória e swapUsada, livre — e swapping
Disco % — por partiçãoTodas as partições, não só a /
Utilização de inodesCheio de arquivos minúsculos? Você saberá
17 métricas · 30 s lidas diretamente do sistema · sem entrar
Processos e núcleosContagem vigiada, núcleos conhecidos
Rede entrada / saídaTráfego, nas duas direções
Anfitrião e atualidadeKernel, SO, tempo de atividade — e um pulso ao vivo
Os alertas acionam-se em violações persistentes, não em picos momentâneos: CPU, memória, carga, swap, disco e inodes por partição, contagem de processos, tráfego de rede — e o mais ruidoso de todos: o servidor ficando em silêncio. silêncio = alerta

Alertas e histórico

Sem falsos alarmes às 3 da manhã

Alertado por problemas reais, não por picos momentâneos

A Uptimia só aciona um alerta de CPU, memória, swap, carga, contagem de processos ou rede quando todas as leituras na sua janela se mantêm acima do limiar — um pico de dois segundos passa em silêncio, um problema persistente não.

  • Você decide quanto tempo um problema tem de se manter — entre 1 minuto e meia hora, definido por métrica
  • Nada para configurar de início — CPU, memória e disco são vigiados desde o primeiro reporte; adicione os outros quando quiser
  • Disco e inodes são a exceção — acionam-se no instante em que uma partição ultrapassa o limiar; um disco cheio não pode esperar
Onde seus alertas são entregues →
CPU02:05:00amostra de 30 segundos94%
CPU02:07:30amostra de 30 segundos96%
CPU02:10:00amostra de 30 segundos93%
10/10amostras
acima de 90%
Alerta de CPU — persistente02:10:01
Todas as leituras durante 5 minutos seguidos mantiveram-se acima de 90% — um problema real, não um pico que se resolveu sozinho.
SlackE-mailSMS+ PagerDuty…
Um pico de dois segundos? Uma única amostra elevada nunca sobrevive à janela — passa em silêncio. Só o disco e os inodes acionam-se imediatamente. sem alerta
Disco por partição

Saiba exatamente qual o disco que encheu, instantaneamente

A Uptimia associa os alertas de espaço em disco e de inodes a cada partição, por isso o incidente diz /var — e não deixa uma máquina inteira para vasculhar. Cada partição abre e resolve seu próprio incidente.

  • Um incidente por partição — /, /var, /data são cada um vigiado e resolvido de forma independente
  • A partição e o valor no alerta — "Utilização de disco acima de 90% em /var", a 92%
  • Exceções por partição — mantenha uma partição concorrida como /var numa porcentagem mais rígida do que o resto
Se ninguém confirmar um alerta →
agenteweb-01.caldmont.comreportando a cada 30 s
/raizpercurso de incidente próprio61%
Alerta de disco — /var02:14:09
Utilização de disco acima de 90% em /var — em 92%. Instantâneo, sem espera; incidente à parte, enquanto o /data continua verde.
por partiçãoinstantâneotambém inodes
/datavolume de dadospercurso de incidente próprio38%
O /var mais ocupado do que os outros? As exceções por partição mantêm uma partição em um limiar mais rígido do que o padrão da máquina. /var → 85%
Detecção de offline

Três reportes falhados abrem um incidente

Se um servidor ficar completamente silencioso — kernel panic, energia, rede — uma verificação separada, feita a cada minuto, detecta os reportes em falta e abre um incidente crítico. Uma máquina morta não se pode esconder atrás do "sem notícias, boas notícias".

  • Assinalado como offline após 3 reportes falhados — 90 segundos de silêncio à cadência de 30 segundos
  • Resolve-se automaticamente na próxima conexão — fecha-se sozinho assim que o agente volta
  • Sem falsos "offline" na configuração — um servidor novo à espera do primeiro reporte nunca é assinalado
Verificações externas: ping e porta TCP →
1
Reporte falhado
02:40:30 · esperado a cada 30 s
aguardar
2
Ainda em silêncio
02:41:00 · segunda falha
aguardar
3
Offline confirmado
02:41:30 · ~90 s de silêncio
crítico
Servidor offline02:41:30
O web-03 ficou completamente às escuras — kernel panic, energia ou rede. Resolve-se automaticamente assim que o agente voltar a reportar.
SlackE-mailSMS+ PagerDuty…
Acabou de instalar o agente? Um servidor novo à espera do primeiro reporte nunca é assinalado como offline. sem falso alarme
Histórico e tendências

Um ano de histórico, picos incluídos

Os números em tempo real dizem o que está mal agora; as tendências dizem que já vem subindo há semanas. A Uptimia guarda os dois — 6 cartões de métricas e 5 gráficos, lendo os mesmos dados que os alertas.

  • 6 cartões de métricas + 5 gráficos de séries temporais — CPU, carga, memória, disco, rede — atualizados a cada 30 segundos
  • Detalhe em bruto de 30 segundos durante 24 horas — depois médias e máximos horários, para que os picos sobrevivam, durante um ano inteiro
  • Os gráficos escolhem a fonte certa — aproxime para a última hora ou o último ano e os dados mudam automaticamente
Receba estes números por e-mail, de forma agendada →
TENDÊNCIAMemória usada — web-01
últimos 30 dias · dados horários · atualizado a cada 30 s
30 d ago15 dnow
Subindo de 40% para 70% ao longo de um mês — o tipo de problema que uma fotografia em tempo real não consegue mostrar.
Em bruto · a cada 30 segundos
todas as amostras, salvas 24 h
02:10:00 → cpu 93% · mem 71%
Média horária · 1 ano
a linha de tendência — suave,
comparável mês a mês
Máximo horário · 1 ano
os picos sobrevivem à agregação —
um pico de 2 minutos continua visível um ano depois
Aproxime onde quiser — a última hora lê dados em bruto de 30 segundos, o último ano lê dados horários; os gráficos mudam de fonte automaticamente. automático

Reportando em menos de um minuto

Uma linha para instalar — sem pacotes, sem runtime, e um único script remove todos os vestígios.

Etapa 130 s

Execute uma linha de instalação como root

A linha única coloca um pequeno script em bash em /opt/uptimia e regista um temporizador systemd — ou cron, se não houver systemd.

$ curl -s uptimia.com/server-agent/install.sh | bash -s -- KEY
# ✓ systemd timer uptimia-agent.timer created
Etapa 230 s

O agente começa a reportar

A cada 30 segundos envia 17 métricas — CPU, memória, disco, carga e mais — autenticadas com uma chave por servidor.

Estado do agente
Ligado — reportando a cada 30 s
primeira conexão recebida · 17 métricas
Servidor
web-01 · Ubuntu 22.04 · 4 cores
Etapa 3automático

Defina limiares e seja alertado

CPU, memória e disco começam nos 90%. Um limiar ultrapassado abre um incidente e alerta a sua equipe onde já trabalha.

#infra-alerts
Uptimia 02:14
⚠ Disco — /var a 92% no web-01
acima de 90%incidente por partição02:14:03
Também enviado a E-mailPagerDuty

Execute uma linha de bash.Saiba antes de o disco encher.

Todos os servidores, todas as métricas, todos os canais de alertas — grátis durante 30 dias, sem nenhum extra pago.

Comece gratuitamente →
30 dias grátis não é necessário cartão de crédito cancele quando quiser

Também incluído

Alertas nos canais que já usa

Os alertas de servidor compartilham uma lista de contatos com todos os outros monitores — e-mail, SMS, Slack, Microsoft Teams, Discord, Mattermost, Telegram, WhatsApp, PagerDuty, Twilio, Statuspage e webhooks personalizados.

E-mailSlackTeamsPagerDutyTelegramWebhook+ mais

Modo de manutenção

Aplique patches ou reinicie sem acumular alertas — todos os alertas ficam silenciados enquanto as métricas continuam chegando.

janela de manutenção · alertas silenciados

Avisos de recuperação

Fique sabendo quando termina, não só quando começou — um aviso de "resolvido" em cada resolução.

✓ resolvido · memória de volta a 58%

Histórico que sobrevive a uma mudança para plano inferior

Ao mudar para um plano inferior, as métricas não são excluídas — só os alertas ficam em silêncio. Ao mudar para um plano superior, os servidores suspensos reativam-se sozinhos.

a recepção de dados continua · alertas em pausa

Um Dashboard para tudo

Os servidores ficam ao lado dos seus monitores de disponibilidade, SSL, heartbeat e DNS — os mesmos contatos, grupos e papéis, um único lugar para consultar.

web-01.caldmont.comSERVIDOR www.caldmont.comDISPONIBILIDADE db-backup · nightlyHEARTBEAT

Desinstale em uma linha

Um único script remove por completo a unidade systemd e /opt/uptimia — sem deixar vestígios.

$ curl -fsS uptimia.com/server-agent/uninstall.sh | bash

O que é o monitoramento de servidores?

O monitoramento de servidores é o acompanhamento contínuo do estado de um servidor — CPU, memória, disco, carga, rede e processos — para que seja alertado no momento em que um recurso escasseia ou a máquina fica offline. O monitoramento de servidores Linux da Uptimia faz isto com um pequeno agente que reporta 17 métricas a cada 30 segundos e levanta um incidente quando uma métrica ultrapassa o seu limiar.

O agente

Como funciona o agente?

O seu servidor Linux
lê /proc · df
~17 métricas · a cada 30 s
Uptimia
gráficos + alertas

Um script em bash, em um temporizador systemd, envia um pequeno reporte, autenticado com uma chave por servidor — só é preciso bash e curl.

Lógica de alertas

Alertas persistentes vs. instantâneos

CPU · carga · memória
janela inteira acima do limiar
depois alerta
Disco · inodes
alertam de imediato

um pico passa em silêncio — só uma violação persistente aciona o alerta; uma partição cheia não pode esperar, por isso o disco aciona de imediato

Os sinais vitais

Que métricas de servidor deve monitorar?

Os sinais que preveem incidentes reais — e como a Uptimia vigia cada um. CPU, memória e disco são vigiados desde o primeiro reporte; os restantes ficam ao seu critério ativar.

Todos os tipos de monitor numa só conta →
MétricaLimiar padrãoComo a Uptimia alerta
Utilização de CPU90%persistente · janela de 5 min
Memória90%persistente · janela de 5 min
Disco · por partição90%instantâneo, por partição
Média de cargadesabilitado por padrãopersistente · janela
Swapdesabilitado por padrãopersistente · janela
Contagem de processosdesabilitado por padrãopersistente · janela
Tráfego de rededesabilitado por padrãopersistente · janela
Servidor offline3 reportes falhadoscrítico · ~90 s

Perguntas frequentes

01O que é o monitoramento de servidores?+
O acompanhamento contínuo do estado de um servidor — CPU, memória, disco, carga, rede e processos — para que seja alertado quando um recurso escasseia ou a máquina fica offline. O pequeno agente da Uptimia reporta 17 métricas a cada 30 segundos e abre um incidente quando uma métrica ultrapassa o seu limiar.
02Como funciona o monitoramento de servidores da Uptimia?+
Uma instalação num único comando coloca um pequeno script bash no seu servidor e configura um temporizador systemd (ou cron). A cada 30 segundos, lê /proc e df e envia 17 métricas — CPU, memória, swap, disco por partição, inodes, carga, rede, número de processos e informação do SO — autenticadas com uma chave própria de cada servidor. Inclui 6 cartões de métricas, 5 gráficos de séries temporais e alertas por limiar — monitoramento e alertas de servidor num único agente leve.
03Que sistemas operacionais são suportados?+
O instalador de uma linha destina-se ao Linux — o agente lê /proc e df, por isso funciona em distribuições padrão (Ubuntu, Debian, RHEL, Alma, entre outras). Também existem agentes para macOS e Windows PowerShell que reportam as mesmas métricas, configurados manualmente (launchd no macOS, uma Tarefa Agendada no Windows) em vez de através do instalador automático. Não existe agente para BSD — nesses casos, use as verificações externas da Uptimia (ping, porta TCP, HTTP).
04Posso mudar a frequência com que o agente reporta?+
Não — a cadência de 30 segundos é fixa. O que pode controlar são os alertas: o limiar de cada métrica e durante quanto tempo um problema se tem de manter antes de alguém ser notificado.
05Um pico breve de CPU vai acionar um alerta às 3 da manhã?+
Não. Os alertas de CPU, memória, swap, carga, contagem de processos e rede só acionam quando todas as leituras na sua janela (padrão de 5 minutos) se mantêm acima do limiar — um pico momentâneo passa em silêncio. As exceções são o disco e os inodes, que acionam de imediato: um disco cheio não pode esperar por uma janela.
06Com que rapidez fico sabendo se um servidor fica indisponível?+
Se um servidor deixar de reportar por completo, uma verificação a cada minuto o assinala como indisponível ao fim de 3 falhas consecutivas — 90 segundos de silêncio — e abre um incidente crítico que se resolve automaticamente quando o agente volta a comunicar. Três falhas seguidas confirmam que desapareceu mesmo; um servidor novo à espera do primeiro reporte nunca é assinalado por engano.
07O agente lê os meus registros ou executa comandos?+
Não. É apenas monitoramento de recursos do servidor — os dados enviados são CPU, memória, disco, rede, carga, tempo de atividade, contagem de processos e informação básica de SO/kernel/nome do servidor. Sem registros, sem conteúdo de arquivos, sem comandos remotos — apenas números enviados num só sentido.
08Quanto histórico é salvo?+
As amostras em bruto de 30 segundos são salvas durante 24 horas. Além disso, a Uptimia salva médias e máximos horários — os picos sobrevivem no máximo — durante um ano inteiro. Os gráficos mudam de fonte automaticamente conforme o intervalo.
09Posso monitorar contêineres Docker ou Kubernetes?+
O agente reporta métricas ao nível do host — o /proc e o df da máquina inteira, não estatísticas por contêiner. É adequado para os servidores onde os seus contêineres rodam; atualmente não existe coleta ao nível do contêiner.
10O monitoramento de servidores é um extra pago?+
Não. Todos os planos pagos incluem monitoramento de servidores assim como monitoramento de disponibilidade, SSL, transações, DNS e heartbeat — nunca como um extra pago. Os planos diferem apenas na quantidade de servidores incluídos. O plano gratuito não inclui monitores de servidor; o teste gratuito de 30 dias inclui (até 50 servidores), não é necessário cartão de crédito.

Comece a monitorar os seus servidores hoje.

Execute uma linha de bash e um disco enchendo, um CPU sobreaquecido ou uma máquina às escuras chegam até você enquanto ainda há margem de manobra.

Teste gratuito de 30 dias Não é necessário cartão de crédito Bash + curl · desinstala numa linha
O monitoramento de servidores está disponível no teste de 30 dias e em todos os planos pagos, assim como todos os outros tipos de monitor.