KairosLink
Monitoramento
Como acompanhar CPU, memória, disco e disponibilidade nos dispositivos dos seus clientes, e como configurar os alertas para que eles realmente cheguem até você a tempo.
Saber que um servidor está ficando sem disco antes de o cliente ligar para você.
O agente mede CPU, memória, disco, uptime e serviços de cada dispositivo. Quando algo passa de um limite, um alerta é aberto. Se você também configurou o e-mail, o aviso chega até você.
Onde fica
Menu lateral, Monitoramento. Dentro:
- Painel de monitoramento, com a situação de todo o seu parque de dispositivos
- Rede, para tudo o que não consegue rodar um agente
- Painel de telas, a parede de telas ao vivo
- Implantação de agentes
Pelo painel de monitoramento você chega à caixa de alertas, ao histórico, às configurações de limites e às regras de silenciamento. Essas quatro não têm entrada própria no menu.
Cada dispositivo também tem as abas Monitoramento e Alertas dentro da ficha dele.
As duas chaves
Esta é a primeira coisa a entender, porque é a causa número um de "o monitoramento nunca me avisa nada".
Todo dispositivo tem duas chaves separadas, na aba Monitoramento da ficha dele:
Monitoramento deste dispositivo. Começa ativado. É ele que faz o dispositivo ser medido. Desative-o e as métricas param de ser armazenadas, os limites param de ser avaliados e todo alerta aberto nesse dispositivo é fechado.
Alertas por e-mail deste dispositivo. Começa desativado. É a única coisa que decide se um e-mail sai.
Então, com a configuração de fábrica, um dispositivo novo faz tudo isso:
- É medido a cada 5 minutos
- Traça o gráfico das últimas 24 horas
- Avalia todos os limites
- Abre alertas, com severidade
- Exibe os alertas na caixa e no contador do menu
- Fecha os alertas sozinho quando o problema passa
- Guarda tudo no histórico e no PDF
E não envia um único e-mail. Nem quando o alerta abre, nem quando ele sobe de aviso para crítico.
Não existe outro canal: não há sino dentro do aplicativo, nem notificação push, nem mensageria. O único aviso que sai do KairosLink é o e-mail. Com essa chave desativada, ninguém fica sabendo de nada, a menos que alguém abra o console e olhe.
Como deixar isso funcionando
Duas coisas, e você precisa das duas:
Uma. Ative os Alertas por e-mail na ficha de cada dispositivo que importa para você.
Duas. Defina quem os recebe. Isso fica no roteamento de notificações do cliente, categoria Monitoramento. Sem destinatários, ter a chave ativada não basta e também não sai nada.
Hoje isso é feito dispositivo por dispositivo, não existe ação em massa. Se o seu parque é grande, comece pelos servidores.
O que é medido, e com que frequência
| Métrica | Windows | Linux |
|---|---|---|
| CPU | Sim | Sim |
| Memória | Sim | Sim |
| Disco, por volume | Sim | Sim |
| Uptime | Sim | Sim |
| Serviços monitorados | Sim | Sim |
A verificação roda a cada 5 minutos por padrão. Esse intervalo é configurável entre 1 e 60 minutos.
Um dispositivo é marcado como offline depois de 70 segundos sem sinal, e essa detecção é separada da verificação de métricas: ela é muito mais rápida.
Limites
Valores de fábrica:
| Métrica | Aviso | Crítico |
|---|---|---|
| CPU | 85% | 95% |
| Memória | 85% | 95% |
| Disco | 80% | 90% |
Outras duas coisas começam desativadas e vale a pena configurá-las se elas importam para você: o alerta de uptime (útil em servidores que precisam de reinicializações periódicas) e o alerta de disco livre em gigabytes, que em um disco de 4 TB é muito mais útil do que uma porcentagem.
Onde alterá-los
Para toda a organização: painel de monitoramento, bloco Política de monitoramento. Ali você define CPU, memória, disco e intervalo.
Para um cliente, grupo ou dispositivo: configurações de monitoramento, aba Ajustes específicos. Ali você tem os treze campos, inclusive os que não estão disponíveis no nível da organização.
Qual deles ganha
A resolução é campo a campo, não política por política. Cada valor é buscado nesta ordem e o primeiro nível que o define ganha:
Dispositivo, depois grupo, depois cliente, depois organização, depois o valor de fábrica.
Isso quer dizer que você pode colocar o disco em 95% em um servidor de arquivos e esse dispositivo vai continuar usando os seus limites gerais de CPU e memória. Você não precisa redefinir tudo.
Na ficha de cada dispositivo, o bloco Limites efetivos mostra de onde veio cada valor, entre colchetes. Se você não tem certeza de por que um dispositivo alerta quando não deveria, olhe ali primeiro.
Se um dispositivo pertence a vários grupos que definem o mesmo campo, o valor mais baixo ganha.
Um dispositivo está em vermelho
- Abra o painel de monitoramento. Os dispositivos críticos vêm primeiro.
- Clique no dispositivo para abrir a ficha de monitoramento dele.
- Olhe o gráfico das últimas 24 horas. Um pico isolado e uma curva que sobe sem parar são problemas diferentes.
- Confira o bloco Limites efetivos: pode ser que o limite simplesmente esteja errado para aquele dispositivo.
- Se você precisa da leitura agora, e não a do último ciclo, peça uma verificação manual.
Um aviso sobre as verificações manuais: se o dispositivo estiver offline, a solicitação é aceita mesmo assim e depois ninguém avisa você de que ela nunca chegou. Ela espera e é descartada depois de 15 minutos. Se você pediu uma verificação e nada aconteceu, olhe primeiro se o dispositivo está online.
Silenciar durante uma migração
Quando você sabe que um servidor vai ficar em 100% a noite inteira porque você está migrando dados, não faz sentido ele alertar.
Você tem duas ferramentas:
Uma janela de manutenção, se for algo planejado com um intervalo de horário. Nenhum alerta abre durante a janela.
Uma regra de silenciamento, se você quer algo cirúrgico: silenciar somente os alertas de disco de um dispositivo e deixar todo o resto ativo.
O que você não deve fazer é desativar a chave de monitoramento. Isso fecha todos os alertas abertos do dispositivo e para de guardar métricas, então depois você não vai ter o gráfico do que aconteceu durante a migração, que costuma ser exatamente o que você quer olhar.
Monitoramento de rede
Isso cobre o que não consegue rodar um agente: roteadores, switches, impressoras, NAS, pontos de acesso.
Funciona designando um dos dispositivos do cliente como sonda. Esse dispositivo, que tem o agente, é quem varre a rede por dentro e informa o que encontrou e o que responde.
Você precisa de um dispositivo com o agente rodando naquela rede. Se a sonda cair, a descoberta para, e os dispositivos de rede mantêm os últimos valores conhecidos sem que nada avise que eles estão desatualizados. Se você vê a rede toda verde, confirme que a sonda está online.
O Painel de telas
Uma parede de telas ao vivo dos dispositivos, feita para ficar em um monitor do escritório.
Você o monta escolhendo quais dispositivos entram nele. A privacidade é configurada à parte: você decide se a pessoa que usa o dispositivo vê um aviso de que a tela dela está no painel, e como.
Um detalhe prático: se você clicar no botão de acesso remoto pelo Painel de telas e o acesso estiver bloqueado por regras, você não vai ver mensagem nenhuma. O botão simplesmente não faz nada. Se você suspeita que é isso, tente pela lista de Dispositivos, onde o botão fica cinza e o motivo fica visível.
Quando o console não consegue ver
Esta parte importa porque é onde um dashboard todo verde pode enganar você.
O painel distingue bem um dispositivo offline. O card diz que não há conexão e quando foi o último contato, e ele conta no total de offline.
Um dispositivo que parou de reportar métricas, não. Se o agente está vivo mas a verificação trava, o card continua mostrando as barras e os números da última verificação bem-sucedida. Um dispositivo cujo monitoramento parou de funcionar seis horas atrás fica exatamente igual a um saudável.
O único sinal é a linha pequena que diz "Verificado há
Esse é o hábito que vale a pena criar: no painel, junto com as cores, leia as datas.
E existe um caso que some da contagem. Um dispositivo cuja verificação devolveu algo que o console não conseguiu interpretar fica em estado desconhecido, e ele não conta em nenhum dos quatro cards do resumo. Nem OK, nem aviso, nem crítico, nem offline. Se os números dos cards não fecham com o total do seu parque, é ali que estão os que faltam.
Se você desativou o monitoramento no nível da organização, os cards dos dispositivos continuam mostrando os últimos dados e nada na ficha do dispositivo diz que ele está desativado. O único lugar onde isso aparece é a caixa de seleção Monitoramento ativado, no painel.
Erros comuns
"O monitoramento nunca me avisa nada." A chave de alertas por e-mail está desativada naquele dispositivo, ou não há destinatários definidos no cliente. Confira os dois.
Pedi uma verificação manual e nada chegou. O dispositivo está offline. A solicitação espera e é descartada depois de 15 minutos, em silêncio.
Um dispositivo alerta no disco e tem espaço de sobra. É um disco grande e o limite é uma porcentagem. Defina um limite de disco livre em gigabytes para aquele dispositivo ou cliente.
Alterei o limite e o dispositivo continua alertando igual. Um ajuste mais específico está ganhando. Olhe o bloco Limites efetivos na ficha do dispositivo: ele diz de onde vem cada valor.
Os números dos cards não fecham com o meu total de dispositivos. Os dispositivos em estado desconhecido não estão em nenhum dos quatro.
Perguntas frequentes
Por que eu não recebo e-mails se o monitoramento está funcionando? Porque são duas chaves separadas. A do e-mail começa desativada em todo dispositivo.
Existe alguma outra forma de ser avisado? Não. O e-mail é o único canal de saída dos alertas de monitoramento.
Posso ativar o e-mail em todos os dispositivos de uma vez? Hoje não. Isso é feito dispositivo por dispositivo.
Com que frequência ele mede? A cada 5 minutos por padrão, configurável entre 1 e 60.
Quanto tempo leva para detectar que um dispositivo caiu? Entre 70 segundos e dois minutos. Muito mais rápido do que a verificação de métricas.
Posso definir limites diferentes por cliente? Sim, e por grupo e por dispositivo também. O mais específico ganha, campo a campo.
Posso definir limites por volume de disco? Sim, no nível de cliente, grupo ou dispositivo. Não no nível da organização.
E se um dispositivo estiver em vários grupos com limites diferentes? O valor mais baixo ganha.
Como eu silencio um dispositivo sem perder as métricas dele? Com uma janela de manutenção ou uma regra de silenciamento. Desativar o monitoramento fecha os alertas e para de guardar dados.
O monitoramento de rede precisa de alguma coisa instalada no roteador? Não. Ele precisa de um dispositivo com agente naquela rede para funcionar como sonda.
O que acontece se a sonda cair? A descoberta para e os dispositivos mantêm os últimos valores, sem nenhum aviso de que eles estão desatualizados.
Posso abrir um chamado a partir de um alerta? Sim, pelo próprio alerta, à mão.
Atualizado em 21 de agosto de 2026