Netdata ou Prometheus e Grafana? Compare as duas opções e veja como instalar cada uma para monitorar CPU, memória, disco, rede e VMs do Proxmox.

Para que serve

Saber que o servidor está "no ar" não basta: você precisa ver como ele está. Uso de CPU por núcleo, memória, I/O e latência dos NVMe, tráfego de rede, carga das VMs. Com esses gráficos você descobre gargalos, planeja crescimento e entende o que aconteceu às 3h da manhã. Este artigo compara duas abordagens populares, Netdata ou Prometheus e Grafana, e mostra como começar com cada uma.

Qual escolher

NetdataPrometheus + Grafana
InstalaçãoUm comando, painel prontoTrês componentes para instalar e configurar
Granularidade1 segundo, ótimo para investigar problemas ao vivoNormalmente 15–60 segundos
HistóricoDias a semanas, conforme o disco reservadoConfigurável (padrão 15 dias); pode ir a meses
Vários servidoresVia Netdata Cloud ou nó "pai" (streaming)Natural: um Prometheus coleta de vários exporters
PainéisProntos e automáticosVocê monta ou importa dashboards
Ideal paraUm ou poucos servidores, diagnóstico rápidoAmbientes com vários hosts, métricas de aplicações, quem já usa o ecossistema

Os dois coexistem com o Zabbix: muitos usam Zabbix para alertas e inventário e Netdata/Grafana para gráficos detalhados.

Pré-requisitos

Nenhum desses painéis deve ficar aberto para a internet. Prometheus e node_exporter não têm senha por padrão e expõem detalhes do seu servidor. Restrinja o acesso por firewall a IPs confiáveis ou use VPN. Ao alterar o firewall, mantenha o SSH liberado e tenha o console iLO/IPMI à mão.

Opção A: Netdata

  1. Instale pelo script oficial, no canal estável e sem telemetria:
    wget -O /tmp/netdata-kickstart.sh https://get.netdata.cloud/kickstart.sh
    sh /tmp/netdata-kickstart.sh --release-channel stable --disable-telemetry
    O script prefere pacotes nativos da distribuição e ativa atualização automática (use --no-updates se preferir controlar). Leia o script antes de executá-lo.
  2. Restrinja o acesso. O painel escuta na porta 19999. Para aceitar só conexões locais (e acessar via túnel SSH), edite com /etc/netdata/edit-config netdata.conf e, na seção [web], defina bind to = 127.0.0.1. Ou libere a 19999 no firewall apenas para seu IP.
  3. Reinicie: systemctl restart netdata.
  4. Acesse por túnel: ssh -L 19999:127.0.0.1:19999 root@IP e abra http://localhost:19999. Conectar ao Netdata Cloud é opcional.

No host Proxmox, o Netdata detecta automaticamente discos, ZFS, interfaces e grupos de controle (cgroups) das VMs e containers, mostrando o consumo de cada um.

Opção B: Prometheus e Grafana (com node_exporter)

  1. Em cada servidor a monitorar, instale o node_exporter (pacote da distribuição):
    apt install -y prometheus-node-exporter
    ufw allow from IP_DO_PROMETHEUS to any port 9100 proto tcp
    Ele expõe as métricas em http://IP:9100/metrics.
  2. Na VM de monitoramento, instale o Prometheus:
    apt install -y prometheus
    Edite /etc/prometheus/prometheus.yml e adicione os alvos na seção scrape_configs:
      - job_name: node
        static_configs:
          - targets: ['10.10.10.11:9100', '10.10.10.12:9100']
    Valide e recarregue: promtool check config /etc/prometheus/prometheus.yml && systemctl reload prometheus. O Prometheus escuta na 9090; limite o acesso a ela também. Para guardar mais histórico, ajuste --storage.tsdb.retention.time=90d em ARGS no arquivo /etc/default/prometheus.
  3. Instale o Grafana pelo repositório oficial:
    apt install -y apt-transport-https wget gnupg
    mkdir -p /etc/apt/keyrings
    wget -O /etc/apt/keyrings/grafana.asc https://apt.grafana.com/gpg-full.key
    chmod 644 /etc/apt/keyrings/grafana.asc
    echo "deb [signed-by=/etc/apt/keyrings/grafana.asc] https://apt.grafana.com stable main" > /etc/apt/sources.list.d/grafana.list
    apt update && apt install -y grafana
    systemctl enable --now grafana-server
  4. Configure o Grafana. Acesse http://IP:3000 (usuário e senha iniciais admin/admin; troque no primeiro login). Em Connections → Data sources, adicione Prometheus com a URL http://localhost:9090. Em Dashboards → New → Import, informe o ID 1860 (Node Exporter Full) para ter um painel completo de servidor Linux.

E o Proxmox?

  • O prometheus-pve-exporter lê a API do Proxmox (com um token somente leitura) e entrega métricas de cada VM, container e storage para o Prometheus.
  • Alternativa nativa: em Datacenter → Metric Server, o Proxmox envia métricas para um InfluxDB ou Graphite, que o Grafana também lê.

Como saber se funcionou

  • Netdata: curl -s http://127.0.0.1:19999/api/v1/info | head retorna JSON com a versão.
  • node_exporter: curl -s http://127.0.0.1:9100/metrics | grep node_load1.
  • Prometheus: em http://IP:9090/targets todos os alvos aparecem como UP.
  • Grafana: o dashboard 1860 mostra dados ao escolher o host no topo.

Problemas comuns

  • Alvo DOWN no Prometheus: firewall bloqueando a 9100 ou IP errado no prometheus.yml.
  • Grafana "No data": data source errado no dashboard ou intervalo de tempo antes do início da coleta.
  • Disco enchendo: reduza a retenção do Prometheus ou o espaço reservado ao banco do Netdata (seção [db] do netdata.conf).
  • Netdata consumindo CPU: em hosts com muitas VMs, desative coletores que não usa e aumente o intervalo (update every).

Perguntas frequentes

Qual a diferença entre Prometheus e Grafana?

O Prometheus coleta e guarda as métricas (banco de séries temporais). O Grafana não guarda nada: ele consulta o Prometheus (ou outras fontes) e desenha os gráficos. Por isso costumam ser usados juntos.

O Netdata é gratuito?

O agente Netdata é open source e gratuito para instalar no seu servidor. O Netdata Cloud é opcional e tem planos gratuito e pagos.

Qual a senha padrão do Grafana?

Usuário admin e senha admin. O Grafana pede a troca no primeiro login; faça isso antes de liberar o acesso a qualquer pessoa.

Preciso de Zabbix se já uso Prometheus e Grafana?

Não necessariamente. Muitos usam Zabbix para alertas e inventário e Grafana para gráficos detalhados. Veja também o artigo «Como instalar Zabbix Agent 2 no Debian, Ubuntu e Proxmox».

Para métricas de banco, veja também o artigo «Como monitorar banco de dados: pg_stat_statements, Performance Schema e PMM». Para servidores Windows, «Windows Server lento: como monitorar CPU, memória e disco (Gerenciador de Recursos e Monitor de Desempenho)».

Leitura complementar

Precisa de ajuda? Abra um ticket ou fale com o suporte pelo WhatsApp.

Esta resposta lhe foi útil? 0 Usuários acharam útil (0 Votos)

Leia também