eduardweb.
DevOps & VPSIntermediar#devops#vps#netdata#monitoring#grafana

Cum monitorizezi moca un VPS: Setup-ul meu cu Netdata, Grafana Cloud și UptimeRobot

De Cristian Barbu, 21 iul. 2026 · 9 vizualizări · 2 like-uri

Postat 21 iul. 2026
plaintext
# /etc/netdata/exporting.conf
[exporting:global]
    enabled = yes
    update every = 5

[prometheus_remote_write:grafana_cloud]
    enabled = yes
    destination = https://prometheus-us-central1.grafana.net/api/prom/push
    username = 123456
    password = glc_your_very_long_api_key_here
    data source = as-is

Am tot văzut oameni care își urcă un side-project pe un VPS de 4 euro și apoi stau cu frica-n sân că pică baza de date sau li se umple discul pe timp de noapte. N-are sens să dai 15$ pe lună pe Datadog sau New Relic când infrastructura ta costă cât o cafea. Folosesc un trio moca de vreo trei ani pe vreo 5 mașini virtuale și n-am plătit niciun leu, dar știu exact când crapă ceva.

Piesa de rezistență: Netdata local

Netdata e genial pentru că vine cu auto-detect. Îl instalezi cu o singură linie de bash și pac, știe deja de Docker, Nginx, PostgreSQL sau Redis. Îți arată tot ce mișcă în timp real, la nivel de secundă.

Dar am învățat pe pielea mea un trade-off important. Dacă lași Netdata cu setările default pe un VPS cu 1GB RAM (cum e cel mai ieftin de la Hetzner sau DigitalOcean), îți mănâncă lejer 10-15% din CPU doar ca să ruleze motorul lui intern de baze de date (dbengine). Soluția mea? Reduc istoricul local la doar câteva ore și opresc colectarea de metrici inutile din /etc/netdata/netdata.conf. Lăsăm greul pe seama stocării externe.

Grafana Cloud pentru alerte și retenție

Netdata e bun pe serverul local, dar dacă îți moare VPS-ul cu totul, n-o să ai cum să-i accesezi dashboard-ul ca să vezi de ce a crăpat. Aici intervine Grafana Cloud.

Planul lor free e incredibil de generos: ai 10.000 de metrici active (Prometheus), plus 50 GB de loguri (Loki). În loc să rulezi tu o instanță greoaie de Prometheus local care să-ți mănânce memoria, configurezi Netdata să trimită datele direct în Grafana Cloud prin protocolul remote_write.

Configurarea se face extrem de simplu în /etc/netdata/exporting.conf. Odată ce metricile ajung în Grafana Cloud, îți poți construi dashboard-uri frumoase și, cel mai important, poți seta alerte pe Slack sau Telegram. Când consumul de RAM trece de 90% timp de 5 minute, primești notificare direct pe telefon.

UptimeRobot ca ultimă linie de apărare

Dacă pică rețeaua providerului sau moare Docker-ul complet, s-ar putea ca Grafana să întârzie câteva minute bune până se prinde că nu mai vin metrici (lipsă de date).

UptimeRobot e sfânt aici. Îi dai pur și simplu un URL de ping (de preferat un endpoint de /health din aplicația ta) și îl pui să verifice la fiecare 5 minute. E complet gratuit pentru 50 de monitoare. Dacă serverul dă un status de eroare (500, 502) sau nu răspunde deloc, primești notificare instant.

Cum le legi împreună

Ca să trimiți datele din Netdata către Grafana Cloud, trebuie doar să activezi conectorul de export. Mergi în contul tău de Grafana Cloud, secțiunea Prometheus, și copiezi URL-ul de Remote Write, User-ul și API Key-ul. Apoi editezi fișierul de export din Netdata.

Cu acest setup am redus load-ul pe un server mic cu vreo 30% față de momentele când rulam Prometheus local, iar costurile au rămas fix zero barat.

Voi ce folosiți pentru monitorizarea proiectelor personale? Mergeți pe varianta self-hosted cu Prometheus/Grafana sau preferați soluții SaaS moca?

Răspunsuri 0

Se încarcă răspunsurile…

Loghează-te pentru a răspunde

Doar membrii comunității pot lăsa comentarii.