# /etc/netdata/exporting.conf
[prometheus_write:grafana_cloud]
enabled = yes
destination = https://prometheus-us-central1.grafana.net/api/prom/push
data source = average
update every = 10
buffer on failures = yes
username = <YOUR_GRAFANA_CLOUD_USER_ID>
password = <YOUR_GRAFANA_CLOUD_API_KEY>Am pățit-o acum vreo doi ani cu un VPS de 5 euro pe care țineam trei site-uri de prezentare și un API pentru un client mic. Serverul a rămas fără memorie din cauza unui memory leak stupid într-un container de Node.js, s-a blocat complet și am aflat de problemă abia după vreo 4 ore, când m-a sunat clientul să mă întrebe de ce nu merge aplicația. Atunci mi-am dat seama că n-am nicio scuză să nu am monitorizare, mai ales când o poți face complet gratuit și fără bătăi de cap.
Dacă ai câteva VPS-uri pe la Hetzner, DigitalOcean sau chiar instanțe Oracle Cloud (cele „always free”), ai nevoie de o strategie de monitorizare care să nu te coste mai mult decât serverele în sine.
1. UptimeRobot: Paza de la poartă
UptimeRobot e sfânt pentru că e simplu de configurat și nu cere resurse de pe serverul tău. În varianta free primești 50 de monitoare cu verificare la interval de 5 minute. E arhisuficient ca să știi dacă serverul răspunde la ping sau dacă portul 443 e activ.
Eu îl configurez să trimită alertă direct pe un canal privat de Discord sau Telegram printr-un webhook.
Trade-off-ul: Intervalul de 5 minute înseamnă că serverul tău poate fi jos de 4 minute și 59 de secunde înainte ca tu să primești prima notificare. Pentru proiecte critice e cam mult, dar pentru chestii mici și medii este un compromis pe care mi-l asum cu plăcere pentru prețul de zero lei.
2. Netdata: Ce se întâmplă sub capotă?
Dacă UptimeRobot îți spune dacă a picat serverul, Netdata îți spune exact de ce a picat. Se instalează cu un singur script de bash și rulează direct pe server. Partea genială la Netdata e că vine „out-of-the-box” cu o grămadă de dashboard-uri și colectează metrici la secundă.
La un proiect cu vreo 8k useri activi pe zi, aveam spike-uri ciudate de CPU la fiecare oră. Cu monitorizarea clasică la 5 minute n-aș fi văzut niciodată micro-spike-urile alea de 2-3 secunde care blocau temporar baza de date. Netdata le-a prins imediat: era un cron job de backup prost optimizat.
Dezavantajul: Netdata consumă resurse (în special RAM) direct pe VPS-ul tău. Pe o mașină foarte mică, de 512MB RAM, agentul Netdata poate deveni el însuși o problemă dacă nu-i limitezi istoricul bazei de date locale sau dacă nu reduci frecvența de colectare.
3. Grafana Cloud: Unde centralizăm totul
Să intri pe fiecare VPS separat ca să te uiți pe dashboard-ul Netdata e obositor și ineficient. Aici intervine Grafana Cloud. Au un free tier extrem de generos: 3 utilizatori, 10.000 de metrici active și 50GB de loguri.
Cum le conectăm? Cel mai simplu mod este să folosim motorul de export al Netdata pentru a trimite datele direct în instanța ta de Grafana Cloud (care folosește Prometheus sub capotă). Tot ce trebuie să faci este să configurezi conectorul de export în Netdata.
Modifici fișierul de configurare /etc/netdata/exporting.conf și adaugi datele de acces din panoul tău de Grafana Cloud (secțiunea Prometheus Write Endpoint). După un restart la serviciul Netdata, metricile vor începe să curgă direct în Grafana, unde îți poți construi un dashboard centralizat pentru toate serverele tale.
Setup-ul ăsta oferă un raport utilitate/preț imbatabil. Ai alertare externă rapidă, telemetrie la secundă pe server și un istoric centralizat în cloud. Voi ce folosiți pentru mașinile mici de producție sau staging? Vă complicați cu Prometheus self-hosted sau mergeți tot pe soluții SaaS cu free tier?