# /etc/netdata/exporting.conf
[exporting:global]
enabled = yes
update every = 5
[prometheus_remote_write:grafana_cloud]
enabled = yes
destination = https://prometheus-us-central1.grafana.net/api/prom/push
username = 123456
password = glc_your_very_long_api_key_here
data source = as-isAm tot văzut oameni care își urcă un side-project pe un VPS de 4 euro și apoi stau cu frica-n sân că pică baza de date sau li se umple discul pe timp de noapte. N-are sens să dai 15$ pe lună pe Datadog sau New Relic când infrastructura ta costă cât o cafea. Folosesc un trio moca de vreo trei ani pe vreo 5 mașini virtuale și n-am plătit niciun leu, dar știu exact când crapă ceva.
Piesa de rezistență: Netdata local
Netdata e genial pentru că vine cu auto-detect. Îl instalezi cu o singură linie de bash și pac, știe deja de Docker, Nginx, PostgreSQL sau Redis. Îți arată tot ce mișcă în timp real, la nivel de secundă.
Dar am învățat pe pielea mea un trade-off important. Dacă lași Netdata cu setările default pe un VPS cu 1GB RAM (cum e cel mai ieftin de la Hetzner sau DigitalOcean), îți mănâncă lejer 10-15% din CPU doar ca să ruleze motorul lui intern de baze de date (dbengine). Soluția mea? Reduc istoricul local la doar câteva ore și opresc colectarea de metrici inutile din /etc/netdata/netdata.conf. Lăsăm greul pe seama stocării externe.
Grafana Cloud pentru alerte și retenție
Netdata e bun pe serverul local, dar dacă îți moare VPS-ul cu totul, n-o să ai cum să-i accesezi dashboard-ul ca să vezi de ce a crăpat. Aici intervine Grafana Cloud.
Planul lor free e incredibil de generos: ai 10.000 de metrici active (Prometheus), plus 50 GB de loguri (Loki). În loc să rulezi tu o instanță greoaie de Prometheus local care să-ți mănânce memoria, configurezi Netdata să trimită datele direct în Grafana Cloud prin protocolul remote_write.
Configurarea se face extrem de simplu în /etc/netdata/exporting.conf. Odată ce metricile ajung în Grafana Cloud, îți poți construi dashboard-uri frumoase și, cel mai important, poți seta alerte pe Slack sau Telegram. Când consumul de RAM trece de 90% timp de 5 minute, primești notificare direct pe telefon.
UptimeRobot ca ultimă linie de apărare
Dacă pică rețeaua providerului sau moare Docker-ul complet, s-ar putea ca Grafana să întârzie câteva minute bune până se prinde că nu mai vin metrici (lipsă de date).
UptimeRobot e sfânt aici. Îi dai pur și simplu un URL de ping (de preferat un endpoint de /health din aplicația ta) și îl pui să verifice la fiecare 5 minute. E complet gratuit pentru 50 de monitoare. Dacă serverul dă un status de eroare (500, 502) sau nu răspunde deloc, primești notificare instant.
Cum le legi împreună
Ca să trimiți datele din Netdata către Grafana Cloud, trebuie doar să activezi conectorul de export. Mergi în contul tău de Grafana Cloud, secțiunea Prometheus, și copiezi URL-ul de Remote Write, User-ul și API Key-ul. Apoi editezi fișierul de export din Netdata.
Cu acest setup am redus load-ul pe un server mic cu vreo 30% față de momentele când rulam Prometheus local, iar costurile au rămas fix zero barat.
Voi ce folosiți pentru monitorizarea proiectelor personale? Mergeți pe varianta self-hosted cu Prometheus/Grafana sau preferați soluții SaaS moca?