# Se adaugă în /etc/netdata/exporting.conf pentru a trimite datele în Grafana Cloud
[prometheus_remote_write:grafana_cloud]
enabled = yes
destination = https://<username>:<api_key>@prometheus-us-central1.grafana.net/api/prom/push
data source = average
update every = 10
buffer on failures bytes = 10485760Să fim serioși, dacă ai un VPS de 4 dolari pe Hetzner sau DigitalOcean pentru un proiect secundar, n-o să dai 15 dolari pe lună pe Datadog sau New Relic ca să știi când crapă. Am avut problema asta la un proiect cu vreo 8k useri activi, unde bugetul de infrastructură era critic. Am vrut monitorizare ca la carte (resurse, alerte, uptime), dar complet moca.
Dacă pui Prometheus și Grafana local pe un server cu 1GB RAM, ai belit cariciul. Îți mănâncă 30% din memorie doar ca să ruleze. Soluția? Un setup hibrid: agenți locali super light și stocare/vizualizare în cloud-ul lor gratuit.
Pilonul 1: Netdata pentru metrici locale instant
Netdata e genial pentru că e incredibil de rapid și vine preconfigurat cu tot ce ai nevoie. Instalezi agentul cu un singur curl și ai direct monitorizare pe CPU, RAM, I/O la disc, trafic de rețea și chiar procese individuale.
Consumul? Undeva la 50-80MB RAM. Partea mișto e că Netdata are acum un cloud gratuit unde poți asocia serverele tale. Nu trebuie să deschizi niciun port în firewall (cum ar fi 19999). Agentul face o conexiune securizată de tip outbound către cloud-ul lor și vezi totul într-un dashboard centralizat.
Pilonul 2: Grafana Cloud pentru istoric și alerte serioase
Netdata Cloud e bun pentru vizualizare rapidă, dar dacă vrei dashboard-uri customizate și alerte complexe pe Slack sau Discord, Grafana Cloud e regele.
În tier-ul gratuit ai voie să stochezi până la 10.000 de metrici active (active series). Pentru 3 servere mici, asta e mai mult decât suficient.
Cum le legi? Cel mai simplu e să configurezi Netdata să trimită datele direct în Grafana Cloud folosind protocolul Prometheus remote write. Nu mai instalezi alt agent (cum ar fi Grafana Alloy sau Telegraf). Doar modifici un fișier de configurare în Netdata și datele încep să curgă în instanța ta gratuită de Grafana.
Pilonul 3: UptimeRobot ca „dead man's switch”
Dacă pică rețeaua VPS-ului sau moare de tot hypervisor-ul, Netdata nu mai poate să trimită nimic. Grafana n-o să te anunțe imediat pentru că, pur și simplu, nu mai primește date.
Aici intervine UptimeRobot. Îl configurezi din exterior să facă un ping HTTP la fiecare 5 minute către aplicația ta. Dacă primește altceva în afară de status 200 (de exemplu un 502 Bad Gateway sau timeout), îți trimite instant alertă pe Telegram. E genul de unealtă pe care o setezi în 2 minute și uiți de ea până când chiar ai nevoie.
Trade-off-uri de care trebuie să știi
Nimic nu e perfect pe lumea asta, mai ales când e moca:
- Retenția datelor: Grafana Cloud Free îți păstrează metricile doar 14 zile. Pentru debug rapid e suficient, dar uită de rapoarte de performanță pe ultimele 6 luni.
- Latența alertelor: Pe planul gratuit de la UptimeRobot, verificarea se face la 5 minute. Dacă vrei verificare la 1 minut, trebuie să scoți cardul.
- Configurare manuală: Trebuie să editezi fișiere de configurare prin SSH, nu ai un wizard drăguț în interfață care să facă totul automat.
Voi ce folosiți pentru serverele mici de producție? Mergeți pe varianta self-hosted cu Docker Compose (chiar și cu riscul de a mânca resurse) sau preferați să externalizați monitorizarea în cloud-uri gratuite?