Zurück zum Blog ·

Monitoring ohne Monitoring-Stack

Der Reflex bei „ich möchte meinen Server überwachen" heißt Prometheus, Node Exporter, Alertmanager und Grafana. Vier Komponenten, ein paar hundert Megabyte Arbeitsspeicher, eine Konfigurationssprache für Alarmregeln und ein Dashboard, das man nach der ersten Woche nicht mehr aufruft.

Auf meiner Maschine sind von 7,7 GB Arbeitsspeicher 6,0 GB belegt. Ein Monitoring-Stack hätte dort mehr Speicher gebraucht als der Automatisierungsdienst, mit dem ich am Ende überwache. Das steht in keinem vernünftigen Verhältnis zu der Frage, die ich eigentlich beantwortet haben will: Läuft alles?

Was ich stattdessen mache

Ein geplanter Job in n8n, ein Befehl, ein Vergleich, eine Nachricht. Mehr ist es nicht. Drei Zeilen Shell, die feststellen, ob ein Dienst läuft, wie viel Platz noch da ist, wann das Zertifikat abläuft – und eine Telegram-Nachricht, wenn eine Antwort nicht passt.

Der wichtige Teil ist der letzte Halbsatz: eine Nachricht, wenn etwas nicht passt. Kein Dashboard, das man aktiv aufrufen muss. Kein Bericht, der jeden Morgen ungelesen ankommt und den man nach zwei Wochen wegfiltert. Stille bedeutet, dass alles in Ordnung ist.

Das deckt bei mir ab: laufen die Dienste, ist genug Platz auf der Platte, sind die Zertifikate frisch, ist das Backup durchgelaufen, stehen Updates an. Das sind fünf Fragen, und es sind ehrlicherweise die fünf, die in 95 Prozent der Fälle das Problem sind.

Was es nicht kann

Damit das nicht nach einer Wunderlösung klingt – hier ist, was mir dabei fehlt:

Für den letzten Punkt braucht es zwingend etwas von außen. Ein externer Ping-Dienst, der Alarm schlägt, wenn sich die Maschine nicht meldet, ist die eine Ergänzung, auf die man nicht verzichten sollte. Sie kostet nichts und schließt die einzige Lücke, die wirklich weh tut.

Wann der Stack sich lohnt

Ich bin nicht gegen Prometheus. Ich bin dagegen, mit dem Werkzeug anzufangen statt mit der Frage. Umsteigen würde ich, sobald einer dieser Punkte zutrifft:

Bis dahin ist eine Telegram-Nachricht bei Abweichung nicht der Kompromiss, sondern schlicht die angemessene Lösung. Der beste Monitoring-Aufbau ist der, den du tatsächlich betreibst – und ein ungepflegter Grafana-Stack mit drei stummgeschalteten Alarmregeln überwacht am Ende weniger als drei Zeilen Shell, die dir aufs Handy schreiben.