Warum ist die VDS-Überwachung wichtig?
Wenn Sie einen VDS (Virtual Dedicated Server) nutzen, ist die kontinuierliche Überwachung der Leistung und des Zustands Ihres Servers von entscheidender Bedeutung. Bei plötzlichen Traffic-Spitzen, Ressourcenerschöpfung oder Angriffen benötigen Sie die richtigen Werkzeuge, um schnell eingreifen zu können. Das Duo Prometheus und Grafana ist in der Open-Source-Welt eine der leistungsstärksten Kombinationen, um diesen Bedarf zu decken. In dieser Anleitung erkläre ich Schritt für Schritt, wie Sie auf einem VDS mit Prometheus Metriken sammeln und diese Daten mit Grafana visualisieren.
Was ist Prometheus?
Prometheus ist ein von SoundCloud entwickeltes, zeitreihenbasiertes Überwachungs- und Alarmsystem. Dank seiner Pull-basierten Architektur ruft es in regelmäßigen Abständen Metriken von Zielsystemen ab. Es zeichnet sich durch Skalierbarkeit und die flexible Abfragesprache PromQL aus. Für einen VDS werden typischerweise Metriken wie CPU, RAM, Festplattennutzung und Netzwerkverkehr gesammelt.
Installation von Prometheus
Stellen Sie zunächst eine SSH-Verbindung zu Ihrem VDS her. Sie können Prometheus von der offiziellen Website herunterladen und installieren. Beispielbefehle für Ubuntu/Debian:
- wget https://github.com/prometheus/prometheus/releases/download/v2.53.0/prometheus-2.53.0.linux-amd64.tar.gz
- tar xvf prometheus-2.53.0.linux-amd64.tar.gz
- sudo mv prometheus-2.53.0.linux-amd64 /opt/prometheus
Erstellen Sie anschließend einen systemd-Dienst. Bearbeiten Sie die Datei prometheus.yml, um die gewünschten Ziele hinzuzufügen. Um beispielsweise mit node_exporter Hardware-Metriken zu sammeln:
scrape_configs: - job_name: 'node' static_configs: - targets: ['localhost:9100']Hinweis: Denken Sie daran, dass Sie Node Exporter separat installieren müssen.
Visualisierung mit Grafana
Grafana ist eine Open-Source-Analytikplattform, die Daten in ansprechenden Dashboards präsentiert. Sie können Prometheus als Datenquelle hinzufügen und innerhalb weniger Minuten Dashboards erstellen.
Installation von Grafana
Fügen Sie das offizielle Grafana-Repository hinzu und installieren Sie es:
- sudo apt-get install -y software-properties-common
- sudo add-apt-repository "deb https://packages.grafana.com/oss/deb stable main"
- sudo apt-get update && sudo apt-get install grafana
Starten Sie den Dienst und greifen Sie über http://server_ip:3000 auf die Weboberfläche zu. Der Standard-Benutzername/das Standard-Passwort ist admin/admin.
Dashboard-Erstellung
Um ein Dashboard in Grafana zu erstellen, wählen Sie "Create" > "Dashboard". Wählen Sie dann die Prometheus-Datenquelle aus und geben Sie eine Metrik ein. Um beispielsweise die CPU-Auslastung anzuzeigen:
100 - (avg by (instance) (rate(node_cpu_seconds_total{mode="idle"}[5m])) * 100)
Diese Abfrage berechnet den Durchschnitt der Leerlauf-CPU-Zeit der letzten 5 Minuten und gibt die Auslastung in Prozent an. Sie können solche Abfragen anpassen, um auch RAM, Festplatten-I/O und Netzwerkmetriken hinzuzufügen.
Alarmkonfiguration
Eine der leistungsstärksten Funktionen von Prometheus ist das integrierte Alarmsystem mit Alertmanager. Sie können beispielsweise eine Regel schreiben, die eine E-Mail-Benachrichtigung sendet, wenn die CPU-Auslastung 90 % übersteigt.
Fügen Sie die folgende Regel zur Prometheus-Konfigurationsdatei hinzu:
groups: - name: cpu_alerts rules: - alert: HighCPUUsage expr: 100 - (avg by (instance) (rate(node_cpu_seconds_total{mode="idle"}[5m])) * 100) > 90 for: 5m labels: severity: critical annotations: summary: "CPU-Auslastung über 90 %"Mit Alertmanager können Sie diese Warnungen an Kanäle wie E-Mail, Slack oder Telegram weiterleiten.
Ein Praxisbeispiel
Nach der Einrichtung von Prometheus und Grafana auf dem VDS eines Kunden löste ein automatischer Alarm aus, als der Festplattenspeicher 85 % erreichte. Wir bereinigten unnötige Log-Dateien und lösten das Problem. Außerdem entdeckten wir im Grafana-Dashboard ein Speicherleck, das normalerweise unbemerkt geblieben wäre, und aktualisierten die Anwendung. Dadurch konnte die Betriebszeit erhöht werden.
„Ohne Überwachung gibt es keine Verbesserung. Prometheus und Grafana sind die Augen und Ohren eines VDS-Administrators.“
Zusammenfassend können Sie mit diesen beiden Werkzeugen den Zustand Ihres VDS Schritt für Schritt unter Kontrolle bringen und durch proaktive Maßnahmen Probleme lösen, bevor sie eskalieren. Denken Sie daran: Überwachung ist nur der Anfang; aktualisieren Sie regelmäßig Ihre Dashboards und fügen Sie nach Bedarf neue Metriken hinzu.