Prometheus: Konfiguration von Prometheus-Warnregeln
Diese Dokumentation ist Teil des Warnungen-Leitfadens. Den vollständigen Leitfaden finden Sie hier: Wie Prometheus-Warnungen funktionieren und wie man sie konfiguriert.
👋 Willkommen in der Stackhero-Dokumentation!
Stackhero bietet eine vollständig verwaltete Prometheus Cloud Plattform, die auf Zuverlässigkeit und Einfachheit ausgelegt ist:
Alert Managerist integriert, sodass Sie Warnmeldungen direkt anSlack,Mattermost,PagerDutyund andere gängige Ziele weiterleiten können.- Ein dedizierter E-Mail-Server ermöglicht das Versenden von unbegrenzten E-Mail-Benachrichtigungen ohne zusätzlichen Konfigurationsaufwand.
Blackboxist enthalten und ermöglicht das Prüfen vonHTTP,ICMP,TCPund weiteren Protokollen für ein umfassendes Monitoring.- Konfigurieren Sie Ihre Instanz schnell und einfach mit dem Online-Konfigurationseditor – manuelles Bearbeiten von YAML ist nicht erforderlich.
- Updates lassen sich mit nur einem Klick anwenden. Stackhero übernimmt den gesamten Upgrade-Prozess für Sie und minimiert so Ausfallzeiten und manuellen Aufwand.
- Hohe Performance und starke Sicherheit sind durch Ihre eigene private, dedizierte Infrastruktur gewährleistet.
In etwa 5 Minuten einsatzbereit. Stackhero übernimmt die Einrichtung, damit Sie sich auf das Monitoring konzentrieren können – nicht auf die Wartung. Testen Sie das Prometheus Cloud Hosting von Stackhero, um Ihre Monitoring- und Alerting-Prozesse zu optimieren.
Sie können Prometheus-Warnregeln anpassen, indem Sie die Datei rules-alert.yml bearbeiten. Um dies zu tun, greifen Sie auf Ihr Stackhero-Dashboard zu, wählen Sie Ihren Prometheus-Dienst aus und klicken Sie auf "Konfiguration der Prometheus-Warnregeln".
Wir haben bereits einige Standardwarnregeln zu Ihrer Stackhero for Prometheus-Instanz hinzugefügt, sodass Sie die Datei rules-alert.yml normalerweise nicht ändern müssen, es sei denn, eine Anpassung ist erforderlich.
Hier ist ein Beispiel für eine Warnung, die ausgelöst wird, wenn die Festplattennutzung 90 % überschreitet:
- alert: "HostOutOfDiskSpace"
expr: (node_filesystem_avail_bytes * 100) / node_filesystem_size_bytes < 10 and ON (instance, device, mountpoint) node_filesystem_readonly == 0
for: 2m
labels:
severity: "warning"
annotations:
summary: "Host out of disk space (instance {{ $labels.instance }})"
description: "Disk is almost full (< 10% left)"
value: "{{ $value }}"
Hier ist ein weiteres Beispiel, das eine potenzielle Sättigung des Speicherplatzes innerhalb der nächsten 24 Stunden vorhersagt:
- alert: "HostDiskWillFillIn24Hours"
expr: (node_filesystem_avail_bytes * 100) / node_filesystem_size_bytes < 10 and ON (instance, device, mountpoint) predict_linear(node_filesystem_avail_bytes{fstype!~"tmpfs"}[1h], 24 * 3600) < 0 and ON (instance, device, mountpoint) node_filesystem_readonly == 0
for: 2m
labels:
severity: "warning"
annotations:
summary: "Host disk will fill in 24 hours (instance {{ $labels.instance }})"
description: "Filesystem is predicted to run out of space within the next 24 hours at the current write rate"
value: "{{ $value }}"
Sie können viele zusätzliche Beispiele für Warnregeln auf der Awesome Prometheus Alerts Website finden.