Prometheus: Konfiguration von Prometheus-Warnregeln

Diese Dokumentation ist Teil des Warnungen-Leitfadens. Den vollständigen Leitfaden finden Sie hier: Wie Prometheus-Warnungen funktionieren und wie man sie konfiguriert.

👋 Willkommen in der Stackhero-Dokumentation!

Stackhero bietet eine vollständig verwaltete Prometheus Cloud Plattform, die auf Zuverlässigkeit und Einfachheit ausgelegt ist:

  • Alert Manager ist integriert, sodass Sie Warnmeldungen direkt an Slack, Mattermost, PagerDuty und andere gängige Ziele weiterleiten können.
  • Ein dedizierter E-Mail-Server ermöglicht das Versenden von unbegrenzten E-Mail-Benachrichtigungen ohne zusätzlichen Konfigurationsaufwand.
  • Blackbox ist enthalten und ermöglicht das Prüfen von HTTP, ICMP, TCP und weiteren Protokollen für ein umfassendes Monitoring.
  • Konfigurieren Sie Ihre Instanz schnell und einfach mit dem Online-Konfigurationseditor – manuelles Bearbeiten von YAML ist nicht erforderlich.
  • Updates lassen sich mit nur einem Klick anwenden. Stackhero übernimmt den gesamten Upgrade-Prozess für Sie und minimiert so Ausfallzeiten und manuellen Aufwand.
  • Hohe Performance und starke Sicherheit sind durch Ihre eigene private, dedizierte Infrastruktur gewährleistet.

In etwa 5 Minuten einsatzbereit. Stackhero übernimmt die Einrichtung, damit Sie sich auf das Monitoring konzentrieren können – nicht auf die Wartung. Testen Sie das Prometheus Cloud Hosting von Stackhero, um Ihre Monitoring- und Alerting-Prozesse zu optimieren.

Sie können Prometheus-Warnregeln anpassen, indem Sie die Datei rules-alert.yml bearbeiten. Um dies zu tun, greifen Sie auf Ihr Stackhero-Dashboard zu, wählen Sie Ihren Prometheus-Dienst aus und klicken Sie auf "Konfiguration der Prometheus-Warnregeln".

Wir haben bereits einige Standardwarnregeln zu Ihrer Stackhero for Prometheus-Instanz hinzugefügt, sodass Sie die Datei rules-alert.yml normalerweise nicht ändern müssen, es sei denn, eine Anpassung ist erforderlich.

Hier ist ein Beispiel für eine Warnung, die ausgelöst wird, wenn die Festplattennutzung 90 % überschreitet:

- alert: "HostOutOfDiskSpace"
  expr: (node_filesystem_avail_bytes * 100) / node_filesystem_size_bytes < 10 and ON (instance, device, mountpoint) node_filesystem_readonly == 0
  for: 2m
  labels:
    severity: "warning"
  annotations:
    summary: "Host out of disk space (instance {{ $labels.instance }})"
    description: "Disk is almost full (< 10% left)"
    value: "{{ $value }}"

Hier ist ein weiteres Beispiel, das eine potenzielle Sättigung des Speicherplatzes innerhalb der nächsten 24 Stunden vorhersagt:

- alert: "HostDiskWillFillIn24Hours"
  expr: (node_filesystem_avail_bytes * 100) / node_filesystem_size_bytes < 10 and ON (instance, device, mountpoint) predict_linear(node_filesystem_avail_bytes{fstype!~"tmpfs"}[1h], 24 * 3600) < 0 and ON (instance, device, mountpoint) node_filesystem_readonly == 0
  for: 2m
  labels:
    severity: "warning"
  annotations:
    summary: "Host disk will fill in 24 hours (instance {{ $labels.instance }})"
    description: "Filesystem is predicted to run out of space within the next 24 hours at the current write rate"
    value: "{{ $value }}"

Sie können viele zusätzliche Beispiele für Warnregeln auf der Awesome Prometheus Alerts Website finden.