Prometheus: Einführung
Wie Prometheus funktioniert
👋 Willkommen in der Stackhero-Dokumentation!
Stackhero bietet eine vollständig verwaltete Prometheus Cloud Plattform, die auf Zuverlässigkeit und Einfachheit ausgelegt ist:
Alert Managerist integriert, sodass Sie Warnmeldungen direkt anSlack,Mattermost,PagerDutyund andere gängige Ziele weiterleiten können.- Ein dedizierter E-Mail-Server ermöglicht das Versenden von unbegrenzten E-Mail-Benachrichtigungen ohne zusätzlichen Konfigurationsaufwand.
Blackboxist enthalten und ermöglicht das Prüfen vonHTTP,ICMP,TCPund weiteren Protokollen für ein umfassendes Monitoring.- Konfigurieren Sie Ihre Instanz schnell und einfach mit dem Online-Konfigurationseditor – manuelles Bearbeiten von YAML ist nicht erforderlich.
- Updates lassen sich mit nur einem Klick anwenden. Stackhero übernimmt den gesamten Upgrade-Prozess für Sie und minimiert so Ausfallzeiten und manuellen Aufwand.
- Hohe Performance und starke Sicherheit sind durch Ihre eigene private, dedizierte Infrastruktur gewährleistet.
In etwa 5 Minuten einsatzbereit. Stackhero übernimmt die Einrichtung, damit Sie sich auf das Monitoring konzentrieren können – nicht auf die Wartung. Testen Sie das Prometheus Cloud Hosting von Stackhero, um Ihre Monitoring- und Alerting-Prozesse zu optimieren.
Was ist Prometheus
Prometheus ist ein hochgradig anpassungsfähiges und zuverlässiges Überwachungssystem, das entwickelt wurde, um die Leistung und Zuverlässigkeit verschiedener Infrastrukturen zu verbessern. Es integriert sich nahtlos in unterschiedliche Umgebungen, einschließlich physischer Server, virtueller Maschinen und Netzwerkausrüstung. Prometheus sammelt und verarbeitet Metriken von vordefinierten Zielen, was die Generierung von Warnungen basierend auf spezifischen Bedingungen ermöglicht, um Sie über den Status Ihres Systems auf dem Laufenden zu halten.
Der Alert Manager, der in Ihrer Stackhero Prometheus-Instanz enthalten ist, erleichtert die Einrichtung von Benachrichtigungswarnungen. Diese Warnungen können so konfiguriert werden, dass sie mit weit verbreiteten Kommunikationstools wie E-Mail, Slack, PagerDuty, OpsGenie und anderen funktionieren. In Kombination mit Grafana entwickelt sich Prometheus zu einer umfassenden Überwachungssuite, die interaktive Dashboards für eine effektive Metrikvisualisierung und -analyse bietet.
Übersicht von Stackhero für Prometheus
Übersicht der Prometheus-Dienste
Prometheus bietet Überwachungsfunktionen durch wesentliche und ergänzende Komponenten. Nachfolgend sind die Schlüsselelemente aufgeführt:
-
Prometheus Server:
- Sammelt regelmäßig Metriken von angegebenen
targets(Exportern) über HTTP. - Speichert diese Metriken in seiner integrierten Zeitreihendatenbank.
- Bewertet Alarmregeln, um Benachrichtigungen basierend auf Schwellenwerten zu generieren.
- Sammelt regelmäßig Metriken von angegebenen
-
Alert Manager:
- Verwalten von Warnungen, die von Prometheus generiert werden.
- Aggregiert, dedupliziert und leitet diese Warnungen an Ihre bevorzugten Kommunikationskanäle weiter.
-
Blackbox Exporter:
- Testet die Verfügbarkeit und Leistung von Endpunkten unter Verwendung von Protokollen wie HTTP(S), DNS, TCP und ICMP.
-
Node Exporter:
- Bietet Hardware- und Betriebssystem-Metriken für Linux-Server an Prometheus.
-
Grafana:
- Eine Visualisierungsplattform, die Prometheus ergänzt und die Erstellung dynamischer, anpassbarer Dashboards für eine detaillierte Datenanalyse ermöglicht.
Konfiguration von Prometheus, Alert Manager und Blackbox
Sie können die Konfigurationen für Prometheus, Alert Manager und Blackbox mit YAML-Konfigurationsdateien verwalten. Diese Dateien sind direkt von Ihrem Stackhero-Dashboard aus zugänglich und bearbeitbar. Nach Änderungen werden diese automatisch angewendet, was einen nahtlosen Konfigurationsprozess ohne Neustart der Dienste gewährleistet.
Wenn ein Fehler in einer Konfigurationsdatei vorliegt, werden die Änderungen nicht angewendet. Zur Fehlerbehebung können Sie die Fehlerprotokolle im Abschnitt "logs" Ihres Prometheus-Dienstes auf dem Stackhero-Dashboard einsehen.
Backups der Prometheus-Konfigurationen
Jedes Mal, wenn Sie eine Konfigurationsdatei ändern, wird automatisch ein Backup erstellt und in einem dafür vorgesehenen Backup-Verzeichnis gespeichert. Das System behält die fünf neuesten Backups oder diejenigen, die in den letzten 14 Tagen erstellt wurden, und entfernt automatisch ältere Einträge.
Sie können auf diese Backups unter der folgenden URL zugreifen: https://<yourServiceDomain>/configurations/files/backups/.
Löschen von Daten aus Prometheus
Wenn Sie bestimmte Zeitreihendaten, die in Prometheus aufgezeichnet wurden, entfernen müssen, können Sie die Admin-API verwenden. Um beispielsweise Daten zu löschen, die mit einem Job namens oldJob verbunden sind, könnten Sie den folgenden Befehl verwenden:
curl -u admin -X POST -g 'https://<yourServiceDomain>/api/v1/admin/tsdb/delete_series?match[]={job="oldJob"}'
Sobald Daten gelöscht sind, können sie nicht wiederhergestellt werden. Stellen Sie sicher, dass Sie umfassende Backups haben und gehen Sie bei solchen Aktionen vorsichtig vor.
Für weitere Informationen konsultieren Sie die offizielle Prometheus-Dokumentation.