Prometheus: Prometheus 服务概览
本文档属于介绍指南的一部分。您可以在此处查看完整指南:Prometheus 的工作原理。
👋 欢迎查阅 Stackhero 文档!
Stackhero 提供了一个完全托管的 Prometheus cloud 平台,专为高可靠性与简便性设计:
- 内置
Alert Manager,可将告警直接发送到Slack、Mattermost、PagerDuty及其他主流平台。- 配备专用邮件服务器,支持发送无限量邮件告警,无需额外配置。
- 集成
Blackbox,可对HTTP、ICMP、TCP等协议进行探测,实现全面监控。- 通过在线配置文件编辑器,快速完成实例配置,无需手动管理 YAML 文件。
- 一键升级,Stackhero 自动为您处理升级流程,最大限度减少停机和人工干预。
- 依托专属私有基础设施,内置高性能与强大安全性。
大约 5 分钟即可完成部署。Stackhero 负责所有初始化设置,让您专注于监控本身,无需为维护分心。欢迎体验 Stackhero 的 Prometheus cloud hosting,让您的监控与告警流程更加高效便捷。
Prometheus 通过基本和补充组件提供监控功能。以下是关键元素:
-
Prometheus Server:
- 通过 HTTP 定期从指定的
targets(导出器)收集指标。 - 将这些指标存储在其内置的时间序列数据库中。
- 评估警报规则以根据阈值生成通知。
- 通过 HTTP 定期从指定的
-
Alert Manager:
- 管理由 Prometheus 生成的警报。
- 聚合、去重并将这些警报转发到您首选的通信渠道。
-
Blackbox Exporter:
- 使用 HTTP(S)、DNS、TCP 和 ICMP 等协议测试端点的可用性和性能。
-
Node Exporter:
- 为 Linux 服务器提供硬件和操作系统级别的指标给 Prometheus。
-
Grafana:
- 一个补充 Prometheus 的可视化平台,能够创建动态、可定制的仪表板以进行详细的数据分析。