Prometheus: Prometheus 服务概览

本文件是介绍指南的一部分。您可以在这里查看完整指南:Prometheus 的工作原理

👋 欢迎来到 Stackhero 文档!

Stackhero 提供了一个完全托管的 Prometheus cloud 平台,专为高可靠性和简易性设计:

  • 内置 Alert Manager,可将告警直接发送到 SlackMattermostPagerDuty 及其他主流平台。
  • 配备专用邮件服务器,支持发送无限量邮件告警,无需额外配置。
  • 集成 Blackbox,可对 HTTPICMPTCP 及其他协议进行探测,实现全面监控。
  • 通过在线配置文件编辑器,您可以快速配置实例,无需手动管理 YAML。
  • 一键升级,Stackhero 自动为您处理升级流程,最大限度减少停机和人工干预。
  • 高性能与强大安全性内建,您的服务运行在专属的私有基础设施上。

大约 5 分钟即可完成部署。Stackhero 负责所有初始化设置,让您专注于监控本身,无需担心维护。欢迎体验 Stackhero 的 Prometheus cloud hosting,让您的监控与告警流程更加高效。

Prometheus 通过基本和补充组件提供监控功能。以下是关键元素:

  • Prometheus Server

    • 通过 HTTP 定期从指定的 targets(导出器)收集指标。
    • 将这些指标存储在其内置的时间序列数据库中。
    • 评估警报规则以根据阈值生成通知。
  • Alert Manager

    • 管理由 Prometheus 生成的警报。
    • 聚合、去重并将这些警报转发到您首选的通信渠道。
  • Blackbox Exporter

    • 使用 HTTP(S)、DNS、TCP 和 ICMP 等协议测试端点的可用性和性能。
  • Node Exporter

    • 为 Linux 服务器提供硬件和操作系统级别的指标给 Prometheus。
  • Grafana

    • 一个补充 Prometheus 的可视化平台,能够创建动态、可定制的仪表板以进行详细的数据分析。