Prometheus: Introducción
Cómo funciona Prometheus
👋 ¡Bienvenido a la documentación de Stackhero!
Stackhero ofrece una plataforma totalmente gestionada de Prometheus en la nube diseñada para ofrecer fiabilidad y simplicidad:
Alert Managerestá integrado, lo que le permite enviar alertas directamente aSlack,Mattermost,PagerDutyy otros destinos populares.- Un servidor de correo electrónico dedicado le permite enviar alertas ilimitadas por email sin necesidad de configuración adicional.
Blackboxestá incluido, permitiéndole monitorizarHTTP,ICMP,TCPy otros protocolos para una supervisión completa.- Configure su instancia rápidamente utilizando el editor online de archivos de configuración. No es necesario gestionar archivos YAML manualmente.
- Aplique actualizaciones con un solo clic. Stackhero se encarga del proceso de actualización por usted, minimizando el tiempo de inactividad y la intervención manual.
- Alto rendimiento y máxima seguridad integrados, gracias a su propia infraestructura privada y dedicada.
Ponga todo en marcha en unos 5 minutos. Stackhero se encarga de la configuración para que pueda centrarse en la monitorización, no en el mantenimiento. Pruebe el hosting de Prometheus en la nube de Stackhero para optimizar sus flujos de trabajo de monitorización y alertas.
¿Qué es Prometheus?
Prometheus es un sistema de monitorización altamente adaptable y fiable, diseñado para mejorar el rendimiento y la fiabilidad de diversas infraestructuras. Se integra sin esfuerzo con diferentes entornos, incluidos servidores físicos, máquinas virtuales y hardware de red. Prometheus recopila y procesa métricas de objetivos predefinidos, lo que permite generar alertas basadas en condiciones específicas para mantenerle informado sobre el estado de su sistema.
El Alert Manager, incluido en su instancia de Stackhero Prometheus, facilita la configuración de alertas de notificación. Estas alertas pueden configurarse para funcionar con herramientas de comunicación ampliamente utilizadas como el correo electrónico, Slack, PagerDuty, OpsGenie y otras. Cuando se integra con Grafana, Prometheus se convierte en una suite de monitorización completa, ofreciendo paneles interactivos para una visualización y análisis efectivos de métricas.
Visión general de Stackhero para Prometheus
Visión general de los servicios de Prometheus
Prometheus proporciona capacidades de monitorización a través de componentes esenciales y complementarios. A continuación se presentan los elementos clave:
-
Prometheus Server:
- Recopila periódicamente métricas de
targets(exportadores) especificados a través de HTTP. - Almacena estas métricas en su base de datos de series temporales integrada.
- Evalúa reglas de alerta para generar notificaciones basadas en umbrales.
- Recopila periódicamente métricas de
-
Alert Manager:
- Gestiona las alertas generadas por Prometheus.
- Agrega, deduplica y reenvía estas alertas a sus canales de comunicación preferidos.
-
Blackbox Exporter:
- Prueba la disponibilidad y el rendimiento de los endpoints utilizando protocolos como HTTP(S), DNS, TCP e ICMP.
-
Node Exporter:
- Proporciona métricas de hardware y a nivel de sistema operativo para servidores Linux a Prometheus.
-
Grafana:
- Una plataforma de visualización que complementa Prometheus, permitiendo la creación de paneles dinámicos y personalizables para un análisis detallado de datos.
Configuración de Prometheus, Alert Manager y Blackbox
Puede gestionar las configuraciones de Prometheus, Alert Manager y Blackbox utilizando archivos de configuración YAML. Estos archivos son accesibles y editables directamente desde su panel de control de Stackhero. Después de realizar cambios, se aplican automáticamente, asegurando un proceso de configuración sin problemas sin necesidad de reiniciar los servicios.
Si existe un error en un archivo de configuración, los cambios no se aplicarán. Para solucionar el problema, puede revisar los registros de errores disponibles en la sección "logs" de su servicio Prometheus en el panel de control de Stackhero.
Copias de seguridad de las configuraciones de Prometheus
Cada vez que modifica un archivo de configuración, se crea automáticamente una copia de seguridad y se almacena en un directorio de copias de seguridad designado. El sistema retiene las cinco copias de seguridad más recientes o aquellas creadas en los últimos 14 días, eliminando automáticamente las entradas más antiguas.
Puede acceder a estas copias de seguridad en la siguiente URL: https://<yourServiceDomain>/configurations/files/backups/.
Eliminación de datos de Prometheus
Si necesita eliminar datos de series temporales específicas registradas en Prometheus, puede utilizar la API de administración. Por ejemplo, para eliminar datos asociados con un trabajo llamado oldJob, podría usar el siguiente comando:
curl -u admin -X POST -g 'https://<yourServiceDomain>/api/v1/admin/tsdb/delete_series?match[]={job="oldJob"}'
Una vez que los datos se eliminan, no se pueden recuperar. Asegúrese de tener copias de seguridad completas y proceda con precaución al realizar tales acciones.
Para obtener información adicional, consulte la documentación oficial de Prometheus.