¿Por qué es importante el monitoreo de VDS?
Si utiliza un VDS (Servidor Dedicado Virtual), es fundamental realizar un seguimiento continuo del rendimiento y la salud de su servidor. Para poder intervenir rápidamente en situaciones como aumentos repentinos de tráfico, agotamiento de recursos o ataques, necesita las herramientas adecuadas. El dúo Prometheus y Grafana es una de las combinaciones más potentes en el mundo del código abierto para satisfacer esta necesidad. En esta guía, explicaré paso a paso cómo recopilar métricas con Prometheus y visualizar estos datos con Grafana en un VDS.
¿Qué es Prometheus?
Prometheus es un sistema de monitoreo y alertas basado en series temporales desarrollado por SoundCloud. Gracias a su estructura basada en pull, extrae métricas de los sistemas objetivo a intervalos regulares. Destaca por su escalabilidad y su lenguaje de consulta flexible, PromQL. Para un VDS, normalmente recopila métricas como CPU, RAM, uso de disco y tráfico de red.
Instalación de Prometheus
Primero, conéctese a su VDS mediante SSH. Puede descargar e instalar Prometheus desde el sitio web oficial. Ejemplos de comandos para Ubuntu/Debian:
- wget https://github.com/prometheus/prometheus/releases/download/v2.53.0/prometheus-2.53.0.linux-amd64.tar.gz
- tar xvf prometheus-2.53.0.linux-amd64.tar.gz
- sudo mv prometheus-2.53.0.linux-amd64 /opt/prometheus
A continuación, cree un servicio systemd. Edite el archivo prometheus.yml para agregar los objetivos que desea monitorear. Por ejemplo, para recopilar métricas de hardware con node_exporter:
scrape_configs: - job_name: 'node' static_configs: - targets: ['localhost:9100']Nota: Recuerde que debe instalar Node Exporter por separado.
Visualización con Grafana
Grafana es una plataforma analítica de código abierto que presenta los datos en paneles atractivos. Puede agregar Prometheus como fuente de datos y crear paneles en cuestión de minutos.
Instalación de Grafana
Puede agregar el repositorio oficial de Grafana e instalarlo:
- sudo apt-get install -y software-properties-common
- sudo add-apt-repository "deb https://packages.grafana.com/oss/deb stable main"
- sudo apt-get update && sudo apt-get install grafana
Inicie el servicio y acceda a la interfaz web en http://ip_del_servidor:3000. El usuario/contraseña predeterminado es admin/admin.
Creación de un panel
Para crear un panel en Grafana, use la opción "Create" > "Dashboard". Luego seleccione la fuente de datos Prometheus e ingrese una métrica. Por ejemplo, para ver el uso de CPU:
100 - (avg by (instance) (rate(node_cpu_seconds_total{mode="idle"}[5m])) * 100)
Esta consulta calcula el promedio de tiempo de CPU inactivo en los últimos 5 minutos y lo convierte en porcentaje de uso. Puede personalizar consultas similares para agregar métricas de RAM, disco I/O y red.
Configuración de alertas
Una de las características más potentes de Prometheus es su sistema de alertas integrado con Alertmanager. Por ejemplo, puede escribir una regla que envíe una notificación por correo electrónico cuando el uso de CPU supere el 90%.
Agregue la siguiente regla al archivo de configuración de Prometheus:
groups: - name: cpu_alerts rules: - alert: HighCPUUsage expr: 100 - (avg by (instance) (rate(node_cpu_seconds_total{mode="idle"}[5m])) * 100) > 90 for: 5m labels: severity: critical annotations: summary: "Uso de CPU superior al 90%"Con Alertmanager, puede dirigir estas alertas a canales como correo electrónico, Slack o Telegram.
Un ejemplo de la vida real
Después de configurar Prometheus-Grafana en el VDS de un cliente, cuando el espacio en disco alcanzó el 85%, la alerta automática se activó y solucionamos el problema limpiando archivos de registro innecesarios. Además, detectamos una fuga de memoria que normalmente habría pasado desapercibida en el panel de Grafana y actualizamos la aplicación. Esto aumentó el tiempo de actividad sin interrupciones.
“Sin monitoreo no se puede mejorar. Prometheus y Grafana son los ojos y oídos de los administradores de VDS.”
En conclusión, con estas dos herramientas puede tomar el control del estado de su VDS paso a paso y resolver problemas de manera proactiva antes de que crezcan. Recuerde, el monitoreo es solo el comienzo; actualice sus paneles regularmente y agregue nuevas métricas según sus necesidades.