
Si el primer sistema de alerta de IT es una llamada de un usuario, existe un problema de visibilidad.
¿Cómo enterarse de una falla antes que el usuario?
Monitoreando disponibilidad y rendimiento continuamente y configurando alertas sobre condiciones que preceden a una caída.
Progress WhatsUp Gold combina monitoreo, alertas, notificaciones y políticas sobre infraestructura, servicios y aplicaciones.
No todo debería alertar cuando ya está caído
Un enlace no tiene que llegar al 100% de utilización para representar un problema.
Un disco no necesita quedarse sin espacio.
Una CPU no necesita permanecer saturada durante horas.
Los performance monitors permiten recopilar históricos, calcular tendencias y disponer de datos recientes para troubleshooting.
¿Qué métricas conviene vigilar?
Dependerá del activo, pero algunos ejemplos son:
- latencia;
- pérdida;
- utilización de interfaces;
- CPU;
- memoria;
- disco;
- disponibilidad;
- servicios críticos;
- respuestas SQL;
- métricas cloud.
¿Cuál es el riesgo de configurar demasiadas alertas?
Alert fatigue.
Si todo genera una notificación, ninguna notificación parece importante.
Cada alerta debería responder:
¿Hay una acción concreta que alguien debería ejecutar?
¿Murc puede diseñar el monitoreo?
Sí.
Murc puede ayudar a definir activos críticos, thresholds, escalamiento y dashboards para que las alertas representen problemas operativos reales.
Si hoy IT se entera de los incidentes por los usuarios, contactá a Murc para evaluar un esquema de monitoreo proactivo con WhatsUp Gold.