Control Anti-Flapping

Aprende cómo el algoritmo inteligente de MonitorNOC mitiga la fatiga por exceso de alarmas intermitentes.

La intermitencia rápida de red (flapping) es uno de los problemas más estresantes para los equipos de guardia (On-Call). Ocurre cuando un enlace o servidor sube y baja constantemente debido a pérdida parcial de paquetes o saturación, inundando los grupos de soporte con decenas de notificaciones consecutivas de DOWN y UP.

MonitorNOC implementa un algoritmo de Control Anti-Flapping que congela el ruido de manera inteligente.


1. Detección del Estado “Flapping”

El sistema monitorea la frecuencia de cambios de estado del Target en una ventana de tiempo móvil de 30 minutos:

  • Si el host experimenta más de 3 transiciones de estado (caídas y recuperaciones alternadas) en 15 minutos, el monitor se marca en estado Inestable (Flapping).
  • Silenciamiento de Alertas: Al entrar en modo inestable, el motor silencia los envíos repetitivos de alertas de DOWN y UP.
  • Notificación de Inestabilidad: Se envía una única alerta especial: ⚠️ FLAPPING DETECTADO - Host inestable. Notificaciones consecutivas silenciadas.

2. Recuperación y Descongelamiento

El sistema reanudará las alertas normales de manera automática cuando:

  1. El Target se mantenga en un estado estable (exclusivamente UP o exclusivamente DOWN) por más de 15 minutos consecutivos.
  2. Envía una notificación final indicando que la estabilidad ha retornado y se reactiva el monitoreo estándar.

3. Configurar Umbrales de Conexión (Thresholds)

Para prevenir el flapping desde el origen, puedes ajustar los umbrales en la edición de tu monitor:

  • Intentos de Fallo: Número de chequeos consecutivos erróneos antes de abrir un incidente (ej: configurado en 3 intentos para un intervalo de 5 minutos, la caída se confirmará al minuto 15 de fallos continuos).
  • Intentos de Recuperación: Número de chequeos exitosos requeridos para cerrar el incidente y marcarlo como resuelto.