Son las dos de la mañana. En la pared del centro de monitoreo, decenas de indicadores brillan en verde. El responsable de turno le echa un vistazo, asiente y sigue con su café. Todo tranquilo. Y sin embargo, en ese mismo momento, un servicio del que depende la facturación lleva veinte minutos respondiendo tan lento que los clientes ya se están yendo. El tablero no lo muestra. Está en verde.
Esa escena resume el malentendido más común sobre el monitoreo: creer que "todo verde" quiere decir "todo bien". No siempre. A veces es justo la señal más peligrosa.
Qué es —y qué no es— un NOC
Un NOC (Network Operations Center) es el centro que vigila de forma continua la salud de tu infraestructura: redes, servidores, servicios, aplicaciones. Su trabajo es detectar y atender problemas, idealmente antes de que el negocio los sienta. No confundir con un SOC, que vigila seguridad; el NOC vigila que las cosas funcionen.
Pero un NOC no es su tablero. El tablero es solo el reflejo de una decisión previa: qué decidiste medir. Y ahí es donde casi todo se juega.
Qué mide un NOC que sí sirve
El monitoreo pobre se queda en el up/down: ¿el servidor responde al ping? Verde. El problema es que un servidor puede estar "arriba" y aun así no prestar el servicio. Un NOC maduro mide varias capas:
- Disponibilidad del servicio, no solo del equipo: que la aplicación responda, no que la máquina encienda.
- Rendimiento y latencia: la degradación lenta es la que más caro sale porque nadie la declara "caída".
- Capacidad y tendencia: el disco que se llenará en tres semanas se ve hoy, si lo mides.
- Dependencias y respaldos: que lo que sostiene al servicio también esté sano.
Por qué "todo verde" engaña
El verde solo dice una cosa: "lo que estoy vigilando está dentro de sus umbrales". No dice nada de lo que no estás vigilando. Un tablero puede estar impecable mientras hay un punto ciego —un servicio sin sensor, un umbral tan laxo que nunca se dispara, una métrica que a nadie se le ocurrió medir—. En esos casos el verde no es tranquilidad: es desconocimiento con buena presentación.
La pregunta incómoda para cualquier tablero verde es: ¿verde porque todo está bien, o verde porque no lo estamos mirando?
Cómo se ve el punto ciego en la práctica
Un ejemplo real y repetido: un servidor de aplicaciones vigilado solo por ping y uso de CPU. Ambos, en verde, durante meses. Lo que nadie medía era el pool de conexiones a la base de datos, que en horas pico se agotaba. La máquina respondía perfecto —ping, CPU y RAM normales—, pero cada nueva sesión de usuario esperaba en cola treinta o cuarenta segundos hasta rendirse. Para el tablero, cero problemas; para el usuario, el sistema estaba caído. El agujero no era técnico sino de decisión: se midió lo fácil (¿enciende la máquina?) en lugar de lo que le importa al negocio (¿puede un usuario completar su tarea?). El día que se agregó un sensor de transacción sobre el login, el "verde permanente" se convirtió en un patrón de alertas amarillas cada mediodía: feo de ver, pero por fin honesto.
Tablero decorativo vs. NOC de verdad
La diferencia no está en cuántas pantallas tiene, sino en si alguien puede responder, con datos, qué se mide, con qué umbral, quién recibe la alerta y qué hace con ella. Un NOC serio revisa y ajusta esa cobertura; un tablero decorativo se instaló una vez y se quedó bonito. Esto conecta directo con algo que ya escribimos: cómo evaluar si tu proveedor de TI realmente está monitoreando tu infraestructura.
Si quieres una foto objetiva de qué tan cubierto estás, nuestro assessment de madurez de monitoreo ayuda a ubicarlo. Y montar la vigilancia sobre lo que de verdad importa —con PRTG u otras herramientas— es parte de nuestro NOC/SOC administrado. Porque un buen monitoreo no busca más verde: busca que el verde signifique algo.
Un NOC serio se apoya en umbrales bien puestos, en distinguir lo sintético de la experiencia real del usuario y en decidir qué registrar y por cuánto tiempo.
Preguntas frecuentes
help ¿Qué es un NOC?
Un NOC (Network Operations Center) es el centro que vigila de forma continua la salud, disponibilidad y rendimiento de la infraestructura de TI —redes, servidores, servicios y aplicaciones— para detectar y atender problemas idealmente antes de que impacten al negocio. No es lo mismo que un SOC, que se enfoca en seguridad.
help ¿Por qué "todo en verde" puede ser mala señal?
Porque el verde solo confirma que lo que estás monitoreando está dentro de los umbrales definidos. Si el monitoreo tiene puntos ciegos, mide lo que no importa o tiene umbrales mal puestos, el tablero puede estar en verde mientras algo crítico se degrada sin que nadie lo vea. Verde significa "lo que vigilo está bien", no "todo está bien".
help ¿Qué debería medir un buen NOC?
Más allá del up/down: disponibilidad real de los servicios (no solo del servidor), rendimiento y latencia, uso y tendencia de capacidad (para anticipar saturación), estado de respaldos y de dependencias. Y sobre todo, medir lo que le importa al negocio, no solo lo que es fácil de graficar.
Rubén Espinoza es fundador y Director Técnico de IT Experts de México. Trabaja en la industria de TI desde 1998: diseña y opera soluciones de infraestructura, ciberseguridad, continuidad, automatización y tecnología OT para entornos empresariales e industriales. Escribe desde proyectos reales y sistemas en producción.
Ver perfil y todos sus artículos →