Support Dashboard Refresh
Reordenar el panel de soporte de un centro de datos federal para que el turno de guardia entienda el estado de la red en segundos, no en minutos.
De dónde venía el problema
El equipo de soporte de un centro de datos en el corredor norte atendía tres turnos con un tablero heredado: métricas de fibra, estado de los enlaces redundantes y alertas de segmentación OT convivían en la misma pantalla sin jerarquía. Cuando caía un tramo troncal, el operador de guardia tardaba varios minutos en distinguir si el corte era de transporte, de energía o de un equipo de borde. Ese retraso se traducía en llamadas cruzadas con los responsables de planta y en registros de incidentes incompletos.
La decisión no fue sumar herramientas nuevas, sino reordenar lo que ya existía. Antes de tocar la interfaz se hizo un inventario de las consultas reales del turno nocturno: qué se mira primero, qué se ignora y qué se busca a mano cuando algo falla.
Cómo se armó el nuevo panel
Se separó la vista en tres capas. Arriba, un resumen de disponibilidad por tramo con el estado de los enlaces de fibra óptica y su redundancia. En el medio, los eventos de red agrupados por severidad y origen, con marca de tiempo y nodo afectado. Abajo, un bloque de contexto con los últimos cambios de configuración y las ventanas de mantenimiento programadas, algo que antes vivía en planillas aparte.
El refresco automático se fijó en intervalos distintos según la criticidad: los enlaces troncales cada pocos segundos, los indicadores de capacidad cada minuto. También se dejó un registro exportable por incidente, útil para las auditorías de protección de datos que exige el cliente estatal. Nada de gráficos decorativos: cada bloque responde a una pregunta concreta que el operador se hace durante la guardia.
Qué cambió en la operación
El turno de noche pasó de revisar cuatro pantallas a trabajar sobre una sola vista con prioridades claras. Los incidentes de enlace quedan clasificados desde el primer minuto y el traspaso entre turnos se hace con un resumen exportable en lugar de un chat informal. El equipo de planta, por su parte, recibe avisos con el nodo exacto y no con un "hay problemas de red" genérico.
Quedan pendientes dos cosas: integrar el inventario de activos OT al mismo panel y definir alertas por umbral para los enlaces que hoy se monitorean solo por evento. Es un refresh, no un rediseño total, y así se planteó desde el inicio.
Ver el primer caso de la serie o escribirnos desde contacto si tu operación necesita algo parecido.