Cuando llega un apagón, ya es tarde para diseñar el plan

Restauración de sistemas y continuidad de negocio

Los problemas graves rara vez avisan con tiempo suficiente para diseñar un procedimiento sobre la marcha.

Un apagón prolongado es un buen ejemplo: de repente desaparece la alimentación eléctrica, los sistemas continúan unos minutos gracias a los SAIs y empieza una cuenta atrás.

La diferencia entre una crisis controlada y una situación caótica suele estar en lo que se preparó mucho antes.

Una experiencia que sigue siendo válida

En una etapa profesional anterior a Tecnidom, durante la coordinación técnica de una empresa de hosting y housing, un corte eléctrico dejó sin suministro a todo el polígono industrial.

La infraestructura disponía de autonomía mediante SAIs y baterías, pero el proveedor eléctrico no podía garantizar cuándo volvería el servicio.

En ese momento no había margen para improvisar.

Prioridades claras

Se confirmó la situación con el proveedor, se informó a los clientes y se inició un apagado controlado de los sistemas antes de agotar la autonomía disponible.

La clave no fue una herramienta concreta. Fue tener claro qué servicios eran prioritarios, cómo detenerlos correctamente, en qué orden debían arrancarse después y cómo mantener informados a los clientes.

La continuidad es más que un SAI

Un SAI compra tiempo. Un generador puede ampliar ese tiempo. Los backups protegen información. La redundancia reduce puntos únicos de fallo.

Pero ninguno de esos elementos sustituye un plan de continuidad.

Un plan debe definir responsables, prioridades, contactos, procedimientos de parada y arranque, dependencias, ubicación de copias y criterios para decidir cuándo escalar una incidencia.

Comunicar también forma parte del plan

En una crisis tecnológica es tentador esperar a tener todas las respuestas antes de informar. Normalmente es un error.

Los clientes y usuarios necesitan saber qué está ocurriendo, qué impacto existe y cuándo recibirán la siguiente actualización. La transparencia reduce incertidumbre y evita que el equipo técnico tenga que responder las mismas preguntas mientras intenta resolver el problema.

Probar antes de necesitarlo

Los procedimientos que nunca se han probado contienen suposiciones. Lo mismo ocurre con restauraciones, failover, accesos de emergencia y contactos de proveedores.

Por eso en Tecnidom tratamos continuidad, monitorización, backups y documentación como partes de una misma disciplina. No basta con disponer de los componentes: deben funcionar juntos cuando las condiciones dejan de ser normales.

La lección

Cuando volvió la electricidad, los sistemas pudieron arrancar de forma ordenada y no se perdió información.

La lección sigue siendo la misma años después: durante una crisis no diseñas el plan; ejecutas el que preparaste antes.

La mejor pregunta no es “¿qué haríamos si ocurre?”. Es “¿cuándo fue la última vez que comprobamos que sabemos hacerlo?”.

Antonio Domenech Pico
Sobre el autor

Antonio Domenech Pico

Antonio Domenech Pico es administrador de sistemas y fundador de Tecnidom. Cuenta con más de 30 años de experiencia en informática, trabajando con infraestructura, servidores, redes, monitorización, automatización y ciberseguridad para empresas.

Tecnidom

¿Necesitas ayuda con la tecnología de tu empresa?

Podemos revisar contigo qué está ocurriendo, qué riesgos existen y por dónde tiene sentido empezar.