Planificación de recuperación ante desastres - RTO, RPO y failover
Lectura de 2 min aprox.
La recuperación ante desastres (DR: Disaster Recovery) es un término general para los planes y procesos que, basándose en procedimientos y objetivos definidos de antemano, restauran los sistemas de TI cuando se detienen debido a desastres naturales, ciberataques, fallos de hardware y similares. El nivel de recuperación se define mediante dos métricas, el RPO (objetivo de punto de recuperación) y el RTO (objetivo de tiempo de recuperación), con el fin de minimizar el impacto en el negocio. A fecha de 2025, la difusión del DRaaS basado en la nube (Disaster Recovery as a Service) ha permitido que incluso las pequeñas y medianas empresas construyan una estructura de DR a un coste asequible.
Cuando un plan de DR se activa de verdad
Un plan de DR se pone a prueba en el momento en que realmente ocurre un fallo de nivel catastrófico. El desencadenante no se limita a terremotos, inundaciones o ciberataques: incluso un problema de instalaciones, como una subida de temperatura causada por un fallo del aire acondicionado en un centro de datos, puede llevar a un apagado de emergencia de los sistemas principales. Si el plan está preparado, la organización conmuta a un sitio de reserva o a otra región de la nube siguiendo los procedimientos predeterminados y restaura sus servicios. La vara de medir de la recuperación es el RTO: que el tiempo real de recuperación se mantenga dentro del objetivo verifica la eficacia del plan y del entrenamiento que lo respalda. Revisar lo sucedido tras la recuperación y trasladarlo a la revisión de los procedimientos y los valores objetivo mantiene la eficacia del plan.
El flujo del proceso de DR
La diferencia con el BCP
Mientras que el plan de continuidad del negocio (BCP) es una estrategia de continuidad para todo el negocio, la DR es un plan técnico especializado en la restauración de los sistemas de TI. Si bien un BCP también abarca aspectos como asegurar oficinas alternativas y confirmar la seguridad de los empleados, la DR se centra en los procedimientos de recuperación de servidores, bases de datos y redes. La DR es un componente crucial de un BCP, y resulta indispensable operar ambos de forma coordinada.
La elección de la estrategia de recuperación
Una estrategia de DR se elige según el equilibrio entre el coste y la velocidad de recuperación. Un sitio frío (donde solo se prepara una infraestructura mínima) tiene un bajo coste, pero tarda varios días en recuperarse. Un sitio templado (donde se mantienen en funcionamiento algunos sistemas) puede recuperarse en cuestión de horas. Un sitio caliente (donde un entorno equivalente al de producción se sincroniza en tiempo real) puede conmutar en minutos, pero es el más caro. En los entornos en la nube, predominan las configuraciones de DR flexibles que aprovechan la replicación Cross-Region de AWS o Azure Site Recovery. Establece una contraseña única y robusta para cada servicio a fin de proteger la consola de administración de tu entorno de DR, y combínala con una estrategia de copias de seguridad para construir una estructura de recuperación sólida.
¿Te resultó útil este artículo?