Los servidores fallan, la gente borra datos por error, las actualizaciones salen mal y las cuentas se ven comprometidas. Nada de esto puede descartarse del todo. Lo que sí se puede controlar es cuántos datos se pierden y cuánto tiempo se detiene el negocio.
Decide qué puedes permitirte perder
Dos preguntas definen el plan. ¿Cuántos datos puedes perder: la última hora, el último día? ¿Y cuánto tiempo puede estar el sistema sin servicio: minutos, horas, un día? Una tienda que recibe pedidos a todas horas necesita copias frecuentes y una recuperación rápida; una web corporativa que cambia una vez al mes puede vivir con copias diarias.
Copia todo lo que importa
La base de datos es la parte obvia, pero no la única. Los archivos e imágenes subidos, la configuración, los ajustes del entorno, las tareas programadas y la versión exacta del código también son necesarios para recuperar un sistema. Escribe la lista completa una vez y mantenla al día a medida que crece el sistema.
Guarda copias en más de un lugar
Una copia en el mismo servidor que el sistema desaparece junto con él. Guarda copias en un lugar separado -otro proveedor u otra región- y conserva al menos una copia que no pueda modificarse ni borrarse desde el sistema principal. Esto protege tanto de fallos de hardware como de ataques que intentan cifrar o borrar los datos.
Automatiza y vigila
Las copias manuales se olvidan justo cuando más falta hacen. Prográmalas automáticamente, conserva varias versiones y configura un aviso si una copia falla o resulta sospechosamente pequeña.
Prueba la restauración
Una copia que nunca se ha restaurado es una esperanza, no un plan. Restaura periódicamente una copia en un entorno separado y comprueba que el sistema funciona y que los datos están completos. Mide cuánto tarda: ese es tu tiempo real de recuperación.
Escribe los pasos de recuperación
Cuando algo se rompe, el estrés es alto y el tiempo escaso. Un documento breve con el orden de las acciones, la ubicación de las copias, los accesos necesarios y las personas de contacto convierte la recuperación en un procedimiento rutinario.
En resumen
Define la pérdida de datos y el tiempo de inactividad aceptables, copia la base de datos, los archivos y la configuración, guarda las copias por separado y protege al menos una del borrado, automatiza y vigila, prueba las restauraciones con regularidad y documenta los pasos. Así un fallo es un incidente y no un desastre.