Serverele se defectează, oamenii șterg date din greșeală, actualizările merg prost, conturile sunt compromise. Nimic din toate acestea nu poate fi exclus complet. Ce poți controla este câte date pierzi și cât timp stă afacerea pe loc.
Decide ce îți permiți să pierzi
Două întrebări definesc planul. Câte date poți pierde - ultima oră, ultima zi? Și cât timp poate fi sistemul indisponibil - minute, ore, o zi? Un magazin care primește comenzi non-stop are nevoie de backupuri frecvente și recuperare rapidă; un site de prezentare care se schimbă o dată pe lună se poate descurca cu copii zilnice.
Copiază tot ce contează
Baza de date este partea evidentă, dar nu singura. Fișierele și imaginile încărcate, configurația, setările mediului, sarcinile programate și versiunea exactă a codului sunt și ele necesare pentru a readuce sistemul la viață. Scrie lista completă o dată și actualizeaz-o pe măsură ce sistemul crește.
Păstrează copii în mai multe locuri
Un backup pe același server cu sistemul dispare odată cu el. Păstrează copii într-un loc separat - la alt furnizor sau în altă regiune - și cel puțin o copie care nu poate fi modificată sau ștearsă din sistemul principal. Asta protejează atât împotriva defecțiunilor hardware, cât și a atacurilor care încearcă să cripteze sau să șteargă datele.
Automatizează și monitorizează
Backupurile manuale sunt uitate exact când e nevoie de ele. Programează-le automat, păstrează un istoric de mai multe versiuni și configurează o alertă dacă un backup eșuează sau devine suspect de mic.
Testează restaurarea
Un backup care n-a fost niciodată restaurat este o speranță, nu un plan. Restaurează periodic o copie într-un mediu separat și verifică dacă sistemul funcționează și datele sunt complete. Cronometrează: acesta este timpul tău real de recuperare.
Scrie pașii de recuperare
Când ceva se strică, stresul e mare și timpul puțin. Un document scurt cu ordinea acțiunilor, locul backupurilor, accesele necesare și persoanele de contact transformă recuperarea într-o procedură de rutină.
Pe scurt
Stabilește pierderea de date și timpul de nefuncționare acceptabile, copiază baza de date, fișierele și configurația, păstrează copiile separat și protejează cel puțin una de ștergere, automatizează și monitorizează, testează regulat restaurarea și documentează pașii. Atunci o defecțiune este un incident, nu un dezastru.