

„Backup się wykonał” nie odpowiada na najważniejsze pytanie. Ile zajmie powrót do pracy?
Ustalamy RPO i RTO dla krytycznych usług, izolujemy kopie od źródła i regularnie sprawdzamy, czy dane da się odzyskać.
Ciągłość działania zaczyna się przed awarią, nie po niej.
Projektujemy nie tylko kopię. Projektujemy powrót do pracy.
Ustalamy co jest krytyczne, ile danych firma może utracić, ile może trwać przestój, gdzie są kopie, kto ma do nich dostęp i jak wygląda procedura odtworzenia.
- 3-2-1 / off-site / offline / immutable tam, gdzie ma to sens
- szyfrowanie i ograniczony dostęp do repozytoriów
- monitoring błędów, pojemności i czasu wykonywania zadań
- regularne testy plików, baz, VM lub całej usługi
- runbook DR z kolejnością i odpowiedzialnością
Nie obiecujemy „szybkiego restore”. Najpierw definiujemy liczby.
Wartości są przykładem projektowym. Realne RPO/RTO wynikają z kosztu przestoju i możliwości technicznych środowiska.
system operacyjny / produkcja / sprzedaż
CRM / pliki / księgowość
archiwum / dane odtwarzalne
Procedura jest prawdziwa dopiero wtedy, gdy zespół przejdzie ją od początku do końca.
Testujemy wybrane scenariusze bez wpływu na produkcję albo w kontrolowanym oknie. Mierzymy rzeczywisty czas, notujemy blokady i aktualizujemy runbook.
-
01
Scenariusz
np. utrata VM, ransomware, awaria storage, usunięcie danych
-
02
Odtworzenie
wykonanie procedury przez osoby wskazane w runbooku
-
03
Pomiar
rzeczywiste RPO/RTO, zależności i problemy
-
04
Poprawki
aktualizacja technologii, procedur i odpowiedzialności
Restore jednego pliku nie potwierdza, że odtworzysz całą usługę.
najprostszy test integralności i dostępu do kopii
odtworzenie do środowiska testowego i podstawowa weryfikacja spójności
uruchomienie systemu z kopii, sieć, dostęp i zależne usługi
pełny scenariusz: aplikacja, baza, tożsamość, DNS, integracje i użytkownik
kontrolowane przejście przez runbook z pomiarem czasu i odpowiedzialności






