Ocena wpływu przestoju IT na systemy krytyczne i pracę firmy produkcyjnej

Jak policzyć koszt przestoju IT i wskazać systemy krytyczne?

Najpierw wybierz proces biznesowy, a nie serwer. Dla scenariuszy 1, 8, 24 i 72 godzin oszacuj utracony wynik, bezproduktywny czas pracy, koszty obejścia i odtworzenia, opóźnienia, kary oraz skutki dla klientów. Następnie wskaż systemy, dane, ludzi i dostawców podtrzymujących ten proces. Na tej podstawie ustala się maksymalny tolerowany przestój, RTO i RPO.

Zacznij od procesu, który musi działać

NIST opisuje Business Impact Analysis jako sposób ustalenia funkcji niezbędnych dla misji organizacji oraz zasobów, które je wspierają. Dla firmy usługowej procesem może być przyjmowanie zamówień i obsługa klientów; dla produkcji — planowanie, sterowanie maszynami i wysyłka; dla biura rachunkowego — dostęp do dokumentów i systemów rozliczeniowych.

Dopiero po nazwaniu procesu wskazuje się pocztę, ERP, bazę danych, serwer plików, internet, uwierzytelnianie, energię, operatorów i dostawców. Jeden system może wspierać kilka procesów, a proces może zależeć od wielu pozornie drobnych usług.

Składniki kosztu przestoju

  • utracony wynik — sprzedaż lub marża, której nie można odzyskać po przywróceniu pracy;
  • czas pracowników — wynagrodzenia i narzuty za czas bez pracy lub pracę ręczną;
  • koszty odtworzenia — nadgodziny, zewnętrzni specjaliści, sprzęt, transport i odtwarzanie danych;
  • kary i zobowiązania — SLA, terminy ustawowe, opóźnienia dostaw i koszty finansowania;
  • utrata danych — ponowne wprowadzanie informacji, błędy i brak możliwości odtworzenia transakcji;
  • klienci i reputacja — reklamacje, odejścia i zwiększony koszt obsługi po zdarzeniu.

Nie wszystkie skutki da się uczciwie zamienić na jedną kwotę. Warto rozdzielić wartości policzalne od opisowych i dokumentować założenia.

Prosty arkusz scenariuszy

Czas niedostępnościPytania
Do 1 godzinyCzy praca może poczekać? Czy istnieje bezpieczne obejście? Ile osób od razu traci produktywność?
1–8 godzinKtóre terminy i dostawy są zagrożone? Czy rośnie kolejka spraw i koszt późniejszego nadrabiania?
8–24 godzinyCzy firma traci przychód, narusza umowy albo musi informować klientów?
24–72 godzinyCzy potrzebna jest praca w lokalizacji zapasowej, ręczna obsługa lub decyzja kryzysowa?
Powyżej 72 godzinCzy zagrożona jest płynność, ciągłość kluczowych umów albo zdolność dalszego działania?

Ready.gov proponuje podobne przedziały czasu oraz oddzielne opisanie wpływów operacyjnych i finansowych. Warto wykonać analizę również dla końca miesiąca, sezonu lub dnia o największej sprzedaży.

MTD, RTO i RPO w prostym języku

MTD to maksymalny czas, przez jaki proces może być zakłócony bez poważnej szkody. RTO określa, w jakim czasie zasób lub system ma wrócić, zanim wpływ stanie się nieakceptowalny. RPO mówi, do jakiego punktu w czasie można cofnąć dane — czyli ile najnowszych danych firma może stracić.

RTO systemu powinno być krótsze niż tolerowany przestój procesu, ponieważ po uruchomieniu technicznym często trzeba jeszcze sprawdzić dane i nadrobić zaległości. RPO musi odpowiadać częstotliwości kopii i rzeczywistej możliwości odtworzenia.

Jak powstaje lista systemów krytycznych

Dla każdego procesu zapisz właściciela, klientów, terminy, systemy, dane, urządzenia, lokalizacje, dostawców, zależności, obejścia i maksymalny czas przerwy. Następnie porównaj procesy według wpływu. Krytyczność nie jest cechą stałą: system płacowy może być szczególnie ważny przed terminem wypłat, a platforma zamówień w godzinach największego ruchu.

Lista powinna prowadzić do decyzji inwestycyjnych: monitoringu, redundancji, zapasowego łącza, backupu, części zamiennych, umowy serwisowej i ćwiczeń. Jeżeli oczekiwane RTO nie ma pokrycia w rozwiązaniu technicznym i umowie, jest życzeniem, a nie planem.

Dane do analizy wpływu biznesowego

  1. Lista procesów i ich właścicieli biznesowych.
  2. Okresy największej wrażliwości: godzina, dzień miesiąca i sezon.
  3. Liczba osób oraz klientów zależnych od procesu.
  4. Utracona marża lub wynik, a nie tylko całkowity przychód.
  5. Koszt bezczynności, pracy ręcznej i późniejszego nadrabiania.
  6. Kary, terminy prawne, zobowiązania umowne i skutki dla klientów.
  7. Systemy, dane, urządzenia, dostawcy i zależności procesu.
  8. MTD procesu oraz uzasadnione RTO i RPO zasobów.
  9. Dostępne obejścia i maksymalny czas ich bezpiecznego używania.
  10. Wynik testu, który potwierdza deklarowany czas odtworzenia.

Najczęstsze pytania

Ile kosztuje godzina przestoju IT?

Nie ma uniwersalnej stawki. Koszt zależy od procesu, liczby osób, pory, utraconego wyniku, kosztu obejścia, zobowiązań i czasu potrzebnego na nadrobienie zaległości.

Czy najdroższy system jest zawsze najbardziej krytyczny?

Nie. Krytyczność wynika z wpływu niedostępności na cele firmy. Tani system uwierzytelniania lub DNS może zatrzymać wiele droższych aplikacji.

Czym różni się RTO od RPO?

RTO dotyczy czasu przywrócenia działania. RPO określa dopuszczalny punkt utraty danych, czyli jak daleko wstecz firma może zostać cofnięta po odtworzeniu.

Czy backup gwarantuje wymagany czas odtworzenia?

Nie. Trzeba uwzględnić czas pobrania danych, uruchomienia systemów, zależności, weryfikacji i nadrabiania pracy. Wymaganie potwierdza dopiero test całego scenariusza.

Źródła

  1. NIST IR 8286D — Using Business Impact Analysis to Inform Risk Prioritization and Response: funkcje krytyczne, wpływ biznesowy i priorytetyzacja zasobów.
  2. Ready.gov — Business Impact Analysis Worksheet: przedziały czasu oraz wpływy operacyjne i finansowe.
  3. NIST SP 800-34 Rev. 1 — Contingency Planning Guide: MTD, RTO, RPO i planowanie odtwarzania.
  4. NIST IR 8179 — Criticality Analysis Process Model: priorytetyzacja systemów i komponentów według celów organizacji.

Materiał ma charakter ogólny. Konfigurację techniczną, retencję danych i obowiązki prawne należy ocenić w kontekście konkretnej organizacji.

Chcesz ustalić, które systemy naprawdę są krytyczne?

Możemy połączyć rozmowę o procesach z inwentaryzacją IT, backupem i realistycznym planem przywracania pracy.

Skontaktuj sięOutsourcing IT