Wiele organizacji zakłada, że skoro ich serwery stoją w profesjonalnej serwerowni, są automatycznie bezpieczne przed przestojem. W praktyce pojedyncza lokalizacja – niezależnie od tego, jak dobrze zabezpieczona – pozostaje pojedynczym punktem awarii (single point of failure). Przerwa w dostawie prądu, awaria klimatyzacji, uszkodzenie łącza operatora czy zwykły błąd ludzki podczas prac serwisowych mogą wyłączyć kluczowe systemy na godziny, a czasem i dni.
Czym różnią się poziomy dostępności. Standard Uptime Institute definiuje cztery poziomy (Tier I-IV) opisujące odporność infrastruktury na awarie. Tier III zakłada redundancję kluczowych komponentów z możliwością prac serwisowych bez przestoju, natomiast Tier IV dodaje pełną odporność na pojedynczą awarię dowolnego elementu – w tym równolegle, niezależnie zasilane ścieżki dystrybucji energii i chłodzenia. W praktyce różnica między tymi poziomami przekłada się bezpośrednio na deklarowaną dostępność roczną – od 99,982% dla Tier III do 99,995% dla Tier IV.
Replikacja synchroniczna vs asynchroniczna. Dla systemów krytycznych (bazy danych transakcyjnych, poczta, systemy finansowo-księgowe) kluczowy jest wybór modelu replikacji danych między lokalizacjami. Replikacja synchroniczna gwarantuje zerową utratę danych (RPO=0), ale wymaga niskich opóźnień między ośrodkami i zwykle większych nakładów na łącza. Replikacja asynchroniczna jest tańsza i działa na większe odległości, ale wiąże się z ryzykiem utraty kilku minut danych w skrajnym scenariuszu awarii.
Realne koszty własne. Budowa środowiska HA to zawsze kompromis między kosztem a poziomem ryzyka akceptowalnym dla organizacji – nie każdy system wymaga Tier IV. W Intalio zaczynamy każdy projekt od klasyfikacji systemów według ich krytyczności biznesowej i dopiero na tej podstawie projektujemy architekturę – tak, by inwestycja w redundancję była proporcjonalna do rzeczywistego ryzyka, a nie wynikała z założenia 'im więcej, tym lepiej’.
Realizujemy projekty w dużych, złożonych środowiskach IT również dla instytucji sektora publicznego, gdzie wymagania dostępności są szczególnie wysokie – i to właśnie tam nauczyliśmy się, że najdroższa awaria to zawsze ta, której nikt nie przewidział na etapie projektowania.
