Документация по непрерывности бизнеса и аварийному восстановлению часто удовлетворяет аудиторов, но никогда не отрабатывается полностью, от начала до конца. Зависимости между приложениями остаются незадокументированными, руководства по переключению ссылаются на людей, уже покинувших компанию, а предположения о времени восстановления основаны на идеальной пропускной способности, а не на том, что реально доступно во время настоящего регионального сбоя.
Как выглядит реалистичное тестирование на самом деле
Значимый тест DR переключает реальную рабочую нагрузку на площадку восстановления и запускает её под нагрузкой, близкой к производственной, а не просто подтверждает, что скрипт выполняется без ошибок. Тестирование должно включать сценарии, которых организации предпочитают избегать: частичные сбои, деградировавшие сетевые каналы и недоступность ключевого персонала.
Целевые показатели точки и времени восстановления следует устанавливать для каждого приложения на основе влияния на бизнес, а не применять единообразно ко всему портфелю.
JIG помогает организациям строить и отрабатывать программы DR и BCP, которые выдерживают реальные условия сбоя, а не только годовую папку аудита.
