В чем разница между Failover (переключение при отказе) и Recovery (восстановление)?

«В чем разница между Failover (переключение при отказе) и Recovery (восстановление)?» — вопрос из категории Тестирование производительности, который задают на 10% собеседований QA Тестировщик. Ниже — развёрнутый ответ с разбором ключевых моментов.

Ответ

Failover и Recovery — это стратегии обеспечения отказоустойчивости и доступности систем, работающие на разных этапах инцидента.

Failover (Переключение при отказе)

  • Когда: Во время сбоя основной системы.
  • Цель: Автоматически и быстро переключить нагрузку на резервный (standby) компонент, чтобы минимизировать простой (downtime).
  • Фокус: Непрерывность обслуживания (Availability).
  • Пример: Кластер веб-серверов. При падении основного сервера балансировщик нагрузки перенаправляет трафик на резервный за миллисекунды.

Recovery (Восстановление)

  • Когда: После сбоя.
  • Цель: Вернуть основную систему в рабочее состояние, восстановив ее данные и функциональность. Это может быть ручной или автоматический процесс.
  • Фокус: Целостность данных и возврат к нормальной работе.
  • Пример: После сбоя базы данных администратор разворачивает ее последнюю резервную копию и применяет журналы транзакций.

Сравнительная таблица

Аспект Failover Recovery
Время Во время сбоя (реактивно) После сбоя
Цель Продолжить работу Восстановить работу
Процесс Часто автоматический Часто требует ручных операций
Результат Сервис работает на резервной системе Сервис снова работает на основной системе

Итог: Failover скрывает проблему от пользователей, а Recovery — исправляет ее.