Ответ
Failover и Recovery — это стратегии обеспечения отказоустойчивости и доступности систем, работающие на разных этапах инцидента.
Failover (Переключение при отказе)
- Когда: Во время сбоя основной системы.
- Цель: Автоматически и быстро переключить нагрузку на резервный (standby) компонент, чтобы минимизировать простой (downtime).
- Фокус: Непрерывность обслуживания (Availability).
- Пример: Кластер веб-серверов. При падении основного сервера балансировщик нагрузки перенаправляет трафик на резервный за миллисекунды.
Recovery (Восстановление)
- Когда: После сбоя.
- Цель: Вернуть основную систему в рабочее состояние, восстановив ее данные и функциональность. Это может быть ручной или автоматический процесс.
- Фокус: Целостность данных и возврат к нормальной работе.
- Пример: После сбоя базы данных администратор разворачивает ее последнюю резервную копию и применяет журналы транзакций.
Сравнительная таблица
| Аспект | Failover | Recovery |
|---|---|---|
| Время | Во время сбоя (реактивно) | После сбоя |
| Цель | Продолжить работу | Восстановить работу |
| Процесс | Часто автоматический | Часто требует ручных операций |
| Результат | Сервис работает на резервной системе | Сервис снова работает на основной системе |
Итог: Failover скрывает проблему от пользователей, а Recovery — исправляет ее.