Год ежедневных бэкапов, а восстановить базу не получилось ни из одного
Cron каждую ночь запускает скрипт с pg_dump и копирует файл в S3. Скрипт всегда завершался с кодом 0, алертов не было. После сбоя диска выяснилось, что последние восемь месяцев файлы весят по 20 байт: после смены пароля pg_dump падал, а ошибка терялась в конвейере с gzip.
Какая практика поймала бы это в первую же неделю?
- Регулярное автоматическое восстановление из бэкапа
- Хранение копий бэкапов в двух разных облаках
- Запуск бэкапа дважды в сутки вместо одного
- Шифрование файлов бэкапа перед загрузкой
