advanced
Backups
Защищайте data через scheduled backups, retention, encryption, restore drills и recovery objectives, tied to business impact.
Резервные копии защищают от ошибок оператора, порчи данных, ransomware и региональных сбоев. Задайте RPO (сколько данных можно потерять) и RTO (как быстро нужно восстановиться). Механизмы: логические дампы, снапшоты хранилища, непрерывное архивирование (WAL/binlog) и кросс-региональная репликация — не взаимозаменяемы.
| Тип | Плюсы | Риск | |-----|-------|------| | Логический дамп | Портативность, выборочное восстановление | Медленно на огромном масштабе | | Снапшот | Быстрый захват | Crash consistency без quiesce | | PITR (WAL) | Восстановление на момент времени | Цепочка replay должна быть целой |
Restore drills доказывают, что бэкапы работают; непротестированный бэкап — самообман. Шифрование at rest и in transit; ограничьте, кто может удалять объекты бэкапа.
На интервью: RPO/RTO для платёжного сервиса vs внутренней вики; когда последний успешный restore test; immutability и off-site копии.
Типовые ошибки: бэкап без runbook восстановления; снапшоты только в том же регионе; нет политики retention; секреты в дампах; реплика вместо бэкапа.
Компромисс — стоимость хранения и операционная нагрузка против реального восстановления, когда primary уничтожен или испорчен.
Чеклист:
- Определите RPO и RTO для сервиса.
- Назовите тип: logical, snapshot, PITR.
- Планируйте и аудируйте restore drills.
- Шифруйте и tier retention (daily/weekly/monthly).
- Разделите учётные данные бэкапа и prod admin.