advanced

Backups

Защищайте data через scheduled backups, retention, encryption, restore drills и recovery objectives, tied to business impact.

Резервные копии защищают от ошибок оператора, порчи данных, ransomware и региональных сбоев. Задайте RPO (сколько данных можно потерять) и RTO (как быстро нужно восстановиться). Механизмы: логические дампы, снапшоты хранилища, непрерывное архивирование (WAL/binlog) и кросс-региональная репликация — не взаимозаменяемы.

| Тип | Плюсы | Риск | |-----|-------|------| | Логический дамп | Портативность, выборочное восстановление | Медленно на огромном масштабе | | Снапшот | Быстрый захват | Crash consistency без quiesce | | PITR (WAL) | Восстановление на момент времени | Цепочка replay должна быть целой |

Restore drills доказывают, что бэкапы работают; непротестированный бэкап — самообман. Шифрование at rest и in transit; ограничьте, кто может удалять объекты бэкапа.

На интервью: RPO/RTO для платёжного сервиса vs внутренней вики; когда последний успешный restore test; immutability и off-site копии.

Типовые ошибки: бэкап без runbook восстановления; снапшоты только в том же регионе; нет политики retention; секреты в дампах; реплика вместо бэкапа.

Компромисс — стоимость хранения и операционная нагрузка против реального восстановления, когда primary уничтожен или испорчен.

Чеклист:

  • Определите RPO и RTO для сервиса.
  • Назовите тип: logical, snapshot, PITR.
  • Планируйте и аудируйте restore drills.
  • Шифруйте и tier retention (daily/weekly/monthly).
  • Разделите учётные данные бэкапа и prod admin.