Snapshot, backup и replica решают разные задачи. Production-политика должна указывать не только расписание, но и место хранения, retention и проверенный способ восстановления.

Текущее состояние PVE

rpool — mirror из двух SanDisk Extreme 1 TB NVMe; на момент проверки pool ONLINE, read/write/checksum errors отсутствуют. Это защищает от отказа одного диска, но не от потери node, ошибочного удаления или повреждения на уровне приложения.
В PVE нет настроенных backup jobs и replication jobs. Сейчас ни одна VM не имеет подтверждённого автоматического Proxmox backup. Это приоритетный инфраструктурный риск.

Классы данных

Базовая политика

Это стартовые ориентиры. Итоговые RPO/RTO определяются владельцем сервиса.

Правило 3-2-1

Backup на том же физическом диске не защищает от отказа диска. Snapshot на том же pool не защищает от потери pool. Синхронизация повреждённых данных тоже не является резервной копией.

Перед изменением

  1. Определите данные, которые изменятся.
  2. Создайте application-consistent backup.
  3. Проверьте, что job завершился без warning.
  4. Запишите restore point и срок хранения.
  5. Для БД проверьте читаемость dump, а не только размер файла.
  6. Выполняйте изменение только после этого.

Тест восстановления

1

Выберите контрольную копию

Используйте обычный backup, не специально подготовленный.
2

Восстановите изолированно

Другой VMID, VLAN без production ingress и отдельное имя.
3

Проверьте приложение

Schema, файлы, авторизация и выборочные данные.
4

Измерьте время

Фактический RTO сравнивается с заявленным.
5

Удалите recovery guest

После отчёта и только если данные больше не нужны.

Что нужно заполнить после PVE-инвентаризации

  • storage ID и тип каждого pool;
  • на каких node он доступен;
  • какие guests и volumes на нём находятся;
  • backup server/repository;
  • encryption и владельцы recovery keys;
  • расписания, retention, последняя успешная проверка restore;
  • пороги свободного места и канал уведомления.