Один из самых дорогих уроков в инфраструктуре — не тот, где «что-то сломалось», а тот, где всё работало… до первой нагрузки.
У нас был аккуратный VPS-контур: бэкапы настроены, мониторинг зелёный, CPU в норме. Решили без лишнего драматизма перенести сервис на более быстрый диск и «чуть позже» проверить восстановление. Проблема была в этом самом «чуть позже». После обновления ядра и перезагрузки выяснилось, что бэкап-агент молча не писал архивы уже 11 дней. Зеленый мониторинг просто не умел это замечать.
В итоге восстановление заняло ночь, а причина оказалась банальной: один сервис зависел от старого пути монтирования, который после миграции изменился. Никакой магии — только привычка откладывать проверки на потом.
Вывод простой: бэкап не считается бэкапом, пока вы не сделали тестовый restore. И да, мониторинг должен сигналить не только о падении CPU, но и о тишине там, где тишины быть не должно 🔧
VPS Дайджест
@vps_digest_ru_n1k
Один из самых дорогих уроков в инфраструктуре — не тот, где «что-то сломалось», а тот, где всё работало… до пе
Этот пост опубликован в Telegram-канале VPS Дайджест. Подписаться можно по ссылке: @vps_digest_ru_n1k.