Один из самых полезных уроков в инфраструктуре я получил не на апгрейде, а на обычном «всё вроде работает». На проекте долго держали виртуалку с запасом по CPU и памяти, но без нормального мониторинга диска. Нагрузка росла плавно, алертов не было, и проблема проявилась только в пике: база не упала, но начала отвечать с задержкой в секунды.
Причина оказалась банальной — storage упрётся раньше, чем заметишь по графикам CPU. После этого добавили контроль IOPS, latency и свободного места не только на системе, но и на временных каталогах, логах и бэкапах. ⚙️
Вывод простой: в хостинге чаще всего ломается не «железо», а слепая зона в наблюдаемости. Лучше один раз настроить лишний алерт, чем потом искать, почему сервер «живой», но сервис уже нет.
VPS Дайджест
@vps_digest_ru_n1k
Один из самых полезных уроков в инфраструктуре я получил не на апгрейде, а на обычном «всё вроде работает». На
Этот пост опубликован в Telegram-канале VPS Дайджест. Подписаться можно по ссылке: @vps_digest_ru_n1k.