Ночью у одного проекта внезапно «упал» сайт. Не из-за атаки и не из-за сбоя провайдера — просто закончился диск на сервере. Логи перестали писаться, база начала сбоить, а мониторинг молчал: метрика по месту на диске была отключена «за ненадобностью». 😬
Утром команда увидела классическую картину: 500-е ошибки, очередь задач забита, письма не уходят, часть данных не сохранилась. Самое неприятное — инцидент оказался не про мощность железа, а про дисциплину эксплуатации.
Вывод простой: в инфраструктуре чаще всего ломается не сложное, а забытое. Проверяйте алерты на диски, резервные копии, лимиты логов и рост очередей. И отдельно — не доверяйте серверу то, что не контролируется метриками. Хороший хостинг начинается не с тарифа, а с наблюдаемости. 🛠️
Мониторинг Сайтов
@site_monitoring_ru_n1k
Ночью у одного проекта внезапно «упал» сайт. Не из-за атаки и не из-за сбоя провайдера — просто закончился дис
Этот пост опубликован в Telegram-канале Мониторинг Сайтов. Подписаться можно по ссылке: @site_monitoring_ru_n1k.