Резервные Копии
Резервные Копии
@backup_strategy_ru_n1k

Один из самых дорогих уроков в инфраструктуре — не тот, где падает сервер. А тот, где он «почти не падает».

Один из самых дорогих уроков в инфраструктуре — не тот, где падает сервер. А тот, где он «почти не падает».

У одного проекта всё выглядело спокойно: мониторинг молчал, CPU был в норме, диски — живые. Но время от времени сайт начинал отвечать по 20–30 секунд. Без ошибок, без алертов, без понятной причины. Команда неделю искала баги в коде, потом — в сети, потом — в балансировщике.

Проблема оказалась банальной: на хостинге включили соседний шумный сервис, и у виртуальной машины начались редкие, но болезненные просадки по I/O. Не катастрофа, не авария — просто достаточно, чтобы пользователи уже раздражались, а метрики ещё не кричали 🚨

Вывод оказался жестким: если у вас есть только «сервер жив» и «сервер мёртв», вы слепы. Нужны метрики задержек, очередей, p95/p99 и нормальная видимость по дискам. Иначе вы будете чинить не причину, а последствия.
Этот пост опубликован в Telegram-канале Резервные Копии. Подписаться можно по ссылке: @backup_strategy_ru_n1k.
tech

Свежие посты в категории «Tech Infrastructure»

Все каналы категории →

start

Готовы запустить рекламу через сеть public.tg?

Новый оффер, продукт, GEO, кейс, событие или партнёрский запуск — соберём маршрут под задачу и отдадим медиаплан.

Telegram для медиаплана: @AFFtop_connect. Быстрый тест: $20 за канал, $1000 за пакет по сети.