Однажды мы ловили странный лаг на сайте: по метрикам сервер был «живой», CPU в норме, а страницы открывались как через туман. Первая мысль — база, потом CDN, потом кеш. Но виновником оказался совсем не тот слой, на который смотрят первым.
Проблема была в диске: место еще оставалось, а вот IOPS уже уперлись в потолок. В пике ночных бэкапов и обновлений CMS соседние процессы начинали конкурировать за ввод-вывод, и веб-сервер просто ждал очередь. Внешне это выглядело как «сервер тупит», хотя по факту он задыхался от инфраструктурной мелочи.
Что вынесли из кейса: метрики по CPU и RAM — это только половина картины. Для хостинга и серверов критично смотреть на I/O, latency, нагрузку по диску и окна фоновых задач. Иногда один перенесенный бэкап или смена типа хранилища дают больший эффект, чем апгрейд процессора. ⚙️
С тех пор любое «тормозит» мы начинаем не с догадок, а с поиска узкого места по слоям.
DevOps Маркетолога
@devops_marketologa_n1k
Однажды мы ловили странный лаг на сайте: по метрикам сервер был «живой», CPU в норме, а страницы открывались к
Этот пост опубликован в Telegram-канале DevOps Маркетолога. Подписаться можно по ссылке: @devops_marketologa_n1k.