95% проблем с доступностью сайта начинаются не с «падения сервера», а с мелочей: переполненного диска, всплеска 5xx или слишком долгого ответа DNS.
Что стоит держать на панели каждый день:
— p95/p99 latency, а не только среднее;
— долю 4xx и 5xx;
— загрузку CPU, RAM и swap;
— I/O wait и очереди диска;
— свободное место на разделе с логами и БД.
Полезный ориентир: если p95 ответа вырос на 30–40% за сутки, пользователи уже чувствуют деградацию, даже если сервер «зелёный». А когда диск забит на 85–90%, инцидент часто вопрос времени, а не вероятности.
Хорошая инфраструктура — это не просто «быстро», а предсказуемо. Метрики нужны не для отчёта, а чтобы ловить проблему до того, как её увидят клиенты.
SSL и HTTPS
@ssl_https_pro_n1k
95% проблем с доступностью сайта начинаются не с «падения сервера», а с мелочей: переполненного диска, всплеск
Этот пост опубликован в Telegram-канале SSL и HTTPS. Подписаться можно по ссылке: @ssl_https_pro_n1k.