Хорошее правило из серверной практики: если что-то начинает «чуть-чуть тормозить» — это уже не мелочь, а ранний сигнал.
На хостинге и в инфраструктуре почти никогда не ломается всё сразу. Сначала растёт latency, потом появляются редкие таймауты, потом очередь запросов, и только после этого система падает заметно для всех. Поэтому полезно смотреть не только на аптайм, но и на метрики до аварии: p95/p99, error rate, saturation CPU, I/O wait, очереди в Nginx и нагрузку на БД. 📈
Ещё одно практическое правило: если проблему можно воспроизвести один раз — её уже можно считать инцидентом. Не откладывайте разбор «до вечера». На сервере вечер обычно начинается раньше, чем ожидаешь. ⚙️
Nginx Советы
@nginx_sovety_ru_n1k
Хорошее правило из серверной практики: если что-то начинает «чуть-чуть тормозить» — это уже не мелочь, а ранни
Этот пост опубликован в Telegram-канале Nginx Советы. Подписаться можно по ссылке: @nginx_sovety_ru_n1k.