Один из самых дорогих уроков в инфраструктуре — это когда «вроде бы всё работает» заканчивается простоями ночью.
Одна команда подняла новый сервер под проект, проверила SSH, веб-сервер, базу, даже мониторинг. Не проверили только мелочь: диск был почти забит логами, а на сервере стоял слишком агрессивный ротационный сценарий. В день пикового трафика лог-файлы раздулись, место кончилось, база не смогла писать временные файлы, а приложение стало отвечать ошибками. ⚠️
Самое неприятное — алерты молчали. Метрика по свободному месту была, но порог поставили слишком низко: 5% на SSD, который забивается резко, это не запас, а приглашение к инциденту.
Вывод простой: в инфраструктуре проваливаются не «сложные» вещи, а те, что считают второстепенными. Место на диске, лимиты, ротация логов, тест восстановления и нормальные пороги мониторинга — это не опции, а базовая страховка.
SSL и HTTPS
@ssl_https_pro_n1k
Один из самых дорогих уроков в инфраструктуре — это когда «вроде бы всё работает» заканчивается простоями ночь
Этот пост опубликован в Telegram-канале SSL и HTTPS. Подписаться можно по ссылке: @ssl_https_pro_n1k.