Мониторинг сервера без алертов в Telegram — это уже не мониторинг, а иллюзия
Если сервер лежит, а вы узнаёте об этом из жалобы клиента, значит проверка была только для галочки. Базовая схема простая: uptime-check по HTTP/TCP, системные метрики по CPU/RAM/disk, и отдельный канал для критических событий в Telegram.
Не шлите в чат всё подряд. Фильтруйте:
• критично — недоступен сервис, диск > 90%, нет места под логи, упал бэкап
• важно — рост latency, ошибки 5xx, скачок load average
• шум — краткие флуктуации, которые проходят за минуту
Для Telegram используйте отдельного бота и отдельный чат под инфраструктуру. Токен храните в переменных окружения, доступ к боту ограничьте, на сервере закройте лишние порты, SSH — только по ключам. Алерт должен содержать не «что-то сломалось», а конкретику: хост, метрика, порог, время, ссылка на график или лог.
Проверяйте, что алерт приходит не только при падении, но и при восстановлении. Иначе вы видите только половину картины.
Стабильность — это отсутствие магии, только предсказуемая конфигурация.
Настройка серверов для маркетинга
@server_setup_guide_arb
Мониторинг сервера без алертов в Telegram — это уже не мониторинг, а иллюзия
Этот пост опубликован в Telegram-канале Настройка серверов для маркетинга. Подписаться можно по ссылке: @server_setup_guide_arb.