7 проверок в сетевом администрировании, которые спасают от «магии» в проде
Сеть редко ломается «сама». Обычно где-то уже есть лишний хоп, кривой маршрут или неучтенный ACL. Поэтому базовый чек-лист должен быть коротким и повторяемым:
— адресация и маски на всех узлах;
— шлюз по умолчанию и статические маршруты;
— DNS-резолвинг и порядок серверов;
— MTU/MSS, если есть VPN или туннели.
Дальше смотрим L2: VLAN tagging, trunk/access-порты, STP и MAC-таблицы. Половина странных инцидентов начинается с того, что кабель «вроде воткнут», а порт живет не в том VLAN. Код работает, но есть нюансы: сеть тоже любит порядок именования и документирование.
На L3 проверяем NAT, фильтрацию, асимметричный маршрут и stateful-сессии. Если трафик идет в одну сторону, а ответ теряется, не спешите винить приложение. Сначала трассировка, потом tcpdump, потом уже разговоры про «нестабильность». Мониторинг должен быть проактивным, а не реактивным.
Если чек-лист один раз формализован, инциденты начинают выглядеть не как хаос, а как набор типовых ошибок. Автоматизация — это не опция, а необходимость: собирайте конфигурации, сравнивайте их с эталоном и фиксируйте отклонения до того, как они станут простоями.
Трекер: конфиги
@tracker_configs_arb
7 проверок в сетевом администрировании, которые спасают от «магии» в проде
Этот пост опубликован в Telegram-канале Трекер: конфиги. Подписаться можно по ссылке: @tracker_configs_arb.