Однажды крупный сайт лег не из-за железа и не из-за DDoS. Причина была банальнее: при миграции забыли проверить TTL у DNS-записи. Старый IP продолжал жить в кэше у части провайдеров, а новый сервер уже принимал трафик. В итоге половина пользователей попадала на пустоту, остальные — на работающий сайт. Паника началась быстро: техподдержка искала проблему в коде, DevOps — в балансировщике, а виноват оказался один параметр, который обычно считают «мелочью» 🙂
Вывод простой: в инфраструктуре нет мелочей. Перед любым переездом стоит проверять DNS, TTL, логи, время жизни кэшей и план отката. Самые дорогие простои часто рождаются не в ядре системы, а на стыке процессов, где все уверены, что «это и так понятно». 🔧
SMTP Серверы
@smtp_servers_ru_n1k
Однажды крупный сайт лег не из-за железа и не из-за DDoS. Причина была банальнее: при миграции забыли проверит
Этот пост опубликован в Telegram-канале SMTP Серверы. Подписаться можно по ссылке: @smtp_servers_ru_n1k.