Как не уронить инфраструктуру, когда трафик растёт в 5 раз за минуту
Главная ошибка — масштабировать всё подряд. При всплеске сначала режется узкое место: CPU, база, очередь, DNS, внешние API. Если нет метрик по p95 latency, RPS, error rate и saturation, вы лечите не причину, а шум.
Рабочая схема:
• CDN и кеш для статического и редко меняющегося
• autoscaling только для stateless-сервисов
• очередь для тяжёлых задач, чтобы не блокировать запросы
• read-replica для чтения, а не «ещё один большой сервер»
• лимиты на воркеры, соединения и rate limit на входе
Перед нагрузкой проверьте три вещи: лимиты в nginx/балансировщике, пул соединений к базе и время прогрева. Часто система падает не от нагрузки, а от холодного старта, когда контейнеры поднялись, а кеши и соединения ещё пустые. Стабильность — это отсутствие магии, только предсказуемая конфигурация.
После всплеска не оставляйте всё «как есть». Снимите графики, найдите пик по очередям и tail latency, зафиксируйте, где началась деградация. Потом уже увеличивайте ресурсы. Проблема не в сервере, проблема в его настройке.
Разворачиваем, проверяем, мониторим. Если у вас нет плана на пик, у вас есть план на аварию.
Настройка серверов для маркетинга
@server_setup_guide_arb
Как не уронить инфраструктуру, когда трафик растёт в 5 раз за минуту
Этот пост опубликован в Telegram-канале Настройка серверов для маркетинга. Подписаться можно по ссылке: @server_setup_guide_arb.