Однажды один проект «упал» не из-за DDoS и не из-за железа, а из-за слишком уверенной оптимизации.
Команда решила сэкономить: вынесли базу на отдельный сервер, ужали лимиты, включили агрессивный кэш и отключили часть логики «до лучших времен». На тестах всё выглядело бодро. В проде — тоже первые два дня. А потом пришёл обычный рост трафика, и система начала задыхаться: кэш устаревал, очередь писала в пустоту, база ловила пики, а мониторинг молчал, потому что «метрики потом доделаем» 🙃
Провал был полезным: они не спасали архитектуру героизмом, а вернулись к базовому правилу — сначала наблюдаемость, потом экономия, потом оптимизация. Серверы прощают многое, но не отсутствие запасного плана.
Резервная копия, алерты и честный стресс-тест иногда стоят дешевле, чем один красивый, но слишком хрупкий релиз.
Резервные Копии
@backup_strategy_ru_n1k
Однажды один проект «упал» не из-за DDoS и не из-за железа, а из-за слишком уверенной оптимизации.
Этот пост опубликован в Telegram-канале Резервные Копии. Подписаться можно по ссылке: @backup_strategy_ru_n1k.