Kubernetes ломается не от магии, а от мелких решений в манифестах
Контейнеризация дает изоляцию, но в оркестрации ошибки быстро становятся системными. Чаще всего проблемы начинаются не в кластере, а в конфигурации: один неверный request, лишний privileged, забытый liveness probe — и код работает, но есть нюансы.
Проверьте базу:
— ресурсы: requests и limits должны соответствовать реальной нагрузке;
— probes: readiness отвечает за трафик, liveness — за перезапуск, не смешивайте их;
— политики: минимальные права для ServiceAccount и отсутствие лишних volume mount;
— сеть: ingress, NetworkPolicy и DNS должны быть предсказуемыми, а не «по умолчанию».
Отдельно смотрите на rollout-стратегию и отказоустойчивость. Если приложение не умеет переживать рестарт pod, evict по узлу или краткую потерю зависимости, Kubernetes это не исправит. Он честно покажет проблему быстрее, чем продакшен успеет придумать оправдание.
Автоматизация — это не опция, а необходимость. Валидируйте манифесты, прогоняйте dry-run, храните конфиги в Git и собирайте шаблоны так, чтобы одинаковые сервисы не отличались случайной запятой.
Держите кластер простым: чем меньше исключений в конфиге, тем меньше сюрпризов в инциденте.
Трекер: конфиги
@tracker_configs_arb
Kubernetes ломается не от магии, а от мелких решений в манифестах
Этот пост опубликован в Telegram-канале Трекер: конфиги. Подписаться можно по ссылке: @tracker_configs_arb.