В омниканальных сервисах у ритейла есть тихая зона риска: Kafka часто выглядит как «надёжный транспорт», пока consumer не начинает повторно забирать одно и то же сообщение.
Снаружи это похоже на мелкий сбой. Внутри — уже паттерн: дубли в обработке, повторные записи в витрине, лишняя нагрузка на downstream и смазанная аналитика по событиям. Особенно если retry устроен без явной стратегии и сообщения возвращаются в поток автоматически.
Что обычно важно держать под контролем:
— идемпотентность consumer’ов;
— отдельную логику для transient-ошибок;
— мониторинг повторных доставок;
— понятные границы, где сообщение считается «не обработано», а где уже уходит в dead-letter.
Я бы смотрел на это как на карту категории: не один баг, а целая схема, где повторная обработка быстро превращается в системный эффект. И чем больше сервисов в контуре, тем дороже обходится незаметный retry. 🔎
Comp Watch
@CompWatchPro
В омниканальных сервисах у ритейла есть тихая зона риска: Kafka часто выглядит как «надёжный транспорт», пока
Этот пост опубликован в Telegram-канале Comp Watch. Подписаться можно по ссылке: @CompWatchPro.