Customer data ломается не в CDP, а на первом кривом event schema
Если у вас в событиях нет единых названий, типов и обязательных полей — дальше начинается мусорная активация. Один и тот же пользователь превращается в три профиля, а downstream-команды спорят не о сегментах, а о том, какое поле считать правдой.
Базовый набор для customer data:
— стабильный user_id и anon_id;
— event_name без самодеятельности;
— timestamp в одном формате;
— source, platform, currency, order_id там, где это нужно.
Если этого нет, identity resolution начинает склеивать шум, а не людей.
Отдельная боль — свойства событий. Не тащите всё подряд: PII в трекинг, свободный текст вместо кодов, разные названия одного и того же свойства в web и app. Лучше 20 полей, которые реально используются в сегментации и триггерах, чем 120, из которых половина пустая.
Проверка перед запуском простая: каждое событие должно отвечать на вопрос «кто, что, когда, откуда и в каком контексте». Если хотя бы один ответ плавает, сначала чините схему, потом строите CDP и reverse-ETL. Иначе вы автоматизируете хаос, а не customer data.
CDP & Data для D2C
@cdp_data_desk
Customer data ломается не в CDP, а на первом кривом event schema
Этот пост опубликован в Telegram-канале CDP & Data для D2C. Подписаться можно по ссылке: @cdp_data_desk.