Customer data ломается не в сборе, а на стыке ID, событий и прав доступа
Если у вас в CRM, CDP и рекламных кабинетах разные customer_id, дальше начинается зоопарк: дубли, кривой attribution и сегменты, которые нельзя активировать без ручной чистки. Базовое правило: один человек — один master ID, а все внешние ключи должны быть лишь связями.
Схема без боли обычно держится на 3 слоях:
— raw events: как пришло, без «улучшений»;
— normalized profile: почистили email, phone, country, consent;
— activation-ready: только те поля, которые можно безопасно лить в email, push, ads.
Ошибки, которые потом дорого чинить:
— хранить PII в каждом событии, а не в профиле;
— менять названия полей без версионирования;
— смешивать product events и marketing events в одном потоке;
— не фиксировать источник и timestamp на уровне события.
Для customer data важнее не «собрать всё», а заранее решить, что вы сможете удалить, склеить и переотправить. Если этого нет, reverse-ETL превращается в доставку мусора в ещё один инструмент.
Начните с карты идентификаторов и списка обязательных полей для активации. Всё остальное можно нарастить позже.
CDP & Data для D2C
@cdp_data_desk
Customer data ломается не в сборе, а на стыке ID, событий и прав доступа
Этот пост опубликован в Telegram-канале CDP & Data для D2C. Подписаться можно по ссылке: @cdp_data_desk.