Semantic similarity на лендингах: почему платформы видят «разные» страницы как один шаблон
Semantic similarity — это не про одинаковый код, а про одинаковый смысл. Платформы сравнивают заголовки, офферы, структуру блоков, повторяющиеся формулировки, порядок секций и даже связки «обещание → доказательство → CTA». Если страницы выглядят по-разному, но несут один и тот же сценарий, их часто склеивают в один риск-паттерн.
Чаще всего срабатывает такой набор сигналов:
• повторяющийся hero-блок с тем же обещанием;
• одинаковые отзывы, FAQ и дисклеймеры;
• близкие по смыслу заголовки и подзаголовки;
• схожая логика редиректов и переходов между страницами;
• одинаковые смысловые роли картинок, даже если сами изображения разные.
Для детекта используют текстовые embeddings, OCR по скриншотам, сравнение DOM-структуры и image fingerprinting. Поэтому замена слов без смены смысла помогает слабо: если на уровне семантики у лендингов один каркас, система увидит это как клон-сетку. Особенно быстро палятся пачки страниц, где меняют только домен, цвет кнопки и несколько строк текста.
Чтобы снизить риск склейки, важно не «переписывать», а реально менять информационную архитектуру: разные сценарии подачи, другой порядок смысловых блоков, иные доказательства, разная визуальная логика. Если ленд можно пересказать одной и той же аннотацией, для антифрода он уже почти дубль.
Итог простой: платформы ловят не копию HTML, а повтор смысла. Чем одинаковее сценарий страницы, тем выше шанс, что ее поставят в одну группу с уже проблемными креативами.
Creative Antifraud — AI-детекция креативов
@creative_antifraud
Semantic similarity на лендингах: почему платформы видят «разные» страницы как один шаблон
Этот пост опубликован в Telegram-канале Creative Antifraud — AI-детекция креативов. Подписаться можно по ссылке: @creative_antifraud.