Semantic similarity на лендингах: как платформы видят «разные» страницы как одну
Платформы давно не смотрят на лендинг только как на набор слов. Для антифрода важны смысловые отпечатки: текст, структура блоков, порядок тезисов, изображения, повторы CTA и даже то, как страница «собрана» из типовых секций.
Чаще всего срабатывают три слоя сравнения:
— текстовые эмбеддинги: одинаковые обещания, FAQ и заголовки
— OCR по картинкам: скриншоты, баннеры, псевдоотзывы, текст в макетах
— визуальные fingerprint'ы: похожая сетка, одинаковые hero-блоки, кнопки и формы
Если две страницы отличаются только словами, но несут один и тот же смысл и тот же сценарий убеждения, система часто сводит их в один кластер. Отдельно палятся шаблонные элементы: «до/после», fake reviews, копии блоков с гарантией, повторяющиеся дисклеймеры и одинаковые последовательности секций.
Для арбитража это означает простую вещь: замена нескольких фраз не делает преленд новым. Чем больше совпадает логика подачи, визуальная композиция и текстовые паттерны, тем выше шанс, что модерация увидит не уникальные страницы, а пачку клонов.
Если лендинг выглядит как новая обёртка для старой истории, для платформы это всё ещё тот же креативный объект.
Creative Antifraud — AI-детекция креативов
@creative_antifraud
Semantic similarity на лендингах: как платформы видят «разные» страницы как одну
Этот пост опубликован в Telegram-канале Creative Antifraud — AI-детекция креативов. Подписаться можно по ссылке: @creative_antifraud.