Клоакинг палится не по одному сигналу: поисковик складывает паттерн из мелочей
Первый слой детекта — несостыковки между ботом и человеком. Если бот приходит с одной гео-матрицей, а юзер видит другой хост, другой шаблон, другой набор редиректов — это уже не маскировка, а маяк. Сюда же летят: разный DOM, пустые блоки в headless, отличающиеся title/description, а также резкие скачки по весу ответа и времени генерации.
Второй слой — поведенческий и сетевой. Поисковик любит гонять одну и ту же связку IP/ASN/User-Agent/Accept-Language через разные маршруты и сравнивать ответ. Если страница стабильно отдает «чистый» контент только части профилей, а остальным — заглушку, бан или промежуточный 302, это читается за минуту. Анализ логов не врет, в отличие от техподдержки.
Третий слой — инфраструктурные следы. Общие CDN-ноды, шаблонные куки, одинаковые TTL, неестественные цепочки 301/302, слишком аккуратные правила по рефереру и реюзу IP-пула. Отдельно палятся схемы, где ботам дают один HTML, а людям — другой, но оба варианта живут на одном и том же пути без нормальной сегментации по кешу и логике.
Рабочий чек-лист простой: сравнивай ответы по заголовкам, DOM, редиректам, задержке и кодам в разных профилях; не держи «чистую» и «грязную» ветку на одном и том же поведенческом паттерне; не делай фильтр слишком бинарным. Чем больше различий между ботом и человеком, тем легче поисковику собрать полную картину.
SERP-клоакинг
@serp_cloak_zone_ubt
Клоакинг палится не по одному сигналу: поисковик складывает паттерн из мелочей
Этот пост опубликован в Telegram-канале SERP-клоакинг. Подписаться можно по ссылке: @serp_cloak_zone_ubt.