Как собирать кастомные футпринты, чтобы вытаскивать новые движки без мусора
Базовый футпринт — это не магия, а грубый фильтр. Если он слишком широкий, в выдаче тонут CMS, форумы и мёртвые каталоги. Если слишком узкий — режешь себе пул. Рабочая схема простая: берёшь сигнатуры движка, шаблоны ошибок, служебные пути, следы админки и куски HTML, которые редко меняют.
Собирай ядро из 4 слоёв: • title/meta-паттерны • характерные URL-кусочки • уникальные строки в коде • следы файлов/папок. Потом комбинируй их через OR/AND и сразу тестим пробив на объемах. Один футпринт не должен жить отдельно: ему нужен запасной и третий, чтобы обойти дубли и футпринты-клоны.
Чистим листы до блеска так: убираем очевидные бренды, режем шумные слова вроде «home», «welcome», «news», и прогоняем вариант без спецсимволов. Для поиска новых движков полезно строить пару наборов: один на админку, второй на фронт, третий на ошибки. Так ты ловишь не только сам движок, но и его обвязку. Срезаем косты на капчу за счёт точности, а не объёма.
Финальный тест всегда один: если футпринт даёт много повторов и мало новых доменов, он мёртв. Если выдаёт разные шаблоны и держит LPM, его можно ставить в Tier-пирамиду и масштабировать.
GSA: подземка
@gsa_underground_ubt
Как собирать кастомные футпринты, чтобы вытаскивать новые движки без мусора
Этот пост опубликован в Telegram-канале GSA: подземка. Подписаться можно по ссылке: @gsa_underground_ubt.