Sitemap показывает поисковику важные URL, а robots.txt решает, куда бот вообще пойдёт
Sitemap — это список адресов, которые вы хотите предложить поисковику для обхода и индексации. Это подсказка, а не приказ: наличие URL в файле не гарантирует его индексацию. Добавляйте туда только канонические страницы с ответом 200, которые доступны пользователю и не закрыты от индексации.
robots.txt управляет доступом робота к разделам сайта. Через него обычно закрывают служебные URL, внутренний поиск, параметры сортировки и технические каталоги. Но запрет обхода не равен удалению страницы из индекса: если на закрытый адрес ведут внешние ссылки, он может появиться в результатах без содержимого.
Проверьте типовые конфликты:
— URL есть в sitemap, но запрещён в robots.txt;
— в sitemap попадают редиректы, ошибки 404 или страницы с noindex;
— важный раздел закрыт слишком широким правилом Disallow;
— robots.txt недоступен, отдаёт ошибку или содержит неверный путь;
— карта сайта не указана в robots.txt и не отправлена через инструменты поисковика.
Рабочая схема простая: сначала составьте список ценных страниц, затем уберите дубли и технические URL, проверьте доступность обхода и только после этого добавьте адреса в sitemap. После изменений тестируйте правила на конкретных URL, а не доверяйте файлу визуально.
Sitemap помогает найти нужное, robots.txt экономит обход. Эффект появляется только тогда, когда оба файла описывают одну и ту же логичную структуру сайта.
—
Соседний канал в сети: @kustov_seo_local
Кустов и технический SEO
@kustov_seo_technical
Sitemap показывает поисковику важные URL, а robots.txt решает, куда бот вообще пойдёт
Этот пост опубликован в Telegram-канале Кустов и технический SEO. Подписаться можно по ссылке: @kustov_seo_technical.