Краулинг сайта — что это такое

Краулинг — процесс, в котором поисковый робот обнаруживает URL и загружает страницы сайта для дальнейшей обработки.

Обновлено 28 августа 2026 г.Автор: Александр Алашеев

Определение

Краулинг — автоматический обход URL поисковым роботом, во время которого он обнаруживает и загружает страницы и другие доступные ресурсы сайта.

Термин
Краулинг
Полное название
Crawling — сканирование страниц поисковым роботом
Раздел
SEO и поисковые системы
Также ищут
сканирование сайта, обход сайта, crawling

Что означает Краулинг простыми словами

Роботы находят адреса по ссылкам, файлу sitemap.xml и другим источникам. Возможность сканирования ещё не означает, что URL будет проиндексирован и показан в результатах поиска.

Если полезная страница недоступна роботу или остаётся без внутренних ссылок, поисковая система может поздно обнаружить её или не получить нужное содержимое.

Пример

Новая страница термина появляется в HTML-карте сайта, XML sitemap и ссылках из других определений. Это создаёт несколько понятных путей для её обнаружения роботом.

Как применять на практике

  1. Проверьте коды ответа, robots.txt и доступность основного HTML без обязательного JavaScript.
  2. Свяжите важные страницы обычными HTML-ссылками.
  3. Добавляйте канонические индексируемые URL в sitemap.xml.

Частые ошибки

  • Считать наличие URL в sitemap гарантией индексации.
  • Закрывать в robots.txt ресурсы, необходимые для понимания страницы.
  • Оставлять важные страницы сиротами без внутренних ссылок.

Источники и документация

Вопросы о Краулинг

Чем краулинг отличается от индексации?

При краулинге робот обнаруживает и загружает страницу. При индексации поисковая система анализирует её и решает, хранить ли документ в поисковом индексе.

Как ускорить обнаружение новой страницы?

Добавьте на неё ссылки с доступных страниц, включите канонический URL в sitemap.xml и убедитесь, что сервер отвечает корректно. Это помогает обнаружению, но не гарантирует индексацию.