Screaming Frog: полный обзор и инструкция

Как установить и настроить Screaming Frog SEO Spider, просканировать сайт, проверить статусы, canonical, JavaScript, sitemap и экспортировать задачи.

Screaming Frog: полный обзор и инструкция

Screaming Frog SEO Spider — настольный краулер для Windows, macOS и Linux. Он проходит по ссылкам сайта, собирает HTTP-ответы, метаданные, директивы, canonical, hreflang, изображения и другие признаки. Бесплатная версия ограничивает один обход 500 URL, лицензия снимает этот лимит и открывает расширенные функции.

Установка и бесплатная версия

Скачивайте программу с официального сайта Screaming Frog и выбирайте сборку своей ОС. Бесплатный режим подходит для небольшого сайта и обучения: до 500 URL в одном crawl. Это число включает не только HTML-страницы, но и другие найденные ресурсы в зависимости от настроек, поэтому лимит может закончиться раньше ожидаемого.

Платная лицензия открывает обход сверх 500 URL в пределах ресурсов компьютера, JavaScript rendering, сохранение и планирование, custom extraction, интеграции и другие функции. Точный состав и цену проверяйте перед покупкой: версии программы регулярно обновляются.

РежимПодходит дляОграничение
FreeОбучение и сайт до 500 ресурсовЛимит URL и закрытые функции
LicensedРегулярный профессиональный аудитРесурсы компьютера и годовая лицензия
Text OnlyОбычный HTML и быстрый обходНе исполняет клиентский JS
JavaScriptSPA и ссылки после рендерингаМедленнее и требовательнее

Настройка перед первым обходом

Введите главную страницу только после настройки. В Configuration → Spider определите типы ресурсов, следование robots.txt, canonical и nofollow. Ограничьте скорость, чтобы не перегрузить сервер. Для теста чужого сайта используйте осторожную частоту и разрешение владельца; краулер создаёт реальную нагрузку.

Исключите бесконечные параметры, календарь, фасеты и сессионные URL. Если нужна одна папка, используйте Include или стартуйте из списка. Выберите User-Agent осознанно: эмуляция Googlebot полезна для сравнения ответов, но результаты всё равно принадлежат вашему IP и настройкам.

  1. Создать отдельную конфигурацию проекта.
  2. Задать User-Agent и скорость.
  3. Определить типы ресурсов и robots.
  4. Добавить include/exclude для параметров.
  5. Выбрать Text Only или JavaScript.
  6. Проверить пять URL вручную.
  7. Запустить crawl и наблюдать ошибки сервера.
Настройка Screaming Frog
Область и режим задаются до запуска большого crawl

Как читать основные вкладки

Internal содержит найденные внутренние ресурсы и сводные поля. Response Codes группирует 2xx, 3xx, 4xx и 5xx. Page Titles, Meta Description, H1 и H2 показывают отсутствие, повторы и длину. Canonicals и Directives помогают понять indexability, но каждое предупреждение нужно сверить с назначением страницы.

Используйте нижнюю панель Inlinks и Outlinks: она показывает, откуда найден URL и куда ведут ссылки. Так ошибка превращается в исправление шаблона. Например, 404 с сотней inlinks требует заменить источник, а не только вернуть заглушку на сломанном адресе.

  • Response Codes — ошибки и редиректы.
  • URL / Internal — инвентарь и тип ресурса.
  • Indexability — итог директив и статуса.
  • Canonicals — заявленная и выбранная связь.
  • Inlinks — источник обнаружения URL.
  • Images — размер, alt и связь со страницей.
  • Hreflang / Structured Data — специальные реализации.

JavaScript rendering

В Configuration → Spider → Rendering можно переключиться на JavaScript. Встроенный Chromium выполняет клиентский код и анализирует rendered HTML. Режим нужен, если ссылки или основной контент появляются только после JavaScript, но не должен включаться автоматически для любого React-сайта: серверный HTML может уже содержать всё нужное.

Сравните два crawl одной выборки — Text Only и JavaScript. Разница покажет, что добавляет рендеринг, какие ресурсы блокируются и не создаёт ли приложение новые URL. Установите окно, таймаут и ограничения, следите за памятью. Данные чувствительных страниц не отправляйте в сторонние AI API через custom JavaScript без разрешения.

Порядок чтения отчёта
Сначала доступность и индексируемость, затем элементы страницы

Интеграции, списки и извлечение данных

Licensed-режим соединяется с Google Analytics, Search Console и PageSpeed Insights, чтобы добавить к URL трафик, запросы и скорость. Эти данные имеют собственные периоды и ограничения; строка crawl не превращает их в одну дату автоматически. Записывайте настройки экспорта.

List Mode сканирует заданный перечень, полезный для миграции и проверки sitemap. Custom Extraction извлекает поля по XPath, CSSPath или regex: цену, артикул, Open Graph, дату и любые элементы. Сначала протестируйте правило на нескольких HTML-вариантах, иначе пустая колонка может означать неверный selector.

Mode → List → Upload → Paste / From a File

Пример задач после crawl:
404 + Inlinks > 0 → исправить ссылки в шаблоне
Non-indexable URL in sitemap → удалить из карты или исправить страницу
Canonical chain → сократить до конечного URL
HTML и JavaScript crawl
Два режима отвечают на разные вопросы о странице

Sitemap, визуализация и экспорт

Программа умеет создавать XML Sitemap из результатов обхода. Перед сохранением оставьте только канонические индексируемые URL с 200 и корректным lastmod. Priority и changefreq Google игнорирует, поэтому не заполняйте их как магические коэффициенты. Готовую карту проверьте через валидатор sitemap.

Визуализации crawl tree и directory tree помогают увидеть глубину и ветви параметров. Для задач используйте Bulk Export и Reports, затем добавьте колонки «шаблон», «ущерб», «владелец» и «проверка». Общий CSV на сто тысяч строк без группировки редко помогает разработчику.

Рабочий процесс аудита

Сохраните конфигурацию, версию приложения и дату. После исправлений перезапустите crawl на той же области и сравните экспорт, иначе нельзя доказать, что дефект исчез. Для регулярного облачного контроля попробуйте Index-Now.ru; другие варианты собраны в статье об аналогах Screaming Frog.

Не принимайте каждое предупреждение за ошибку. Noindex страницы входа может быть правильным, короткий title бренда — достаточным, а редирект при миграции — обязательным. Приоритет определяют назначение URL и влияние на обход, индексирование и пользователя.

Частые вопросы

Что входит в бесплатную версию?

Она сканирует до 500 URL за crawl и выполняет основные технические проверки. JavaScript rendering, сохранение crawl, integrations и часть расширенных функций требуют лицензии.

Нужно ли всегда включать JavaScript?

Нет. Начните с Text Only и включайте рендеринг, если основной контент или ссылки отсутствуют в исходном HTML. Сравните результаты на выборке.

Screaming Frog показывает индекс Google?

Нет. Он оценивает страницы своим обходом. Данные Google берите из Search Console и URL Inspection; интеграция лишь добавляет эти поля в crawl.

Что читать дальше