Screaming Frog SEO Spider — это десктопный краулер для глубокого технического и
SEO‑аудита сайта.
Подготовка к сканированию
В Screaming Frog есть два основных режима:
✅
Spider
краулинг сайта по ссылкам (стандартный вариант для полного аудита)
✅
List
загрузка списка URL из файла (удобно для точечной проверки, миграций, сравнения страниц).
Настройка User‑Agent
В Configuration > User-Agent можно выбрать агента (например, Googlebot или YandexBot),
чтобы увидеть сайт «глазами» поисковика. Это важно, если сайт отдаёт разный контент
для разных роботов.
Учёт robots.txt
По умолчанию Screaming Frog соблюдает правила robots.txt. Если нужен полный
технический аудит (в том числе закрытых разделов), в Configuration > Robots.txt
можно отключить это ограничение.
JavaScript‑рендеринг
Для SPA и сайтов с динамическим контентом включите рендеринг в Configuration >
Spider > Rendering. Это замедлит сканирование, но даст доступ к контенту, который
подгружается через JS.
Ограничения и скорость.
В бесплатной версии можно просканировать до 500 URL. В платной — без ограничений.
В Configuration > Spider настройте количество потоков и скорость запросов, чтобы
не перегружать сервер.
Как запустить сканирование
✅
Введите стартовый URL в поле ввода и нажмите Start.
✅
При необходимости заранее задайте правила включения/исключения страниц в Configuration
Include и Exclude (например, исключить админку, тестовые поддомены, UTM‑метки).
✅
Дождитесь завершения краулинга. Статус и прогресс отображаются в интерфейсе.
Ключевые вкладки и что в них искать
Internal
Основная вкладка со всеми найденными страницами. Здесь удобно фильтровать и
сортировать данные по разным параметрам:
✅
HTTP Status Codes.
Ищите страницы с кодами 4xx (ошибки клиента, например, 404) и 5xx (ошибки сервера).
Это битые ссылки и проблемы на стороне сервера.
✅
Page Titles, Meta Description
Проверяйте на отсутствие, дублирование, слишком большую или маленькую длину.
Дубли мета‑тегов — частая проблема, которая мешает правильной индексации.
✅
H1, H2
Анализируйте наличие, уникальность и соответствие контенту. На странице должен быть
один H1, релевантный теме.
✅
Word Count
Фильтруйте страницы с очень малым количеством текста (thin content) — они могут
плохо ранжироваться.
✅
Response Time
Смотрите на медленные страницы: они влияют на UX и могут мешать индексации.
External
Здесь собраны все исходящие ссылки с сайта:
✅
Ищите внешние ссылки на страницы с 4xx/5xx, чтобы убрать или заменить их.
✅
Если есть ссылки на сомнительные ресурсы, их лучше пересмотреть.
Images
Анализ изображений:
✅
Alt Text
Ищите картинки без alt‑текста — это упущенная возможность для SEO и проблема доступности.
✅
File Size.
Находите тяжёлые изображения, которые замедляют загрузку страниц.
✅
Missing Images.
Битые картинки портят пользовательский опыт и могут сигнализировать о проблемах с
CMS или миграцией.
Canonical
Проверка тега rel="canonical":
✅
Страницы с несколькими каноническими ссылками
✅
Каноническая ссылка ведёт на страницу с редиректом или ошибкой
✅
Отсутствие canonical там, где есть дубли контента
Redirects
Анализ редиректов:
✅
302 вместо 301. Временные редиректы не передают вес страницы. Для постоянных
перемещений используйте 301.
✅
Длинные цепочки редиректов (3xx → 3xx → …). Их нужно сокращать до одного шага.
✅
Редиректы на страницы с ошибками (4xx, 5xx)
URL
Анализ структуры URL:
✅
Слишком длинные адреса.
✅
Наличие спецсимволов, дублей из‑за слешей или регистра.
✅
Параметры URL, которые создают дубли страниц.
Custom Extraction
Позволяет парсить любые данные с помощью XPath, CSS Selectors или Regex. Например,
можно собрать микроразметку, цены, артикулы — всё, что нужно для SEO или аналитики.
Расширенные возможности для глубокого анализа
✅
Duplicate Content Checker
Выявляет страницы с похожим контентом с помощью алгоритма Simhash. Это помогает
находить частичные дубли, которые сложно заметить вручную.
✅
Thin Content Analyzer
Ищет страницы с недостаточным объёмом текста. Можно задать порог
(например, менее 300 слов) и получить список кандидатов на доработку.
✅
Compare Mode.
Позволяет сравнивать два сканирования (например, до и после редизайна или миграции).
Так можно быстро увидеть, какие страницы пропали, какие появились, как изменились
мета‑теги и статусы.
✅
Интеграции.
Screaming Frog умеет импортировать данные из Google Analytics, Search Console и
других источников, чтобы сопоставлять технические параметры с трафиком и позициями.
Частые ошибки при использовании Screaming Frog
✅
Игнорирование настроек User‑Agent и robots.txt
Из‑за этого можно получить неполную картину.
✅
Сканирование без учёта JavaScript.
На современных сайтах часть контента подгружается динамически — без рендеринга
вы его не увидите.
✅
Анализ только одной вкладки
SEO‑аудит — комплексный процесс: нужно смотреть и на мета‑данные, и на ссылки, и
на изображения, и на редиректы.
✅
Отсутствие приоритизации
Пытаться исправить все ошибки сразу неэффективно: лучше начать с самых критичных.