Внутренний анализ релевантности

Проверьте, какие слова формируют содержание страницы, где они расположены и какой вес получают по TF‑IDF. Анализируйте URL или вставляйте исходный HTML-код.

Проверить страницу

По одному на строку или через запятую. Сервис покажет вхождения и охват списка.
Настройки анализа

Анализ по зонам, а не одной общей цифрой

Основной контент

Текст из main или article без навигации, шапки, подвала и боковых блоков.

Структурные зоны

Навигация, ссылки, метатеги, title, description, header и footer считаются отдельно.

Частоты и вес

Для каждой группы словоформ доступны повторы, TF, корпусный IDF и итоговый TF‑IDF.

Как рассчитывается IDF

Используется производный словарь открытого русского веб-корпуса Leipzig на 30 000 предложений. Для слова рассчитывается документная частота, затем применяется формула ln(N / DF) + 1.

Словарь работает только на сервере и не загружается в браузер. Значения предназначены для сравнительного анализа текста, а не являются фактором ранжирования поисковых систем.

Источник корпуса

О внутреннем анализе

Что показывает внутренний анализ релевантности?

Сервис считает слова и словоформы, частоты, TF, IDF и TF-IDF, а также показывает распределение терминов по основному контенту, навигации, ссылкам, метатегам, шапке и подвалу.

Чем отличаются TF, IDF и TF-IDF?

TF показывает долю слова в выбранной зоне страницы, IDF уменьшает вес общеупотребительных слов по открытому веб-корпусу, а TF-IDF объединяет частоту на странице и редкость в корпусе.

Можно ли анализировать исходный код без URL?

Да. Переключитесь на исходный HTML, вставьте код страницы и запустите анализ. В этом режиме сервер не обращается к внешнему сайту.