Фильтр LSI и n-грамм по частотности русского языка

Это не анализ твоего текста. Инструмент отсекает общую лексику и шаблонные фразы сайта по "глобальной частотности" русского языка. Чем слово более частотное в языке - тем выше шанс, что это мусор для LSI.

Будет преобразовано в столбик. Нормализация: нижний регистр, ё->е, пробелы.
Фраза оценивается по словам внутри: если много сверхчастотных - это мусор.
Если элемент попал в стоп-лист - будет выкинут сразу.
В частотном списке: 1 = самое частое. Если ранг <= порога - считаем "слишком частое" и выкидываем. Пример: 5000 - мягкая чистка, 15000 - жесткая чистка.
Средний ранг слов во фразе <= порога - фраза выглядит общей и выкидывается.
Если во фразе >= 70% слов сверхчастотные - выкидываем.
Сортировка результата: от более редких/специфичных к более общим. Для SEO обычно удобнее так: сначала "мясо", потом "вода".
Элемент Тип Глобальный ранг Оценка фразы Статус Причина
Пока пусто. Нажми "Очистить".
Подсказка: слишком частое - слово/фраза общая для русского языка. шаблон сайта - стоп-фразы, cookie, политика, контакты и подобное. ок - можно оставлять как полезный SEO-сигнал.