Анализатор частоты слов
Онлайн-инструмент для подсчета частоты и плотности слов в тексте с фильтрацией стоп-слов.
Запустить инструмент
Онлайн-анализатор частоты слов подсчитывает повторения лексических единиц в исходном тексте и упорядочивает их по убыванию частоты. Инструмент переводит все символы в нижний регистр и извлекает последовательности из латинских букв от a до z и апострофов. Цифры, знаки препинания и специальные символы служат разделителями слов. Пользователь может включить или выключить встроенный фильтр стоп-слов, чтобы убрать из таблицы часто встречающиеся служебные частицы. Параметр количества выводимых строк задает размер списка в диапазоне от 5 до 100 элементов со значением по умолчанию 20. Для каждого найденного слова сервис рассчитывает число вхождений, процентную долю относительно общего количества распознанных токенов с округлением до двух знаков после запятой, а также относительный визуальный показатель относительно лидирующей позиции. Если поле ввода остается пустым, на экране отображаются нулевые значения общего объема и уникальных слов. Итоговая таблица помогает быстро оценить лексическую плотность и выявить повторяющиеся конструкции.
Инструкция
- Вставьте или введите исходный текст в поле ввода.
- При необходимости отметьте пункт фильтрации стоп-слов для исключения служебной лексики.
- Укажите количество отображаемых позиций от 5 до 100.
- Нажмите кнопку запуска для формирования частотного отчета.
Примеры
- Анализ фразы 'Data analysis and data science' с включенным фильтром стоп-слов и лимитом 10: слово 'data' встречается 2 раза (50%), слова 'analysis' и 'science' по 1 разу (25%).
- Обработка пустого поля: инструмент показывает нулевое общее количество токенов и пустую таблицу результатов.
Частые вопросы
Как инструмент обрабатывает регистр букв и знаки препинания?
Все латинские буквы автоматически приводятся к нижнему регистру, а знаки препинания, цифры и пробелы служат разделителями.
Какие символы включаются в состав слов?
Распознаются латинские символы от a до z и апострофы.
Какое минимальное и максимальное число строк можно запросить?
Параметр принимает значения от 5 до 100 со значением по умолчанию 20.
Как рассчитывается процентная доля каждого слова?
Число вхождений делится на общее количество извлеченных токенов с округлением результата до двух знаков после запятой.