Результат не соответствует ожиданиям.
Проверьте ввод, выбранные параметры и ограничения ниже; перед удаляющей или агрессивной нормализацией сохраните исходник. Нет стемминга, лемматизации и объединения синонимов.
Подсчитайте, сколько раз встречается каждое слово, и увидьте самые частые элементы первыми.
Слова распознаются по Unicode-буквам с возможными цифрами, дефисами и апострофами внутри. Можно игнорировать регистр и задать минимальную длину. Результат сортируется по убыванию частоты и выдаётся как “число + Tab + слово”. Разные словоформы не объединяются.
Вставьте текст, настройте условия и проверьте качество токенизации.
Не более 500 000 символов: 0 / 500000
Нет результата
Вставьте анализируемый текст.
Настройте регистр и минимальную длину слова.
Проверьте дефисы, апострофы, цифры и языковую токенизацию, затем скопируйте TSV.
Проверьте ввод, выбранные параметры и ограничения ниже; перед удаляющей или агрессивной нормализацией сохраните исходник. Нет стемминга, лемматизации и объединения синонимов.
Уменьшите объём, разделите операцию на небольшие части и закройте другие ресурсоёмкие вкладки. Перед повтором сохраните исходник.
Проверьте приложение назначения, шрифт и кодировку. Некоторые программы нормализуют пробелы или иначе отображают Unicode.
Слова распознаются по Unicode-буквам с возможными цифрами, дефисами и апострофами внутри. Можно игнорировать регистр и задать минимальную длину. Результат сортируется по убыванию частоты и выдаётся как “число + Tab + слово”. Разные словоформы не объединяются.
Нет. Инструмент считает поверхностные формы отдельно и не выполняет лемматизацию.
Нет. Он считает только вхождения в предоставленном тексте и не знает поисковых объёмов.
Нет стемминга, лемматизации и объединения синонимов. Для языков со сложной морфологией, включая русский, результат не заменяет морфологический анализатор. Высокая частота не равна SEO-ценности или поисковому объёму.
Вставьте текст, настройте условия и проверьте качество токенизации.