Взгляд внутрь
Этот безопасный просмотр показывает, для чего нужен инструмент, не выполняя действий, требующих аккаунта.
Что умеет Частота слов
Текст выдаёт выбором слов больше, чем думаешь. Какие понятия доминируют, какие слова-паразиты закрадываются, какую формулировку ты используешь трижды на одной странице: при письме этого не видно, но цифры показывают это беспощадно. Wort-Frequenz это инструмент, который разбирает твой текст на составные части и считает их.
Основа это анализ частот. Wort-Frequenz перечисляет отдельные слова по частоте, так что доминирующие понятия стоят наверху. Более 400 стоп-слов для немецкого и английского можно отфильтровать, чтобы проступили слова, несущие смысл, а список не возглавляли привычные und, der, die, das.
Помимо отдельных слов, инструмент считает и сочетания слов. Биграммы показывают самые частые последовательности из двух слов, триграммы самые частые последовательности из трёх. Именно здесь проявляются любимые фразы и повторы, которые на уровне слов остаются незаметными, а как шаблоны становятся очень заметными. Это самый быстрый способ найти собственную привычку в письме.
Для визуализации есть несколько видов. Облако слов показывает частые слова крупно и экспортируется как PNG. Столбчатая диаграмма показывает самые частые слова в виде рейтинга. Вид распределения проверяет, следует ли твой текст закону Ципфа, по которому в естественном языке самое частое слово встречается примерно вдвое чаще второго по частоте. Увлекательный взгляд на статистику, стоящую за языком.
Анализ основ слов объединяет падежные и спрягаемые формы. Gehen, geht, ging и gegangen это одно и то же слово в разных формах; с помощью стемминга их сводят к общей основе, так что видна настоящая частота понятия, а не разбросанная по формам.
Режим сравнения ставит два текста друг против друга. Так видно, какие слова чаще встречаются в одном, чем в другом. Это удобно, чтобы сопоставить две редакции, двух авторов или две темы. Дополняют это показатели вроде Type-Token-Ratio, которая измеряет разнообразие слов. Все результаты можно экспортировать как CSV или JSON.
Всё работает в твоём браузере, твой текст не покидает устройство. Без регистрации, без передачи, без сбора данных. Присматриваешься ли ты к своему стилю письма, строишь профиль ключевых слов для SEO или просто интересуешься, какие слова держат твой текст, Wort-Frequenz даёт цифры и картинки к ним.
Функции
Частота слов
Отдельные слова по частоте: доминирующие понятия сразу наверху.
Биграммы и триграммы
Самые частые последовательности из двух и трёх слов выдают любимые фразы, незаметные на уровне слов.
Облако слов как PNG
Частые слова крупно и с экспортом как изображение: для презентации или обзора.
Распределение Ципфа
Проверяет, следует ли твой текст закону Ципфа: взгляд на статистику, стоящую за естественным языком.
Анализ основ слов
Стемминг объединяет формы слова, чтобы была видна настоящая частота понятия.
Более 400 стоп-слов
Отфильтруй служебные слова немецкого и английского, чтобы проступили понятия, несущие смысл.
Сравнение текстов и экспорт
Поставь два текста друг против друга, измерь Type-Token-Ratio и экспортируй результаты как CSV или JSON.
Как это работает
- 1
Вставить текст
Вставь свой текст. Анализ частот стартует сразу и показывает слова по числу вхождений.
- 2
Фильтровать стоп-слова
Включи фильтр стоп-слов, чтобы наверху стояли не привычные служебные слова, а слова, несущие смысл.
- 3
N-граммы и визуализация
Посмотри биграммы, триграммы, облако слов и распределение Ципфа, чтобы заметить шаблоны и повторы.
- 4
Сравнить и экспортировать
В режиме сравнения поставь два текста рядом и экспортируй результаты как CSV, JSON, а облако слов как PNG.
Кому это нужно
Частые вопросы
Что такое биграммы и триграммы?
Биграммы это последовательности из двух слов подряд, триграммы из трёх. Они показывают, какие сочетания слов и фразы ты используешь чаще всего: повторы, незаметные на уровне отдельных слов, отчётливо проступают как шаблоны.
Зачем отфильтровывать стоп-слова?
Без фильтра частые служебные слова вроде und, der или in возглавляют каждый список частот и закрывают настоящие слова, несущие смысл. Фильтр из более чем 400 немецких и английских стоп-слов скрывает их, и становятся видны понятия, о которых в тексте действительно идёт речь.
Что такое распределение Ципфа?
Закон Ципфа описывает закономерность естественного языка: самое частое слово встречается примерно вдвое чаще второго по частоте, втрое чаще третьего и так далее. Вид распределения показывает, насколько хорошо твой текст следует этой кривой.
Что даёт анализ основ слов?
Он сводит формы слова к общей основе, так что gehen, geht и ging считаются как одно понятие. Без этого шага частота слова была бы разбросана по формам и недооценена.
Сохраняется ли мой текст?
Нет. Весь анализ идёт в твоём браузере, твой текст не покидает устройство. Без регистрации, без передачи на сервер, без сбора данных. Экспортированные файлы появляются на твоём устройстве только после твоего клика.
Похожие инструменты
Статистика текста
Подробный анализ текста: Flesch-Amstad, Gunning Fog, частота слов, длина предложений, время ч…
Оценка читабельности
Измерь читаемость своих текстов. Flesch-DE, Wiener Sachtextformel, индекс Lix.
Очистка текста
Убирай пробелы, теги HTML, URL, специальные символы. Исправляй умляуты, типографику, умные ка…
Сравнение договоров
Сравни две версии договора слово за словом, прямо в браузере. Новое зелёным, вычеркнутое крас…
Plagiat-Checker Lite
Сравни свой текст с источником, который вставишь сам, и смотри предложение за предложением, к…
Начнём с Частота слов?
Без установки. Входит в Plus. Открывай прямо в браузере.
Открыть сейчас