Статистика частоты появления ключевых слов в документе
Подсчитывает количество вхождений ключевых слов в документах PDF/DOCX/PPTX и других форматах, поддерживает массовый экспорт отчетов
Режим выполнения в браузере: Ваши данные обрабатываются в браузере и не загружаются на сервер.
Скорость и стабильность: Скорость обработки зависит от вашего устройства и браузера. Для больших пакетов настольная версия может быть стабильнее.
Загрузка инструмента, подождите...
Если онлайн-инструмент не загружается или не запускается, попробуйте настольный инструмент. https://tools.yikeaigc.com/
Использование инструмента
Вернуться к старой версииНастройки подсчета
Одно ключевое слово в строке; в режиме regex — одно выражение в строке.
Можно считать несколько ключевых слов сразу; пустые строки игнорируются.
Если лимит фрагментов 0, контекст не извлекается.
0 в конечной странице — считать до конца документа.
После сохранения ключевые слова, тип совпадения, страницы PDF и формат экспорта восстановятся при следующем открытии.
Добавить содержимое
Можно вставить текст или выбрать один или несколько документов.
Поддерживаются PDF, DOCX, PPTX, XLSX, TXT, MD, HTML, CSV, JSON, SRT.
Скачать статистику
После запуска статистики можно просмотреть результат и скачать отчёт.
Инструкции
Инструкция по использованию
- Настройте ключевые слова: в «Списке ключевых слов» вводите ключевые слова для подсчета построчно; в режиме регулярных выражений указывайте по одному выражению в каждой строке.
- Выберите способ сопоставления:
- Обычное сопоставление: поиск по введенным символам, подходит для китайских слов и фиксированных фраз.
- Сопоставление целых слов: подходит для английских слов и числовых выражений, снижает риск ошибочного совпадения внутри более длинных слов.
- Регулярное выражение: подходит для подсчета номеров, дат, форматированного кода и другого содержимого по правилам.
- Настройте параметры подсчета: при необходимости можно включить учет регистра, разрешить подсчет перекрывающихся совпадений, объединение пробельных символов, объединение переносов с дефисом, подсчет строк с совпадениями и постраничную статистику PDF.
- Настройте фрагменты и страницы: можно задать количество фрагментов с совпадениями, длину фрагмента, а также начальную и конечную страницы PDF; значение 0 в поле конечной страницы означает подсчет до последней страницы документа.
- Добавьте содержимое: можно вставить текст или выбрать файлы PDF, DOCX, PPTX, XLSX, TXT, Markdown, HTML, CSV, JSON, SRT и другие. Несколько файлов будут обработаны полностью, в интерфейсе отображаются только первые 20.
- Сохраните настройки: нажмите «Сохранить настройки», чтобы сохранить текущие ключевые слова, способ сопоставления, диапазон страниц и формат экспорта для дальнейшего использования.
- Начните подсчет: после перехода к шагу «Статистика и загрузка» нажмите «Начать подсчет» и дождитесь завершения обработки, чтобы просмотреть количество появлений ключевых слов, число строк с совпадениями, постраничные результаты PDF и найденные фрагменты.
- Скачайте результаты: для одного содержимого можно скачать отчет TXT, CSV или JSON; для пакетных файлов будет создан ZIP, содержащий отчеты по каждому файлу и необязательный сводный CSV. При совпадении имен результирующих файлов номер будет добавлен автоматически.
Часто задаваемые вопросы
INV-\d+.
Похожие инструменты
Инструмент форматирования текста
Очистка и форматирование неструктурированного текста в од...
Инструмент удаления дубликатов CSV
Поддерживает удаление дубликатов в CSV-данных для одного ...
Инструмент удаления строк TXT
Массово удаляйте указанные строки из TXT-файлов по различ...
Инструмент для пакетного удаления указанных строк в TXT
Пакетная обработка TXT-файлов с поддержкой фильтрации по ...
Инструмент сортировки китайских имён
Профессиональный онлайн-инструмент для сортировки китайск...
DOCX в PDF или изображения
Профессиональное ПО для пакетной обработки документов Wor...
Онлайн-инструмент сравнения текста
Онлайн-сравнение различий между двумя фрагментами текста ...
Инструмент объединения документов Word
Пакетно объединяйте несколько документов Word в один файл...