브라우저 실행 모드: 데이터는 브라우저에서 처리되며 서버에 업로드되지 않습니다.
속도와 안정성: 처리 속도는 기기와 브라우저에 따라 달라집니다. 대량 배치 작업에는 데스크톱 버전이 더 안정적일 수 있습니다.
도구를 불러오는 중입니다. 잠시 기다려 주세요...
도구를 불러오는 중입니다. 잠시 기다려 주세요...
온라인 도구가 로드되거나 실행되지 않으면 데스크톱 도구를 사용해 보세요. https://tools.yikeaigc.com/
도구 사용량
이전 버전으로 돌아가기먼저 키워드와 일치 방식을 설정한 뒤 텍스트 또는 문서를 추가하고 통계를 시작하세요. 여러 파일은 모두 처리되며, 화면에는 파일과 결과가 최대 20개만 표시됩니다.
통계 설정
한 줄에 키워드 하나를 입력하세요. 정규식 모드에서는 한 줄에 표현식 하나를 입력하세요.
로컬 처리
일괄 ZIP
정규식 일치
키워드
여러 키워드를 한 번에 집계할 수 있으며 빈 줄은 자동으로 무시됩니다.
매칭 방식
조각 추출
조각 상한을 0으로 설정하면 문맥을 추출하지 않습니다.
PDF 페이지
끝 페이지에 0을 입력하면 문서 마지막 페이지까지 집계합니다.
텍스트 읽기
일괄 내보내기
설정 저장
저장 후 다음에 열면 키워드, 매칭 방식, PDF 페이지, 내보내기 형식이 자동 복원됩니다.
설정을 완료한 뒤 텍스트나 문서를 계속 추가하세요.
내용 추가
텍스트를 바로 붙여넣거나 문서 파일을 하나 이상 선택할 수 있습니다.
입력 대기
텍스트 내용
파일 선택
파일을 선택하거나 여기로 드래그
PDF, DOCX, PPTX, XLSX, TXT, MD, HTML, CSV, JSON, SRT 지원.
처리 대기 개요
키워드0
파일 수0
텍스트 문자0
처리 모드텍스트
설정과 입력 내용을 확인한 후 통계 다운로드 단계로 이동하세요.
통계 다운로드
통계 시작을 클릭하면 결과를 미리 보고 보고서를 다운로드할 수 있습니다.
통계 시작 대기 중.
아직 통계를 시작하지 않았습니다.
안내
소프트웨어 사용 설명
- 키워드 설정: “키워드 목록”에 통계할 키워드를 한 줄에 하나씩 입력하세요. 정규 표현식 모드에서는 각 줄에 표현식 하나를 입력합니다.
- 일치 방식 선택:
- 일반 일치: 입력한 내용에 따라 문자 일치를 수행하며, 한국어/중국어 단어와 고정 문구에 적합합니다.
- 전체 단어 일치: 영어 및 숫자형 단어에 적합하며, 더 긴 단어에 포함되어 잘못 일치하는 경우를 줄입니다.
- 정규 표현식: 번호, 날짜, 형식화된 코드 등 규칙이 있는 내용을 통계하는 데 적합합니다.
- 통계 매개변수 구성: 필요에 따라 대소문자 구분, 중복 카운트 허용, 공백 문자 병합, 줄바꿈 하이픈 병합, 적중 행 수 통계, PDF 페이지별 통계를 활성화할 수 있습니다.
- 조각 및 페이지 번호 설정: 적중 조각 수, 조각 길이, PDF 시작 페이지와 종료 페이지를 설정할 수 있습니다. 종료 페이지에 0을 입력하면 문서 마지막 페이지까지 통계합니다.
- 콘텐츠 추가: 텍스트를 붙여넣을 수 있으며, PDF, DOCX, PPTX, XLSX, TXT, Markdown, HTML, CSV, JSON, SRT 등의 파일도 선택할 수 있습니다. 여러 파일은 모두 처리되며, 화면에는 처음 20개만 표시됩니다.
- 설정 저장: “설정 저장”을 클릭하면 현재 키워드, 일치 방식, 페이지 범위 및 내보내기 형식을 보존하여 이후에도 계속 사용할 수 있습니다.
- 통계 시작: “통계 다운로드” 단계로 이동한 뒤 “통계 시작”을 클릭하고 처리가 완료될 때까지 기다리면 키워드 출현 횟수, 적중 행 수, PDF 페이지별 결과 및 적중 조각을 확인할 수 있습니다.
- 결과 다운로드: 단일 콘텐츠는 TXT, CSV 또는 JSON 보고서를 다운로드할 수 있습니다. 일괄 파일은 ZIP으로 생성되며, 각 파일의 보고서와 선택적 요약 CSV가 포함됩니다. 결과 파일 이름이 중복되면 숫자를 자동으로 추가해 구분합니다.
자주 묻는 질문
답변: PDF, DOCX, PPTX, XLSX, TXT, Markdown, HTML, CSV, JSON, SRT 등 일반적인 형식을 지원합니다. 일괄 처리 시 서로 다른 형식의 파일을 함께 선택할 수 있습니다.
답변: 일반 일치는 문자를 직접 통계합니다. 전체 단어 일치는 영어 또는 숫자 단어에 적합하며 cat이 category에 일치하는 것을 방지합니다. 정규 표현식은 번호, 날짜, 주문 번호 등 규칙이 있는 내용에 적합하며, 예를 들어
INV-\d+와 같습니다.
답변: 일반적인 원인으로는 PDF 텍스트 추출 순서와 레이아웃 순서의 차이, 키워드가 줄바꿈이나 공백으로 분리된 경우, 영어 단어가 줄바꿈 하이픈으로 나뉜 경우 등이 있습니다. 공백 문자 병합과 줄바꿈 하이픈 병합을 활성화하고, 일치한 조각을 통해 문맥을 확인해 보세요.
답변: “PDF 페이지 번호”에 시작 페이지와 끝 페이지를 입력하면 됩니다. 끝 페이지에 0을 입력하면 문서의 마지막 페이지까지 통계합니다. 시작 페이지는 끝 페이지보다 클 수 없습니다.
답변: 여러 결과 파일이 동일한 이름으로 생성될 경우, 시스템은 결과가 서로 덮어쓰이지 않도록 파일명 뒤에 _2, _3 등의 숫자를 추가합니다.
답변: 먼저 PDF 페이지 범위를 줄이고, 일치한 조각 수를 줄이거나, 많은 파일을 나누어 일괄 처리하는 것을 권장합니다. 정규 표현식도 지나치게 복잡한 백트래킹 방식은 피해야 합니다.