일괄 동영상·오디오 금칙어 검사
로컬 오디오·비디오 콘텐츠를 일괄 인식하고, 타임라인 자막을 자동 생성하며 금칙어 목록과 대조해 스캔합니다. 적발 시 상세 보고서를 출력하여 검토 및 시정이 용이합니다.
도구를 불러오는 중입니다. 잠시 기다려 주세요...
도구를 불러오는 중입니다. 잠시 기다려 주세요...
온라인 도구가 로드되거나 실행되지 않으면 데스크톱 도구를 사용해 보세요. https://tools.yikeaigc.com/
도구 사용량
이전 버전으로 돌아가기
더 강력하고 안정적인 기능의 데스크톱 버전이 제공됩니다.
데스크톱 버전 열기
Windows 10/11만 지원
대량 동영상·오디오 금칙어 검사 도구(소프트웨어 버전)
로컬 음성 인식 및 금칙어 대조에는 많은 CPU와 GPU 메모리 리소스가 필요하고 FunASR 등 오프라인 모델에 의존합니다. 더 안정적이고 신뢰할 수 있는 처리 환경을 위해 이 기능은 Windows 데스크톱 클라이언트 버전에서만 제공됩니다.
동영상·오디오 내용을 일괄 인식하고 타임라인 자막 자동 생성
맞춤 금칙어 목록, 적중 시 TXT 또는 CSV 보고서 출력
전 과정 로컬 오프라인 처리, 파일 서버 업로드 불필요
클릭하면 소프트웨어 다운로드 페이지로 이동합니다
안내
소프트웨어 사용 설명
- 검사할 파일 선택:"파일 찾아보기" 또는 "폴더 찾아보기" 버튼을 클릭하여 검사할 오디오·비디오 파일 또는 폴더를 추가합니다. 다중 선택과 드래그 앤 드롭을 지원합니다. 여러 경로는 영문 세미콜론으로 구분하며, MP4, AVI, MKV, MOV, FLV, MP3, WAV, FLAC, M4A 등 일반적인 형식을 지원합니다.
- 탐색 방식 설정:
- 하위 디렉터리 탐색:체크하면 기본 폴더와 그 모든 하위 디렉터리의 오디오·비디오 파일을 재귀적으로 처리합니다
- 원본 경로 구조 유지:체크하면 출력 보고서가 원본 폴더의 디렉터리 구조와 동일하게 생성되며, 이름이 중복될 경우 번호가 자동으로 추가됩니다
- 금지어 파일 선택:기본적으로 프로그램과 같은 디렉터리에 있는 "违禁词.txt"를 읽습니다. 키워드는 한 줄에 하나씩 작성하며, UTF-8 및 GBK 인코딩을 지원하고, #으로 시작하는 줄은 주석으로 간주됩니다. "찾아보기" 버튼을 클릭하여 다른 텍스트 파일을 지정할 수도 있습니다.
- 검사 옵션 구성:
- 보고서 형식:TXT 또는 CSV 두 가지 출력 중 선택할 수 있으며, 번호, 시작 시간, 종료 시간, 자막 내용, 적중 단어를 기록합니다
- 적중 보고서만 생성:체크하면 금지어가 적중되지 않은 파일은 보고서를 생성하지 않습니다
- 중간 자막 보존:인식된 SRT 자막도 함께 저장하여 수동 검토가 편리합니다
- VAD 단일 구간 최대 밀리초:긴 문장 분할 임계값을 조정하며, 긴 동영상은 적절히 높일 수 있습니다
- 장치 및 스레드:CPU 또는 CUDA GPU 추론을 선택하고 병렬 스레드 수를 설정할 수 있습니다
- 저장 디렉터리 선택:검사 보고서와 자막 파일의 출력 위치를 설정하며, 드래그 앤 드롭을 지원합니다.
- 검사 시작:"검사 시작" 버튼을 클릭하여 일괄 작업을 시작하면, 아래 진행률 표시줄과 로그에 현재 파일, 인식 진행률, 적중 상황이 실시간으로 표시됩니다. 처리 중에는 "중지" 버튼을 클릭하여 중단할 수 있습니다.
- 보고서 확인:검사가 완료되면 저장 디렉터리로 이동하여 TXT 또는 CSV 보고서를 확인할 수 있으며, 타임라인을 기준으로 금지어가 나타난 위치를 찾아 2차 편집 또는 수정할 수 있습니다.
자주 묻는 질문
답변: 비디오는 MP4, AVI, MKV, MOV, FLV, WMV, WEBM, M4V, MPG, TS, 3GP, RMVB 등의 형식을 지원하며, 오디오는 MP3, WAV, FLAC, AAC, OGG, M4A, WMA, OPUS, AC3, AMR 등을 지원합니다. 인식 엔진은 중국어 표준어 콘텐츠에 최적화되어 있어, 방언이나 억양이 있는 자료는 정확도가 다소 낮아질 수 있습니다.
답변: 금지어 파일은 일반 TXT 텍스트이며, 한 줄에 키워드 하나를 입력합니다. 빈 줄과 #으로 시작하는 주석 줄은 자동으로 무시됩니다. UTF-8 인코딩으로 저장하는 것을 권장하며, GBK와도 호환됩니다. 주제별로 그룹화하고 주석 줄을 추가하면 업계 민감어, 브랜드 단어, 컴플라이언스 단어 등 여러 목록을 관리하기 쉽습니다.
답변: 각 적중 기록에는 다섯 가지 필드가 포함됩니다: 번호, 시작 시간, 종료 시간, 자막 내용, 적중한 금지어. TXT는 사람이 읽거나 이메일로 전달하기에 적합하며, CSV는 Excel, WPS로 열어 필터링과 통계를 수행할 수 있어 팀 협업 수정에 편리합니다.
답변: 아닙니다. 음성 인식은 로컬 FunASR 모델로 완료되며, 금지어 대조도 로컬 메모리에서 진행됩니다. 전체 과정에서 인터넷에 연결하지 않고 어떤 오디오/비디오나 자막 내용도 업로드하지 않으므로, 개인정보나 영업 기밀이 포함된 자료 처리에 적합합니다.
답변: 다음과 같은 방법으로 최적화할 수 있습니다: 1) 장치에 NVIDIA 그래픽 카드가 있고 CUDA 버전 PyTorch가 설치되어 있다면 장치를 GPU로 전환합니다; 2) VAD 단일 구간 최대 밀리초 값을 적절히 높여 분할 비용을 줄입니다; 3) "적중 보고서만 생성"을 선택해 IO를 줄입니다; 4) 폴더를 배치별로 추가해 처리하여 단일 작업의 파일 수가 너무 많아지는 것을 방지합니다.
답변: 핫워드 기능을 설정해 고유명사, 인명, 브랜드명의 인식 정확도를 높일 수 있습니다. 또한 금지어 목록에 키워드의 흔한 동음이의 문자, 유사 발음 변형, 약어 형태를 포함하고, SRT 자막 보존 옵션과 함께 수동 검토를 진행하여 전체 커버리지를 높이는 것을 권장합니다.
답변: 1인 미디어 숏폼 영상 공개 전 준법 자체 점검, 이커머스 라이브 방송 클립 검수, 교육 강의 및 오디오북 콘텐츠 재검토, 광고 소재 민감어 점검, 기존 자료의 일괄 수정 등 다양한 상황에 적합하며, 콘텐츠 팀이 업로드 전에 위험 요소를 미리 발견할 수 있도록 도와줍니다.
답변: 이 도구는 감지 및 위치 확인에 중점을 두며, 감지된 각 구간의 정확한 타임라인을 출력합니다. 보고서를 받은 후 시간 지점에 따라 동영상 편집 소프트웨어 또는 본 사이트의 동영상 편집, 더빙 교체류 도구를 사용해 2차 처리하여 삭제, 교체 또는 음소거 효과를 구현할 수 있습니다.