動画・音声の禁止語一括検出
ローカルの音声・動画コンテンツを一括認識し、タイムライン付き字幕を自動生成して禁止語リストと照合スキャンします。該当項目が検出されると詳細レポートを出力し、審査と修正を効率化します。
ツールを読み込み中です。お待ちください...
ツールを読み込み中です。お待ちください...
オンラインツールを読み込めない、または実行できない場合は、デスクトップツールをお試しください。 https://tools.yikeaigc.com/
ツール使用状況
旧バージョンに戻す
より強力で安定した機能を備えたデスクトップ版があります。
デスクトップ版を開く
Windows 10/11 のみ対応
動画・音声の禁止語一括検出ツール(ソフト版)
ローカル音声認識と禁止語照合には多くのCPU・VRAMリソースを消費し、FunASRなどのオフラインモデルに依存するため、より安定した信頼性の高い処理を提供する目的で、本機能はWindowsデスクトップクライアント版のみで提供しています。
動画・音声を一括認識し、タイムライン付き字幕を自動生成
禁止語リストをカスタマイズし、検出後にTXTまたはCSVレポートを出力
すべてローカルでオフライン処理、ファイルのサーバーアップロード不要
クリックするとソフトのダウンロードページへ移動します
手順
ソフトウェア使用方法
- 検出対象ファイルを選択:「ファイルを参照」または「フォルダーを参照」ボタンをクリックし、検出する音声・動画ファイルまたはフォルダーを追加します。複数選択とドラッグ&ドロップに対応しています。複数のパスは半角セミコロンで区切ります。MP4、AVI、MKV、MOV、FLV、MP3、WAV、FLAC、M4A などの一般的な形式に対応しています。
- 走査方法を設定:
- サブディレクトリを走査:チェックすると、メインフォルダーおよびそのすべてのサブディレクトリ内の音声・動画ファイルを再帰的に処理します
- 元のパス構造を保持:チェックすると、出力レポートはソースフォルダーのディレクトリ構造と一致します。同名の場合は自動的に連番が追加されます
- 禁止語ファイルを選択:デフォルトではプログラムと同じディレクトリにある「违禁词.txt」を読み込みます。キーワードは1行に1件、UTF-8 と GBK エンコードに対応し、# で始まる行はコメントとして扱われます。「参照」ボタンをクリックして他のテキストファイルを指定することもできます。
- 検出オプションを設定:
- レポート形式:TXT または CSV の2種類の出力を選択でき、番号、開始時間、終了時間、字幕内容、ヒット語を記録します
- ヒットレポートのみ生成:チェックすると、禁止語にヒットしなかったファイルのレポートは生成されません
- 中間字幕を保存:認識された SRT 字幕も同時に保存し、手動確認に便利です
- VAD 単一区間の最大ミリ秒:長文の分割しきい値を調整します。長時間動画では適宜高めに設定できます
- デバイスとスレッド:CPU または CUDA GPU 推論を選択し、並列スレッド数を設定できます
- 保存先ディレクトリを選択:検出レポートと字幕ファイルの出力先を設定します。ドラッグ&ドロップに対応しています。
- 検出を開始:「検出開始」ボタンをクリックして一括タスクを開始します。下部の進行状況バーとログに、現在のファイル、認識の進捗、ヒット状況がリアルタイムで表示されます。処理中に「停止」ボタンをクリックして中断できます。
- レポートを確認:検出完了後、保存先ディレクトリに移動すると TXT または CSV レポートを確認できます。タイムラインに沿って禁止語の出現位置を特定し、再編集や修正を行えます。
よくある質問
A:動画では MP4、AVI、MKV、MOV、FLV、WMV、WEBM、M4V、MPG、TS、3GP、RMVB などの形式に対応しています。音声では MP3、WAV、FLAC、AAC、OGG、M4A、WMA、OPUS、AC3、AMR などに対応しています。認識エンジンは中国語の標準語コンテンツ向けに最適化されており、方言やアクセントのある素材では精度が低下する場合があります。
A:禁止語ファイルは通常の TXT テキストで、1行に1つのキーワードを記載します。空行および # で始まるコメント行は自動的に無視されます。UTF-8 エンコードで保存することを推奨しますが、GBK にも対応しています。テーマ別にグループ化しコメント行を追加することで、業界のセンシティブワード、ブランド語、コンプライアンス用語など複数のリストを管理しやすくなります。
回答:各ヒット記録には5つの項目が含まれます:番号、開始時刻、終了時刻、字幕内容、ヒットした禁止語。TXT は人による確認やメール転送に適しており、CSV は Excel、WPS で開いてフィルターや集計ができるため、チームでの修正作業に便利です。
回答:いいえ。音声認識はローカルの FunASR モデルで実行され、禁止語の照合も本機のメモリ上で行われます。全工程でインターネット接続や音声・動画・字幕内容のアップロードは行わないため、プライバシーや営業秘密を含む素材の処理に適しています。
回答:以下の点を最適化できます:1)デバイスに NVIDIA グラフィックカードがあり、CUDA 版 PyTorch がインストールされている場合は、デバイスを GPU に切り替える;2)VAD の単一セグメントの最大ミリ秒数を適度に引き上げ、分割コストを減らす;3)「ヒットレポートのみ生成」を選択して IO を減らす;4)フォルダを分割して追加・処理し、1回のタスクでファイル数が多くなりすぎないようにする。
回答:ホットワード機能を設定することで、専門用語、人名、ブランド名の認識精度を高められます。同時に、禁止語リストにはキーワードの一般的な同音字、語呂合わせの変形、略称を登録し、SRT 字幕を保持するオプションと併用して人手で確認することで、全体のカバー率を向上できます。
回答:個人メディアのショート動画公開前のコンプライアンス自己チェック、ECライブ配信の切り抜き審査、研修講座やオーディオブックの内容確認、広告素材のセンシティブワード確認、過去素材の一括修正などのシーンに適しており、コンテンツチームがアップロード前にリスク箇所を事前に発見するのに役立ちます。
回答:本ツールは検出と位置特定に特化しており、ヒットした各箇所の正確なタイムラインを出力します。レポート取得後、時間位置に基づいて動画編集ソフト、または当サイトの動画編集・音声差し替え系ツールを使用して二次処理を行い、削除、置換、またはミュートの効果を実現できます。