テキストの文字数でファイルを絞り込むツール
設定した中国語の文字数範囲に基づき、さまざまな文書形式(TXT、PDF、DOCX、PPTXなど)から条件に合うファイルを絞り込み、一括ダウンロードに対応します。
ブラウザ実行モード: データはブラウザ内で処理され、サーバーにはアップロードされません。
速度と安定性: 処理速度はデバイスとブラウザに依存します。大量のバッチ作業では、デスクトップ版の方が安定する場合があります。
ツールを読み込み中です。お待ちください...
ツールを読み込み中です。お待ちください...
オンラインツールを読み込めない、または実行できない場合は、デスクトップツールをお試しください。 https://tools.yikeaigc.com/
ツール使用状況
旧バージョンに戻す
まず「絞り込み設定」で文字数範囲、集計方法、解析オプションを確認してから、処理を開始してください。
ファイルは現在のページ内でのみ読み取り、集計、圧縮されます。一括選択時、画面には先頭20件のみ表示されますが、実際の処理は選択済みの全ファイルが対象です。
1ファイルまたはフォルダーを選択
クリックしてファイルを選択、またはここにドラッグ&ドロップ
TXT、SRT、HTML、Markdown、DOCX、PDF、PPTX、XLSX などに対応。フォルダーを選択して一括読み込みもできます。
フォルダー選択時は対応文書を再帰的に読み込みます。画面の混雑を避けるため、プレビュー一覧は先頭20件のみ表示します。
2サンプルデータ
選択済みファイル
0
合計サイズ
0 KB
対応形式
0
プレビュー数
0
3ファイルプレビュー
ファイルがまだ選択されていません。先にサンプルデータを読み込み、絞り込み設定へ進めます。
| 番号 | ファイル名 | 形式 | サイズ | 元のパス |
|---|
1文字数範囲
空欄なら下限なし。
空欄なら上限なし。
結果 ZIP にはフィルター方式に合うファイルのみを含めます。
2集計基準
3解析とクリーンアップ
PDF のみに適用。
0 を入力すると最終ページまで処理。
処理結果
抽出後、条件一致ファイルのZIPをダウンロード、または完全な統計レポートCSVをエクスポートできます。
抽出後、条件一致ファイルのZIPをダウンロード、または完全な統計レポートCSVをエクスポートできます。
処理待ち0%
ファイル処理
0
条件一致
0
該当なし
0
解析失敗
0
1フィルター結果
未処理です。先に「フィルター設定」でパラメータを確認してから、処理を開始してください。
| 選択 | ファイル名 | 状態 | 統計値 | 漢字数 | 形式 | 説明 |
|---|
2処理ログ
処理開始待ちです。
手順
ソフトウェアの使用方法
- ファイルまたはフォルダーを選択:「ファイルを選択」または「フォルダーを選択」をクリックします。サンプルデータを直接読み込むこともできます。一括インポート時、一覧には最初の20個のファイルのみ表示され、残りのファイルはメッセージで案内されますが、処理時にはすべて対象になります。
- 先にパラメータを設定:「フィルター設定」に切り替え、文字数範囲、集計基準、エンコード方式、PDFページ範囲、空白と句読点の処理ルールを順に確認してから、次へ進みます。
- 処理を開始:「処理を開始」をクリックすると、ツールがローカルでファイル内容を読み取り、集計します。サーバーにはアップロードされません。
- 結果を確認:処理完了後、結果ページで該当項目、未ヒット、解析失敗の一覧を確認できます。結果範囲ごとに表示を切り替えることもできます。
- 出力をダウンロード:必要な結果にチェックを入れて、ZIP または CSV をダウンロードします。結果ファイルは元のファイル名を保持し、同名ファイルには自動で数字が追加されて区別されます。
- 一括処理を続行:各ステップページには「次へ」ボタンがあり、次の設定ページへ素早く移動して再処理できます。
よくある質問
A:TXT、SRT、MD、HTML、HTM、DOCX、PDF、PPTX、XLSX、CSV、JSON、XML、XLS などの一般的な形式に対応し、フォルダーの再帰読み込みにも対応しています。
A:「300-1200」のように正確な範囲を入力できます。単一の数字を入力した場合は、0 からその数値までの範囲を表し、短いテキストや空の内容の抽出に適しています。
A:中国語の内容を主に見る場合は漢字数を選択できます。文書に中国語と英語が混在している場合は中英混合を選択できます。ページ上に実際に表示される内容を重視する場合は、可視文字基準を選択できます。
回答:PDFが長い場合、指定したページ範囲だけを集計でき、文書全体を対象にせずに済みます。特定の部分だけを確認したい場合に適しています。
回答:元のファイル名の後ろに自動で数字を追加して区別します。たとえば同名ファイルは「ファイル名(2)」「ファイル名(3)」となり、圧縮ファイル内での重複を防ぎます。
回答:よくある原因として、ファイルの破損、形式の不備、エンコード異常、内容が空であること、またはファイル形式と拡張子が一致していないことが挙げられます。まずは形式が近い別のサンプルで再試行してください。