ブラウザ実行モード: データはブラウザ内で処理され、サーバーにはアップロードされません。
速度と安定性: 処理速度はデバイスとブラウザに依存します。大量のバッチ作業では、デスクトップ版の方が安定する場合があります。
ツールを読み込み中です。お待ちください...
ツールを読み込み中です。お待ちください...
オンラインツールを読み込めない、または実行できない場合は、デスクトップツールをお試しください。 https://tools.yikeaigc.com/
ツール使用状況
旧バージョンに戻す先に段落・文・クリーンアップ設定を行い、テキスト入力またはファイルを選択してください。サンプルデータで結果をすぐ確認できます。
先に設定してください
現在、集計対象は追加されていません。
1段落分割
2文分割
3語数と出力
4クリーンアップ規則
統計はクリーンアップ後のテキストを基に計算され、レポートに現在のルールが記録されます。
5集計詳細
英語の略語、小数点、句読点の範囲は文分割と文字数に影響します。
よく使うルールを保存してから入力へ進むのがおすすめです。
1入力方法を選択
2入力テキスト
入力後、集計結果をリアルタイム更新。処理をクリックすると結果リストに追加され、エクスポートしやすくなります。
2ファイルを追加
画面には先頭20件のファイルを表示し、処理時は選択済みの全ファイルを含めます。
クリックしてファイル選択、またはここにドラッグ
対応形式:.txt、.md、.docx、.pdf。DOCX と PDF はローカルでテキスト抽出後に集計します。
2サンプルを読み込む
サンプルデータは現在の入力内容またはファイル一覧を置き換えます。
3リアルタイム統計
直接入力モードでは、ここに結果が自動更新されます。
4処理を実行
開始待ち。
集計する内容がまだ追加されていません。
集計結果はまだありません。手順に沿って処理後に表示してください。
| 名前 | 段落 | 文 | 単語数 | 文字 | 空白以外 | 平均文長 | 平均段落長 | 行数 | 状態 |
|---|
詳細
表の行をクリックすると、段落・文の例と個別レポートを表示できます。
手順
ソフトウェア使用方法
- 集計ルールの設定:まず「集計設定」に入り、段落分割、文分割、単語数集計モード、レポート命名テンプレートを選択します。
- クリーンアップオプションの設定:
- 段落分割:空行で分割、1行を1段落、先頭行インデント認識に対応しています。
- 文分割:文末の句読点、改行、句読点と改行の組み合わせによる分割に対応しています。
- テキストクリーンアップ:改行の統一、前後の空白削除、連続空白の折りたたみ、ソフト改行の結合、HTMLタグの削除、括弧内内容の無視が可能です。
- 集計詳細:英語の略語や小数点を保護でき、文字数集計で句読点を無視するかどうかを選択できます。
- 入力またはファイル選択:
- 直接入力:テキストを貼り付けると、段落数、文数、単語数、文字数がリアルタイムで表示されます。
- 一括ファイル:TXT、MD、DOCX、PDFファイルを選択します。画面には最初の20ファイルのみ表示されますが、残りのファイルもまとめて処理されます。
- サンプルデータ:中国語原稿、中英混在、または一括テキストのサンプルを読み込み、集計結果をすばやく確認できます。
- 処理開始:設定と入力内容を確認したら、「処理開始」をクリックすると、ツールが現在のルールに従って集計結果を生成します。
- 結果の確認:結果ページには、段落数、文数、単語数、文字数、空白以外の文字数、平均文長、平均段落長、処理ステータスが表示されます。表の行をクリックすると、段落サンプル、文サンプル、テキストプレビューを確認できます。
- 結果のエクスポート:CSVサマリーをエクスポートできるほか、ZIP圧縮ファイルをダウンロードできます。ZIPにはsummary.csv、results.json、集計説明、ファイルごとのTXTレポートが含まれます。
よくある質問
回答:空行で分割は一般的な記事に適しています。1行を1段落はリストや表からエクスポートしたテキストに適しています。先頭行インデント認識は、体裁が比較的整った長文原稿に適しています。
回答:文の集計は句読点、改行、保護ルールに依存します。見出し、番号、略語、小数点、特殊なレイアウトがある場合は、「英語の略語を保護」と「小数点を保護」をオンにし、テキストの種類に応じて文分割方法を切り替えることをおすすめします。
答:PDF、Webページ、またはDTPソフトからテキストをコピーすると、本文中に不自然な改行が入ることがあります。「ソフト改行を結合」を有効にすると、ツールは連続する本文行をできるだけ結合し、段落が分断されるのを減らします。
答:TXT、MD、DOCX、PDFに対応しています。DOCXは本文テキストを抽出し、PDFはテキストレイヤーの内容を読み取ります。PDFがスキャン画像の場合は、先にOCR認識を行ってから集計する必要があります。
答:画面表示をスムーズに保つため、ファイル一覧には確認用として最初の20件のみを表示しています。実際の処理では選択済みのすべてのファイルが含まれ、結果はCSV、JSON、ファイル別レポートに完全に書き込まれます。
答:中国語は文字数+英語は単語数は中英混在テキストに適しています。空白で単語分割は英語、またはスペースで単語を区切る内容に適しています。漢字のみをカウントと英単語のみをカウントは、特定の種類のテキスト数を個別に確認する場合に適しています。
回答:ZIPにはsummary.csv集計表、results.json構造化データ、統計説明.txt、およびreportsディレクトリ内のファイルごとのTXTレポートが含まれます。「抽出テキストを含める」にチェックを入れた場合は、textsディレクトリも含まれます。