ブラウザ実行モード: データはブラウザ内で処理され、サーバーにはアップロードされません。
速度と安定性: 処理速度はデバイスとブラウザに依存します。大量のバッチ作業では、デスクトップ版の方が安定する場合があります。
ツールを読み込み中です。お待ちください...
ツールを読み込み中です。お待ちください...
オンラインツールを読み込めない、または実行できない場合は、デスクトップツールをお試しください。 https://tools.yikeaigc.com/
ツール使用状況
旧バージョンに戻す処理前にフィルター設定と出力設定を完了してください。 ファイル内容はこのページ内でのみ読み取り・解析・圧縮されます。一括選択時、画面には先頭20件のみ表示し、処理時は選択済み全ファイルを対象にします。
データ未選択
ルールは既定値
出力は既定値
1TXTまたはテキストファイルを選択
クリックしてファイルを選択、またはここにドラッグ
TXT、CSV、LOG、HTML、JSONなどのテキストファイルに対応。フォルダーを選択して一括読み込みも可能です。
複数ファイル選択時、プレビュー一覧は先頭20件のみ表示します。処理と圧縮には全ファイルが含まれます。
2ファイル概要
選択済みファイル0
ファイルサイズ0 KB
表示数0
ソースモードファイル
ファイルを選択、URLテキストを貼り付け、またはサンプルデータを読み込んでください。
1解析方法と出力内容
混在テキストは「全URLを抽出」がおすすめです。
2ドメインサフィックスとホスト規則
よく使うサフィックス
3キーワード、パス、重複除外
1出力ファイル構成
ファイルごとに出力すると元のファイル名を保持します。同名の場合は数字を自動追加します。
2ZIPと追加ファイル
データソース、フィルター設定、出力設定が完了していることを確認してください。開始後、現在のページで選択済みの全ファイルを処理し、ZIPダウンロードを生成します。
処理待ち0%
ファイルをスキャン0
URL検出0
条件一致0
重複削除0
出力ファイル0
プレビュー処理結果
未処理| 番号 | ソースファイル | 出力内容 | サフィックス | 状態 |
|---|---|---|---|---|
| 未処理です。先に設定を完了し、処理開始をクリックしてください。 | ||||
手順
ソフトウェア使用方法
- データソースを選択:「データソース」ページでTXT、CSV、LOGなどのテキストファイルを選択します。フォルダーの選択、URLリストの貼り付け、またはサンプルデータの読み込みで処理を試すこともできます。
- 解析方法を設定:
- テキストからすべてのURLを抽出:ログ、Webページのソース、JSON断片などの混在コンテンツに適しています。
- 1行に1つのURLとして処理:整理済みのURLリストに適しています。
- 出力内容を選択:ルートドメイン、完全なドメイン、プロトコル+ドメイン、完全なURL、元の断片、ドメインサフィックスなどの結果タイプを選択できます。
- フィルタールールを設定:
- サフィックスフィルター:.com、.cn、.com.cn、.co.ukなどのドメインサフィックスのみを保持、または除外できます。
- プロトコルフィルター:プロトコルを制限しない、またはHTTPやHTTPSのみを保持できます。
- キーワードフィルター:ドメインに含む、ドメインから除外、パスに含むキーワードで絞り込めます。
- 重複削除設定:全体での重複削除、単一ファイル内での重複削除に対応し、重複結果を保持することもできます。
- 出力方法を設定:ファイルごとに出力して元のファイル名を保持する、結果タイプ別にフォルダーへ出力する、または1つの結果ファイルに結合できます。
- 処理を開始してダウンロード:「処理ダウンロード」ページで「処理開始」をクリックし、完了後に「ZIP結果をダウンロード」をクリックして処理後のファイルを保存します。
よくある質問
回答:ルートドメインはexample.comのようなメインドメインです。完全なドメインはwww、blog、shopなどのサブドメインを保持します。プロトコル付きドメインはhttpまたはhttpsを保持し、例:https://www.example.com。
回答:一般的な原因には、形式が不完全、ドメイン階層が不足している、異常な文字を含む、プロトコルがHTTP/HTTPSではない、またはサフィックス、キーワード、プロトコルのルールでフィルタリングされていることが含まれます。「未認識の断片を生成」にチェックを入れると、確認用ファイルを表示できます。
A:よく使うサフィックスを直接チェックすることも、カスタムサフィックスに.com、.net、.com.cnなどを入力することもできます。複数のサフィックスはカンマ、セミコロン、または改行で区切ってください。
A:ファイルごとに出力する場合、元のファイル名が保持されます。複数のファイルが同名の場合、結果が上書きされないように、list.txt、list(2).txtのようにファイル名の後ろに数字が追加されます。
A:複数のファイルを横断してまとめてクリーンアップする場合は「グローバル重複削除」を選択します。各ファイルごとに結果を1つずつ保持したい場合は「各ファイル内で重複削除」を選択します。出現回数や元の重複レコードを保持する必要がある場合は「重複削除しない」を選択します。
A:いいえ。ファイル内容は現在のページ内で読み取り、フィルタリング、パッケージ化が完了し、サーバーにはアップロードされません。内部リンク、ログの断片、サイト一覧を含むデータの処理に適しています。
A:デフォルトでは、元のファイル名に基づいて生成された処理結果と統計レポートが含まれます。「未識別の断片」を有効にすると、解析できなかったURL断片とその理由を記録した調査用ファイルも追加で生成されます。