ブラウザ実行モード: データはブラウザ内で処理され、サーバーにはアップロードされません。
速度と安定性: 処理速度はデバイスとブラウザに依存します。大量のバッチ作業では、デスクトップ版の方が安定する場合があります。
ツールを読み込み中です。お待ちください...
ツールを読み込み中です。お待ちください...
オンラインツールを読み込めない、または実行できない場合は、デスクトップツールをお試しください。 https://tools.yikeaigc.com/
ツール使用状況
旧バージョンに戻す
先にクリーンアップルールを設定し、HTML内容をインポートして処理を開始してください
コード貼り付け、複数ファイル、サンプルデータに対応。複数ファイルは先頭20件のみ表示し、処理は全ファイルを含みます。
ローカルテキスト処理
先に改行、リンク、画像説明、出力形式などの設定を選択してから処理することをおすすめします。すぐ試す場合はサンプルデータを読み込めます。
1テキスト構造段落と空白を制御
2出力形式単体・一括共通
3ファイル設定処理前に調整可能
4クリーンアップ規則次回の既定値として保存可
先にクリーニングルールを確認してから、内容の取り込みに進んでください。
1入力方法を選択
ファイル内容は現在の端末で読み取り、処理されます
2HTMLコードを貼り付け
完全なページまたは断片に対応
2HTML/TXTファイルを選択
複数ファイルを一度に選択可
2サンプルを選択
サンプルは現在の入力を置き換えます
サンプルは機能確認用です。読み込み後も設定を変更して処理できます。
3内容の概要
内容は未追加
テキストを貼り付けるかファイルを選択すると、処理対象の内容がここに表示されます。複数ファイルは先頭20件のみ表示します。
HTMLテキストまたはファイルを先に追加してください。
1処理開始設定とインポートの完了を確認してください
先に設定してください
クリーンアップ設定と内容のインポート後、下のボタンでHTMLタグを削除します。
2処理状況開始待ち
処理待ちです。
処理結果はまだありません。手順どおりに処理後、確認してください。
3結果プレビュー
最初の処理結果を表示
処理完了後、先頭20件の結果ファイルが表示されます。
4処理詳細先頭20件は確認用です
| # | 元ファイル名 | 出力ファイル名 | 元の長さ | 結果の長さ | タグ数 | 状態 |
|---|
一括ZIPは元のファイル名を保持します。同名の場合は末尾に数字を追加します。
手順
ソフトウェアの使用方法
- クリーニングルールの設定:「クリーニング設定」に入り、まず改行処理、空白処理、出力形式、バッチファイル名ルールを選択します。
- 削除する内容の選択:
- スクリプト内容の削除:script、noscript、template などのコード内容を削除します。
- スタイル内容の削除:style タグの内容とインライン style 属性を削除します。
- HTMLコメントの削除:ソースコード内のコメント内容を削除します。
- 追加で削除するセレクター:.ad、#footer、nav などのセレクターを入力して、指定したブロックを削除できます。
- 保持する内容の設定:
- リンクURLの保持:リンクを「テキスト [URL]」形式に変換します。
- 画像説明の保持:画像の alt、title、またはファイル名をテキストのヒントとして抽出します。
- 指定タグの保持:a,strong,em,br などのタグ名を入力すると、一部のHTML構造を保持できます。
- HTMLエンティティのデコード: 、<、& などのエンティティを読みやすい文字に変換します。
- HTML内容のインポート:「内容のインポート」に入り、HTMLコードを直接貼り付けるか、html、htm、txt、xml、xhtml、shtml ファイルをまとめて選択できます。
- サンプルデータの使用:記事ページ、表の断片、混合コードのサンプルを選択して、クリーニング効果をすばやく確認できます。
- 処理の開始:「処理結果」に入り、「HTMLタグを削除」をクリックして結果を生成します。
- コピーとダウンロード:単一の結果はコピーまたはダウンロードできます。バッチ処理後はZIP圧縮ファイルをダウンロードでき、同名ファイルには自動的に数字が追加されて区別されます。
よくある質問
回答:できます。「改行処理」で「段落改行をスマートに保持」を選択すると、ツールが p、div、br、li、tr などの構造を改行に変換し、結果を読みやすくします。
回答:「リンクURLの保持」にチェックを入れると、リンクは「リンクテキスト [URL]」形式に変換され、資料整理、Webページ内容のアーカイブ、テキストへのエクスポートに適しています。
回答:デフォルトでは元のファイル名と同じです。圧縮ファイル内で同名のファイルがある場合は、区別するためにファイル名の末尾に数字が自動的に追加されます。カスタム接尾辞を追加することもできます。
回答:html、htm、txt、xml、xhtml、shtmlなどのテキスト系ファイルに対応しています。複数のファイルを一括選択した場合、画面には最初の20件のみ表示されますが、処理にはすべてのファイルが含まれます。
回答:HTMLエンティティとは、 、<、&のようにコードで表される文字です。デコードを有効にすると対応する文字に変換され、無効にすると元のエンティティ表記が保持されます。
回答:「保持するタグ」入力欄に保持したいタグ名を入力し、英字のカンマで区切ってください。例:a,strong,em,br。未入力の場合は、プレーンテキストとしてタグが削除されます。
回答:「ファイルエンコーディング」でUTF-8またはGB18030 / GBKに切り替えてから再処理できます。元ファイルのエンコーディングが特殊な場合は、先にテキストエディタで一般的なエンコーディングに変換することをおすすめします。