おそらく空白のPDFページを削除してください

境界付きページのプレビューをレンダリングし、ほぼ白に近いページを明確な閾値以下に保守的にフラグ付けし、物理的に保持されたページのみを新しいローカルPDFにコピーします。

このツールが役立つ場合

目に見えて空のセパレーターや裏面ページを含むスキャナーのバッチをクリーンアップするルーチンで、使用前にダウンロードした結果を変更されていないソースと比較できる場合。

局所処理の仕組み

PDF.jsは各ページを境界内の内部分析キャンバスにレンダリングし、ほぼ白からどれだけ異なるかを測定します。ワークベンチは候補ページ番号を一覧表示し、ユーザーが特定の候補を確認するまでPDFは生成されません。プロセッサは再度検出し、確認済みで一致するページだけを削除します。

使い方

  1. ソースを準備する: 目に見えて空のセパレーターや裏面ページを含むスキャナーのバッチをクリーンアップするルーチンで、使用前にダウンロードした結果を変更されていないソースと比較できる場合。
  2. ローカルで処理する: PDF.jsは各ページを境界内の内部分析キャンバスにレンダリングし、ほぼ白からどれだけ異なるかを測定します。ワークベンチは候補ページ番号を一覧表示し、ユーザーが特定の候補を確認するまでPDFは生成されません。プロセッサは再度検出し、確認済みで一致するページだけを削除します。
  3. ダウンロードして確認する: ダウンロードしたPDFをページごとに変更されていないソースと高倍率で比較し、すべての空白を確認し、薄く予期される内容がないか探し、削除されたページは出力から回復できないため、元のページを保持します。

重要な制限事項

空白検出は視覚的ヒューリスティックであり、確実性ではありません。薄い鉛筆の跡、淡い透かし、微小なマーク、透明度、異常な背景、レンダリングの違いは誤削除の候補を生むことがあります。一方、埃、影、トリミングマーク、ノイズは、実際は空白のページを保持させることがあります。

ダウンロードした結果を確認する

ダウンロードしたPDFをページごとに変更されていないソースと高倍率で比較し、すべての空白を確認し、薄く予期される内容がないか探し、削除されたページは出力から回復できないため、元のページを保持します。

私設設計

あなたのファイルはこのブラウザに残ります。ツールはソースや出力をサーバーにアップロードしません。

質問と回答

このツールはいつ役立ちますか?

目に見えて空のセパレーターや裏面ページを含むスキャナーのバッチをクリーンアップするルーチンで、使用前にダウンロードした結果を変更されていないソースと比較できる場合。

ブラウザは実際に何をしますか?

PDF.jsは各ページを境界内の内部分析キャンバスにレンダリングし、ほぼ白からどれだけ異なるかを測定します。ワークベンチは候補ページ番号を一覧表示し、ユーザーが特定の候補を確認するまでPDFは生成されません。プロセッサは再度検出し、確認済みで一致するページだけを削除します。

理解しておくべき制限は何ですか?

空白検出は視覚的ヒューリスティックであり、確実性ではありません。薄い鉛筆の跡、淡い透かし、微小なマーク、透明度、異常な背景、レンダリングの違いは誤削除の候補を生むことがあります。一方、埃、影、トリミングマーク、ノイズは、実際は空白のページを保持させることがあります。

結果をどのように確認すべきですか?

ダウンロードしたPDFをページごとに変更されていないソースと高倍率で比較し、すべての空白を確認し、薄く予期される内容がないか探し、削除されたページは出力から回復できないため、元のページを保持します。

関連ツール