このツールが役立つ場合
目に見えて空のセパレーターや裏面ページを含むスキャナーのバッチをクリーンアップするルーチンで、使用前にダウンロードした結果を変更されていないソースと比較できる場合。
局所処理の仕組み
PDF.jsは各ページを境界内の内部分析キャンバスにレンダリングし、ほぼ白からどれだけ異なるかを測定します。ワークベンチは候補ページ番号を一覧表示し、ユーザーが特定の候補を確認するまでPDFは生成されません。プロセッサは再度検出し、確認済みで一致するページだけを削除します。
使い方
- ソースを準備する: 目に見えて空のセパレーターや裏面ページを含むスキャナーのバッチをクリーンアップするルーチンで、使用前にダウンロードした結果を変更されていないソースと比較できる場合。
- ローカルで処理する: PDF.jsは各ページを境界内の内部分析キャンバスにレンダリングし、ほぼ白からどれだけ異なるかを測定します。ワークベンチは候補ページ番号を一覧表示し、ユーザーが特定の候補を確認するまでPDFは生成されません。プロセッサは再度検出し、確認済みで一致するページだけを削除します。
- ダウンロードして確認する: ダウンロードしたPDFをページごとに変更されていないソースと高倍率で比較し、すべての空白を確認し、薄く予期される内容がないか探し、削除されたページは出力から回復できないため、元のページを保持します。
重要な制限事項
空白検出は視覚的ヒューリスティックであり、確実性ではありません。薄い鉛筆の跡、淡い透かし、微小なマーク、透明度、異常な背景、レンダリングの違いは誤削除の候補を生むことがあります。一方、埃、影、トリミングマーク、ノイズは、実際は空白のページを保持させることがあります。
ダウンロードした結果を確認する
ダウンロードしたPDFをページごとに変更されていないソースと高倍率で比較し、すべての空白を確認し、薄く予期される内容がないか探し、削除されたページは出力から回復できないため、元のページを保持します。
私設設計
あなたのファイルはこのブラウザに残ります。ツールはソースや出力をサーバーにアップロードしません。
質問と回答
このツールはいつ役立ちますか?
目に見えて空のセパレーターや裏面ページを含むスキャナーのバッチをクリーンアップするルーチンで、使用前にダウンロードした結果を変更されていないソースと比較できる場合。
ブラウザは実際に何をしますか?
PDF.jsは各ページを境界内の内部分析キャンバスにレンダリングし、ほぼ白からどれだけ異なるかを測定します。ワークベンチは候補ページ番号を一覧表示し、ユーザーが特定の候補を確認するまでPDFは生成されません。プロセッサは再度検出し、確認済みで一致するページだけを削除します。
理解しておくべき制限は何ですか?
空白検出は視覚的ヒューリスティックであり、確実性ではありません。薄い鉛筆の跡、淡い透かし、微小なマーク、透明度、異常な背景、レンダリングの違いは誤削除の候補を生むことがあります。一方、埃、影、トリミングマーク、ノイズは、実際は空白のページを保持させることがあります。
結果をどのように確認すべきですか?
ダウンロードしたPDFをページごとに変更されていないソースと高倍率で比較し、すべての空白を確認し、薄く予期される内容がないか探し、削除されたページは出力から回復できないため、元のページを保持します。