Supprimer les pages PDF probablement blanches

Rendez les aperçus de pages limités, signalez de manière conservatrice les pages proches du blanc sous un seuil explicite, et copiez uniquement les pages physiques conservées dans un nouveau PDF local.

Quand cet outil est utile

Routine de nettoyage des lots de scanners contenant des séparateurs évidents vides ou des pages arrière lorsqu'une personne peut comparer le résultat téléchargé avec la source inchangée avant de l'utiliser.

Comment le traitement local fonctionne

PDF.js rend chaque page sur un canevas d'analyse interne limité et mesure combien elle diffère du presque-blanc. La plateforme liste les numéros de pages candidats ; aucun PDF n'est généré tant que l'utilisateur n'a pas vérifié les candidats spécifiques. Le processeur détecte à nouveau et supprime uniquement les pages confirmées qui correspondent encore.

Comment l'utiliser

  1. Préparer la source: Routine de nettoyage des lots de scanners contenant des séparateurs évidents vides ou des pages arrière lorsqu'une personne peut comparer le résultat téléchargé avec la source inchangée avant de l'utiliser.
  2. Traiter localement: PDF.js rend chaque page sur un canevas d'analyse interne limité et mesure combien elle diffère du presque-blanc. La plateforme liste les numéros de pages candidats ; aucun PDF n'est généré tant que l'utilisateur n'a pas vérifié les candidats spécifiques. Le processeur détecte à nouveau et supprime uniquement les pages confirmées qui correspondent encore.
  3. Télécharger et vérifier: Comparez le PDF téléchargé page par page avec la source inchangée à un niveau de zoom élevé, vérifiez que chaque espace correspond bien à une page source réellement blanche, recherchez un contenu attendu faible, et conservez l'original car une page supprimée ne peut pas être récupérée à partir du fichier de sortie.

Limitations importantes

La détection de pages blanches est une heuristique visuelle, pas une certitude. Les traits légers de crayon, les filigranes pâles, les petites marques, la transparence, les arrière-plans inhabituels ou les différences de rendu peuvent provoquer des candidats à la suppression erronés, tandis que la poussière, les ombres, les marques de rognage et le bruit peuvent faire subsister une page par ailleurs blanche.

Vérifier le résultat téléchargé

Comparez le PDF téléchargé page par page avec la source inchangée à un niveau de zoom élevé, vérifiez que chaque espace correspond bien à une page source réellement blanche, recherchez un contenu attendu faible, et conservez l'original car une page supprimée ne peut pas être récupérée à partir du fichier de sortie.

Privé par conception

Vos fichiers restent dans ce navigateur. L'outil n'envoie pas la source ni le résultat à nos serveurs.

Questions et réponses

Quand cet outil est-il utile ?

Routine de nettoyage des lots de scanners contenant des séparateurs évidents vides ou des pages arrière lorsqu'une personne peut comparer le résultat téléchargé avec la source inchangée avant de l'utiliser.

Que fait réellement le navigateur ?

PDF.js rend chaque page sur un canevas d'analyse interne limité et mesure combien elle diffère du presque-blanc. La plateforme liste les numéros de pages candidats ; aucun PDF n'est généré tant que l'utilisateur n'a pas vérifié les candidats spécifiques. Le processeur détecte à nouveau et supprime uniquement les pages confirmées qui correspondent encore.

Quels limites dois-je comprendre ?

La détection de pages blanches est une heuristique visuelle, pas une certitude. Les traits légers de crayon, les filigranes pâles, les petites marques, la transparence, les arrière-plans inhabituels ou les différences de rendu peuvent provoquer des candidats à la suppression erronés, tandis que la poussière, les ombres, les marques de rognage et le bruit peuvent faire subsister une page par ailleurs blanche.

Comment devrais-je vérifier le résultat ?

Comparez le PDF téléchargé page par page avec la source inchangée à un niveau de zoom élevé, vérifiez que chaque espace correspond bien à une page source réellement blanche, recherchez un contenu attendu faible, et conservez l'original car une page supprimée ne peut pas être récupérée à partir du fichier de sortie.

Outils associés