Comparer des PDF

Vos PDF sont lus uniquement dans ce navigateur. Dans le parcours par étapes, ils expirent après 30 minutes et sont supprimés si la page reste ouverte ou à la prochaine ouverture de l’outil. Ils ne figurent jamais dans l’adresse et ne sont pas envoyés à notre serveur.

Comparez le texte extractible de deux versions d’un PDF sans envoyer les documents. L’outil lit chaque page avec PDF.js, normalise les espaces et surligne le texte présent uniquement dans l’ancienne version ou dans la version révisée.

Comment comparer deux PDF

  1. 1

    Choisissez le fichier précédent

    Sélectionnez le PDF A, dans la limite de 25 Mo et 200 pages.

  2. 2

    Choisissez la révision

    Sélectionnez le PDF B. Dans le parcours par étapes, les deux fichiers restent au maximum 30 minutes dans le stockage privé du navigateur.

  3. 3

    Examinez les pages modifiées

    Le navigateur extrait le texte page par page, puis marque en rouge les passages supprimés et en bleu les passages ajoutés.

Ce que la comparaison détecte

Le résultat compare le texte que PDF.js peut extraire aux mêmes numéros de page. Il convient aux contrats, rapports, épreuves et brouillons dont le libellé a changé. Les espaces sont normalisés avant la comparaison, afin de réduire les différences causées uniquement par les retours à la ligne.

Ce qui n’est pas comparé

Il ne s’agit ni d’une comparaison visuelle ni d’une analyse du sens. Les polices, la mise en page, les images, les annotations, les champs de formulaire, les métadonnées et la validité des signatures numériques ne sont pas vérifiés. Un PDF numérisé peut ne contenir aucun texte extractible s’il ne possède pas déjà une couche OCR. Une page de couverture ajoutée décale aussi les pages suivantes.

Confidentialité et limites

Les fichiers et le texte extrait restent dans votre navigateur et ne sont jamais envoyés à notre serveur. Dans le parcours par étapes, le navigateur conserve localement les deux fichiers pendant 30 minutes au maximum. Vous pouvez les effacer plus tôt. Chaque fichier est limité à 25 Mo, 200 pages et 2 000 000 de caractères extraits.

Questions fréquentes

Uniquement si le document possède déjà une couche de texte OCR. Cet outil n’effectue pas de reconnaissance OCR.

Non. Il indique seulement que le texte extractible correspond après normalisation des espaces. Les éléments visuels et la structure PDF peuvent différer.

Non. PDF.js les lit localement. Le parcours par étapes utilise le stockage privé du navigateur pendant 30 minutes au maximum, pas un stockage serveur.

Un PDF enregistre des instructions de dessin positionnées plutôt que des paragraphes. Les colonnes, tableaux et formulaires complexes peuvent donc être extraits dans un ordre inattendu.

Outils similaires