En quoi consiste cet outil ?
Un outil de comparaison de PDF prend deux versions d'un document (par exemple, un contrat avant et après relecture, ou deux brouillons d'un rapport) et vous montre les différences entre eux sans que vous ayez à les lire côte à côte, ligne par ligne.
Cet outil fonctionne par comparaison du contenu textuel : il utilise pdf.js pour extraire le texte de chaque page des deux PDF (selon la spécification ISO 32000 du format PDF, chaque page stocke son texte sous forme de fragments positionnés, que pdf.js restitue dans l'ordre de lecture), puis effectue une comparaison mot par mot entre le texte des pages correspondantes. Il vous indique précisément quels mots ont été ajoutés ou supprimés.
Il est important de préciser ce que cet outil détecte et ce qu'il ne détecte pas : il s'agit d'une comparaison du contenu textuel, et non d'une comparaison visuelle au pixel près. Il repère de façon fiable les changements de formulation, les phrases ajoutées ou supprimées, et les paragraphes remaniés. Il ne détecte pas les changements purement visuels ou liés à la mise en page : un changement de police, une couleur modifiée, une image déplacée, ou une page réorganisée conservant exactement les mêmes mots. Si vous devez confirmer qu'un document est identique pixel par pixel à un autre, cet outil n'est pas le bon ; si vous devez savoir si le texte a changé, c'est celui qu'il vous faut.
Pourquoi l'utiliser ?
- Repérez les changements en un coup d'œil : le texte ajouté et supprimé est mis en évidence par couleur sur chaque page, plutôt que de comparer deux documents à l'œil nu.
- Résumé du nombre de pages en un coup d'œil : combien de pages dans le fichier A, combien dans le fichier B, et combien de pages diffèrent réellement.
- Gère les PDF ayant un nombre de pages différent : les pages présentes uniquement dans un fichier sont signalées plutôt qu'ignorées silencieusement.
- Confidentiel par conception : contrats, brouillons et autres documents sensibles ne quittent jamais votre appareil, puisque l'extraction et la comparaison se déroulent toutes deux dans l'onglet de votre navigateur.
- Gratuit, sans limite de pages hormis ce que votre navigateur peut gérer, et sans création de compte requise.
Mode d'emploi
- Cliquez ou glissez le fichier A (le PDF original) dans la première zone de dépôt.
- Cliquez ou glissez le fichier B (le PDF modifié) dans la deuxième zone de dépôt.
- Cliquez sur « Comparer les PDF » et patientez pendant que le texte de chaque page est extrait puis comparé.
- Consultez la ligne de résumé pour connaître le nombre de pages et combien d'entre elles diffèrent.
- Parcourez les résultats page par page : les surbrillances vertes indiquent le texte ajouté dans le fichier B, le texte barré en rouge indique le texte supprimé du fichier A, et les pages sans surbrillance sont inchangées.
Exemple
Entrée
contrat-v1.pdf (3 pages) et contrat-v2.pdf (3 pages), où une clause de la troisième page a été reformuléeRésultat
Résumé : « Fichier A : 3 pages, fichier B : 3 pages — 1 page diffère », la page 3 affichant l'ancienne clause barrée en rouge et la nouvelle formulation surlignée en vertLes pages 1 et 2 apparaissent comme identiques, vous pouvez donc aller directement à la seule page qui a réellement changé.
Quand utiliser le Comparateur de PDF plutôt que le Comparateur de Texte
Les deux outils finissent par exécuter le même type de comparaison mot par mot, mais partent d'entrées différentes. Utilisez le Comparateur de PDF lorsque vous disposez de deux véritables fichiers PDF (un contrat, une facture, un rapport) et que vous voulez que l'outil ouvre les deux, en extraie le texte de chaque page, et fasse correspondre les pages automatiquement.
Utilisez plutôt l'outil Comparateur de Texte lorsque vous disposez déjà du contenu sous forme de texte : par exemple, vous avez copié-collé une clause depuis un PDF, ou vous comparez deux versions d'un fichier de configuration, d'un script, ou du brouillon d'un e-mail. C'est plus rapide dans ce cas, puisqu'il n'y a aucune analyse de PDF à effectuer, et cela fonctionne avec n'importe quel texte collé, pas seulement des pages extraites d'un PDF.
Cas d'usage courants
- Vérifier ce qui a réellement changé entre deux révisions d'un contrat ou d'un accord juridique avant de le signer.
- Examiner les modifications entre le brouillon et la version finale d'un rapport, d'une proposition ou d'un article académique.
- Confirmer qu'une facture ou un bon de commande correspond à une version antérieure après qu'un fournisseur a envoyé une révision.
- Repérer des modifications non autorisées ou inattendues entre un document original et une copie qu'une autre personne a modifiée.
Foire aux questions
Est-ce que cet outil compare la mise en page visuelle exacte des PDF, ou seulement le texte ?
Uniquement le contenu textuel de chaque page. Il extrait le texte que pdf.js peut lire sur chaque page et le compare mot par mot. Il ne signalera pas un changement purement visuel (une police différente, un titre recoloré, une image déplacée) si les mots sous-jacents restent identiques. Pour une comparaison visuelle au pixel près, il faudrait convertir les deux PDF en images et comparer les pixels, ce que cet outil léger basé sur le navigateur ne fait pas.
Que se passe-t-il si les deux PDF n'ont pas le même nombre de pages ?
Les pages sont comparées selon leur position (la page 1 de A avec la page 1 de B, et ainsi de suite). Si un fichier compte plus de pages que l'autre, les pages supplémentaires sont indiquées comme « présentes uniquement dans le fichier A » ou « présentes uniquement dans le fichier B », plutôt que d'être ignorées ou de provoquer une erreur.
Peut-il comparer des PDF scannés ou des pages composées uniquement d'images ?
Seulement si le PDF contient réellement du texte intégré : les pages scannées qui ne sont que des images sans couche de texte sous-jacente n'ont rien que pdf.js puisse extraire, ces pages apparaîtront donc vides. Faites d'abord passer le scan par un OCR pour ajouter une couche de texte si vous devez le comparer de cette façon.
Mes PDF sont-ils envoyés quelque part pour être comparés ?
Non. Les deux fichiers sont lus, leur texte extrait, et la comparaison calculée entièrement dans votre navigateur en JavaScript. Aucun fichier n'est envoyé à un serveur : il n'y a rien à envoyer.
J'ai déjà le texte des deux documents, ai-je besoin de cet outil ?
Non : si vous avez déjà extrait ou copié le texte en texte brut, utilisez directement l'outil Comparateur de Texte, puisqu'il saute l'étape d'analyse du PDF et compare le texte immédiatement. Utilisez le Comparateur de PDF lorsque vous disposez des deux fichiers PDF eux-mêmes et que vous souhaitez que l'extraction des pages soit prise en charge pour vous.