Comparer deux textes

Différences surlignées ligne par ligne. Gratuit, sans upload. 1 Go max · Jusqu'à 1 Go · Traité localement, jamais envoyé sur un serveur.

Deux versions d’un même texte, et toujours la même question: qu’est-ce qui a changé. La lecture en vis-à-vis tient sur une page, pas sur un contrat de quinze pages renvoyé par la partie adverse avec « quelques ajustements mineurs ». Cet outil prend la version d’origine à gauche, la version modifiée à droite, et affiche la liste des lignes supprimées et des lignes ajoutées.

La comparaison s’appuie sur la recherche de la plus longue sous-séquence commune, calculée sur les lignes. Tout ce que les deux textes partagent reste en place, en retrait; le reste apparaît avec un signe moins pour l’original et un signe plus pour la nouvelle version. L’en-tête du résultat donne le nombre de lignes ajoutées et supprimées, et indique explicitement le cas où les deux textes sont identiques.

Les deux zones se remplissent au collage, sans import de fichier ni compte. Le calcul se déroule entièrement dans l’onglet, ce qui a une conséquence directe: il consomme la mémoire de votre machine, et une limite de taille protège le navigateur contre les comparaisons démesurées. Le bouton Comparer relance le calcul autant de fois que nécessaire.

Mode d’emploi

  1. Collez la version d’origine à gauche La zone « Texte original… » sert de référence: c’est par rapport à elle que sont calculées les suppressions affichées avec un signe moins.
  2. Collez la version modifiée à droite La zone « Texte modifié… » fournit les lignes ajoutées. Inverser les deux zones inverse le sens de lecture de tout le résultat.
  3. Découpez le texte en lignes courtes La comparaison porte sur des lignes entières: un bloc collé d’un seul tenant ressortira intégralement supprimé puis intégralement ajouté, sans indication utile.
  4. Pressez « Comparer » Le résultat s’affiche sous les deux zones, dans un cadre défilant, avec en titre le décompte des lignes ajoutées et supprimées.
  5. Parcourez les blocs colorés Les lignes communes sont simplement décalées, les supprimées et les ajoutées mises en couleur. Une ligne modifiée apparaît deux fois, une fois de chaque côté.

L’algorithme employé

Les deux textes sont découpés sur les retours à la ligne, puis la page calcule leur plus longue sous-séquence commune par programmation dynamique: un tableau d’entiers de taille (n+1) sur (m+1) est rempli depuis la fin, chaque case retenant la longueur de la plus longue suite de lignes communes restant à parcourir. Le chemin est ensuite reparcouru depuis le début pour produire la suite des opérations.

Le coût est proportionnel au produit des deux nombres de lignes, en temps comme en mémoire. Une garde refuse la comparaison lorsque ce produit dépasse quatre millions, avec le message « Textes trop longs pour la comparaison ligne à ligne ». La limite porte sur le produit: deux mille lignes contre deux mille passent, cinq cents contre huit mille aussi, et le tableau occupe alors une quinzaine de mégaoctets. À égalité entre les deux directions, la suppression est émise avant l’ajout: une ligne modifiée apparaît donc comme une ligne retirée suivie de celle qui la remplace.

La granularité: la ligne, pas le mot

Deux lignes ne sont réputées identiques que si leurs chaînes le sont strictement. Une virgule, une majuscule ou une espace en fin de ligne suffisent à faire diverger la ligne entière. Il n’existe ni surlignage du mot modifié à l’intérieur de la ligne, ni option pour ignorer la casse ou les espaces.

La préparation du texte est donc décisive. Un contrat collé en trois énormes paragraphes donne trois lignes et un résultat sans intérêt; le même contrat à raison d’un article par ligne donne une comparaison lisible où seules les clauses touchées ressortent. Ajouter un retour à la ligne après chaque point avant de coller change tout. Un découpage mot à mot, à l’inverse, fait gonfler le tableau très vite.

Les différences que l’œil ne voit pas

La surprise la plus fréquente: tout est signalé comme modifié alors que les deux textes paraissent identiques à l’écran. La cause est presque toujours un caractère invisible. Le découpage se fait sur le saut de ligne seul: un texte enregistré sous Windows garde un retour chariot en fin de chaque ligne et, comparé au même texte en fins de ligne Unix, diverge partout.

Même effet avec une espace insécable posée par un traitement de texte devant un deux-points, une apostrophe courbe opposée à une apostrophe droite, ou une espace traînant en fin de ligne. Le texte extrait d’un PDF ajoute ses pièges: césures conservées, ligatures, retours à la ligne qui suivent la mise en page au lieu des phrases. En cas de doute, faites transiter les deux versions par un éditeur brut.

Les usages où cet outil convient, et les autres

Il rend service sur un contrat revenu amendé, sur deux états d’un mémoire avant et après relecture du directeur, sur un modèle de courrier retouché par un collègue, ou pour vérifier qu’une traduction suit la dernière révision de sa source.

Il convient moins ailleurs. Pour un document Word, la fonction de comparaison du traitement de texte lit la structure du fichier et les marques de révision, que le copier-coller détruit. Pour du code sous gestion de versions, un diff dédié affiche le contexte et l’historique. Pour deux PDF, il faut d’abord en extraire le texte. Cet outil ne fusionne pas non plus: il montre les écarts sans produire de version consolidée.

Questions fréquentes

Pourquoi tout mon texte ressort-il supprimé puis réajouté ?

Parce qu’il ne contient aucun retour à la ligne et forme donc une seule ligne, jugée différente en bloc. Insérez un saut de ligne après chaque phrase ou chaque article, dans les deux zones, et relancez la comparaison.

Une ligne où j’ai changé un seul mot s’affiche deux fois.

C’est le fonctionnement attendu: la comparaison ne descend pas sous la ligne. Vous voyez l’ancienne version marquée d’un moins, puis la nouvelle marquée d’un plus, à vous de repérer le mot qui diffère.

Le message « Textes trop longs » apparaît, que faire ?

Le produit du nombre de lignes des deux textes dépasse quatre millions. Comparez chapitre par chapitre ou partie par partie: deux blocs de mille lignes passent sans difficulté.

Les deux textes semblent identiques et pourtant tout est signalé.

Cherchez les caractères invisibles: retours chariot d’un fichier Windows, espaces insécables issues d’un traitement de texte, apostrophes typographiques, espaces en fin de ligne. Un passage par un éditeur brut les neutralise.

Peut-on ignorer la casse ou la ponctuation ?

Aucune option ne le permet, la comparaison est strictement littérale. Si la casse seule vous importe peu, passez les deux textes en minuscules avec le convertisseur de casse du site avant de les coller ici.

Le résultat peut-il être téléchargé ?

Il n’y a pas de bouton d’export: le rapport s’affiche dans un cadre défilant que vous pouvez sélectionner et copier. L’entrée déposée dans l’historique local ne retient que le nombre de lignes ajoutées et supprimées, jamais leur contenu.

Mes deux textes sont-ils envoyés sur un serveur pour être comparés ?

Non, la comparaison se déroule entièrement dans l’onglet: la plus longue sous-séquence commune est calculée par le JavaScript de la page, sur les lignes des deux zones, sans qu’aucun caractère ne soit transmis. Rien n’est conservé non plus: l’entrée déposée dans l’historique local ne retient que le nombre de lignes ajoutées et supprimées, jamais leur contenu, et recharger la page vide les deux zones. La contrepartie de ce calcul local est qu’il mobilise la mémoire de votre machine, d’où le garde-fou qui refuse les couples de textes trop volumineux.

Comment comparer deux versions d’un contrat Word ou PDF confidentiel ?

Il n’y a pas d’import de fichier, donc rien à téléverser: ouvrez vos deux versions dans votre logiciel habituel, copiez le texte et collez-le, l’original à gauche et la version modifiée à droite. Anticipez ce que le collage laisse en route: la mise en forme, les commentaires et les marques de révision disparaissent, et un PDF ajoute souvent un retour à la ligne à chaque ligne imprimée, ce qui fait ressortir en différence des phrases pourtant identiques. Pour deux fichiers .docx, la fonction Comparer de Word reste plus fine; cet outil se justifie quand les deux versions viennent de sources différentes — un courriel, un PDF, une page web — ou quand vous n’avez pas de traitement de texte sous la main.

Faut-il installer un logiciel ou créer un compte pour comparer deux textes ?

Non: la page fonctionne au collage, sans compte, sans inscription et sans quota, le bouton Comparer pouvant être relancé autant de fois que nécessaire. Aucun composant supplémentaire n’est téléchargé pour cet outil, contrairement aux convertisseurs du site qui vont chercher une bibliothèque au premier clic: une fois la page affichée, la comparaison ne déclenche plus la moindre requête. Un détail à connaître avant de coller: inverser les deux zones inverse le sens de lecture du résultat, les suppressions devenant des ajouts.

Outils similaires

Découvrir d’autres outils

Catégories