Comparer deux fichiers
Identiques ou non, à l’octet près — et pour du texte, les lignes qui ont changé.
Traité sur cet appareil · aucun envoi de fichier
Vous pouvez aussi coller (Ctrl+V)Confortable jusqu’à plusieurs gigaoctets : les fichiers sont lus par tranches
72 ko à télécharger la première fois, puis conservé sur cet appareil.détails
Moteur : hash-wasm · SHA-256, SHA-1, MD5, CRC32 et BLAKE3 ; seuls les algorithmes utilisés sont chargés.
À quoi sert cette page
Deux copies d’une sauvegarde dont on ne sait plus laquelle est à jour, un fichier téléchargé deux fois depuis deux miroirs, une version « définitive » et une version « définitive (2) » : la question est toujours la même — est-ce exactement le même fichier ? Comparer les tailles ne suffit pas, comparer les dates encore moins. Cette page lit les deux fichiers par tranches, dit s’ils sont identiques à l’octet près, et si non à partir de quel octet ils divergent. Pour deux fichiers texte, elle montre en plus les lignes qui ont changé.
On dit aussi : vérifier que deux fichiers sont identiques.
Comment faire
- Déposez les deux fichiers à comparer.
- Lancez la comparaison — la lecture se fait par tranches, sans limite de taille.
- Lisez le verdict, et téléchargez le rapport détaillé.
Questions fréquentes
Que dit exactement le verdict « identiques » ?
Que les deux fichiers ont la même taille et exactement les mêmes octets, du premier au dernier. C’est l’affirmation la plus forte qu’on puisse faire sur deux fichiers : ils sont interchangeables, quel que soit le logiciel qui les ouvre. Leurs noms, leurs dates et leurs emplacements peuvent différer sans que cela change quoi que ce soit.
Deux fichiers différents veulent-ils dire un contenu différent ?
Non, et c’est la nuance importante. Réenregistrer un document sans y toucher suffit à changer des octets : une date de modification interne, un identifiant de session, l’ordre d’écriture des objets. Deux PDF visuellement identiques peuvent donc être déclarés différents à juste titre. Quand la question porte sur le texte d’un document plutôt que sur ses octets, c’est « comparer deux PDF » qui répond.
À quoi sert la position de la première divergence ?
À diagnostiquer. Une divergence à l’octet 0 signale deux fichiers sans rapport ou deux formats différents. Une divergence très tardive, avec un fichier plus court que l’autre, signale un téléchargement interrompu — l’un est le début de l’autre, ce que le rapport dit explicitement. Une divergence isolée au milieu, sur des fichiers de même taille, ressemble à une corruption de disque.
Pourquoi calculer aussi les empreintes ?
Parce qu’elles se recopient. Le verdict est vrai ici et maintenant, mais quand il faut écrire à quelqu’un « mon fichier fait 4f3c… et le tien ? », c’est l’empreinte qu’on colle. Elle est calculée dans le même parcours que la comparaison : la lire ne coûte donc rien de plus que le temps déjà passé à lire les deux fichiers.
Bon à savoir
- Le verdict porte sur le contenu, octet pour octet. Deux enregistrements du même document par le même logiciel donnent déjà deux fichiers différents — une date interne, un identifiant — sans qu’une virgule ait bougé.
- Exactement deux fichiers : au-delà, la question « lequel avec lequel » n’a pas de réponse unique, et c’est « trouver les fichiers en double » qui répond.
- Le même fichier déposé deux fois est refusé. Deux copies du même contenu sous deux noms différents, en revanche, sont une vraie question — et la réponse est alors « identiques, octet pour octet ».
- La comparaison ligne à ligne n’est proposée que si les deux fichiers sont réellement du texte, et seulement jusqu’à 50 Mo : au-delà, il faudrait les charger entièrement en mémoire. Le verdict d’octets, lui, n’a aucune limite de taille.
- Au-delà de 4 000 lignes par fichier, les lignes changées sont listées sans être alignées : un bloc déplacé apparaît alors comme une suppression suivie d’un ajout.