Corriger l’encodage d’un fichier

Les « é » et les « è » redeviennent des é et des è, en UTF-8 propre.

Traité sur cet appareil · aucun envoi de fichier

TXTCSVTSVSRTVTTMD+5Vous pouvez aussi coller du texte ou un fichier (Ctrl+V)Confortable jusqu’à 50 Mo

Aucun téléchargement : tout se passe dans cette page.détails

Cet outil n’utilise aucun moteur à télécharger — son code est déjà dans la page.

À quoi sert cette page

Un fichier ouvert affiche « Procédure » au lieu de « Procédure », ou une suite de losanges noirs. Ce n’est pas le contenu qui est abîmé, c’est l’encodage : le texte a été écrit dans une table de caractères et relu dans une autre. Cette page identifie la table d’origine — Windows-1252, UTF-16, UTF-8 à BOM — et réécrit le fichier en UTF-8, l’encodage que tout le monde lit aujourd’hui. Le fichier ne quitte pas votre navigateur, ce qui compte quand il s’agit d’un export comptable ou d’un fichier client.

On dit aussi : corriger l'encodage d'un fichier, accents bizarres dans un fichier, utf-8 en ansi.

Comment faire

  1. Déposez un ou plusieurs fichiers texte aux accents cassés.
  2. Cochez le BOM UTF-8 si le fichier est destiné à Excel.
  3. Lancez la correction : l’encodage détecté est affiché sous chaque résultat.

Questions fréquentes

Pourquoi mes accents s’affichent-ils comme « é » ?

Parce que le fichier est lu en UTF-8 alors qu’il a été écrit en Windows-1252, ou l’inverse. En UTF-8, un « é » occupe deux octets ; relus un par un dans l’ancienne table, ces deux octets donnent « é ». Rien n’est perdu : l’information est intacte, c’est la clé de lecture qui manque, et c’est exactement ce que cet outil rétablit.

Quels encodages l’outil sait-il reconnaître ?

UTF-8 avec ou sans BOM, UTF-16 petit et gros boutiste, et Windows-1252 (très proche de Latin-1 / ISO-8859-1). Ces trois familles couvrent la quasi-totalité des fichiers texte francophones. Un texte japonais ou chinois en Shift-JIS ou GB18030 n’est pas deviné : l’outil préfère ne rien promettre plutôt que de rendre du charabia.

Faut-il cocher le BOM UTF-8 ?

Uniquement si le fichier est destiné à Excel, qui ouvre un CSV en encodage local tant qu’il ne trouve pas cette signature de trois octets. Pour un fichier lu par un éditeur de texte, un script ou un site web, laissez la case décochée : le BOM y est au mieux inutile, au pire il apparaît comme un caractère parasite en première ligne.

Et si mon fichier était déjà correct ?

L’outil vous le dit — « déjà en UTF-8 » — et vous rend une copie identique au lieu de prétendre avoir réparé quelque chose. C’est aussi une manière rapide de vérifier l’encodage réel d’un fichier avant de chercher le problème ailleurs.

Pourquoi mon PDF ou mon fichier Word est-il refusé ?

Parce que ce sont des fichiers binaires : leur texte est enfermé dans une structure interne, et changer leur encodage octet par octet les casserait. Ces extensions sont écartées dès le dépôt ; et si l’extension ment, l’outil repère les octets nuls caractéristiques du binaire et s’arrête avec un message, plutôt que de rendre un fichier illisible.

Bon à savoir

  • Trois familles d’encodage sont reconnues : UTF-8 (avec ou sans BOM), UTF-16 LE et BE, Windows-1252 / Latin-1. C’est ce qui couvre les fichiers texte français mal encodés.
  • Les encodages asiatiques (Shift-JIS, GB18030, Big5) ne sont pas devinés : produire du texte faux serait pire que refuser.
  • Un fichier contenant des octets nuls est refusé : c’est du binaire, et le « réparer » n’aurait aucun sens.
  • Sans BOM, la détection est une déduction fondée sur les octets, pas une certitude — l’outil affiche l’encodage qu’il a retenu pour que vous puissiez le contredire.
  • Le fichier d’origine n’est jamais modifié : vous téléchargez une copie en UTF-8, suffixée.

Outils liés