SPARKPOND / GUIDE

Comment corriger l’encodage CSV UTF-8 et Windows-1252

Le texte devient illisible lorsque les octets sont décodés avec un encodage différent de celui de la création.

Symptômes du problème

  • é apparaît comme é.
  • Les apostrophes courbes deviennent ’.
  • Des losanges ou caractères de remplacement apparaissent.

Pourquoi cela arrive

  • Des octets UTF-8 ont été lus en Windows-1252.
  • Un fichier ancien ne contient ni BOM ni déclaration.

Exemple avant et après

Avant

André,Montréal

Après

André,Montréal
Télécharger l’exemple ↓

Procédure

  1. Gardez les octets originaux intacts.
  2. Comparez les aperçus UTF-8, Windows-1252 et Latin-1.
  3. Choisissez le texte lisible avec le moins de remplacements.
  4. Exportez en UTF-8, avec BOM uniquement si nécessaire.
Corriger les caractères illisibles et l’encodage CSV →

Erreurs fréquentes

  • Ouvrir et enregistrer plusieurs fois le fichier illisible.
  • Croire la détection certaine sans BOM.

Autres solutions possibles

  • Réexportez depuis la source avec une option UTF-8 explicite.

Limites importantes

  • Les caractères déjà remplacés par des points d’interrogation ne peuvent pas être reconstruits.

Guides associés

Pourquoi un CSV s’ouvre dans une seule colonne et comment le corriger

Un CSV s’ouvre généralement dans une seule colonne lorsque son séparateur diffère de celui attendu par le tableur.

CSV virgule ou point-virgule : quel séparateur choisir ?

Les deux formats sont valides ; la compatibilité avec la destination compte davantage que l’extension.