L’essentiel : l’échec d’un import CSV est généralement causé par une corruption structurelle plutôt que par une mauvaise traduction. En utilisant un outil qui protège les ID, les handles et les balises HTML tout en imposant l’encodage UTF-8, vous éliminez les frictions techniques de la localisation massive.
Le fichier CSV semble identique à l’original. Pourtant, l’import échoue. C’est ainsi que la plupart des projets de traduction massive gâchent un week-end. C’est souvent parce que l’équipe n’a pas utilisé le meilleur logiciel de traduction de site web adapté à ses besoins techniques spécifiques.
Un import CSV corrompu ne renvoie presque jamais d’erreur claire. À la place, vous obtenez un produit Shopify sans SKU, un élément CMS Webflow avec un slug 404, ou une application SaaS où chaque label allemand est soudainement deux fois plus long que le bouton qui le contient. Les dégâts sont invisibles et vous ne les remarquez que lorsqu’un client vous le signale. Cela souligne pourquoi la traduction de site web est importante et pourquoi vous devez comprendre les avantages du SEO multilingue avant de passer à l’échelle.
J’ai vu cela arriver sur des projets réels plus de fois que je ne peux en compter. Les cinq erreurs ci-dessous sont celles qui reviennent sans cesse, et la bonne nouvelle est qu’elles sont toutes évitables avec le bon flux de travail de traduction CSV. Suivre un guide de traduction SEO pour site web et comprendre la définition du SEO multilingue vous aidera à éviter ces pièges techniques.
Translate into German and Spanish. Keep product names in English, use our glossary, and make the copy sound natural for e-commerce.
Erreur 1 : Traduire des colonnes qui doivent rester intactes
C’est la source de panne la plus courante. Cela arrive généralement quand on confie un CSV complet à ChatGPT ou DeepL en laissant le modèle décider ce qui est du “texte”, l’une des nombreuses raisons pour lesquelles les outils IA génériques échouent lors de localisations structurées.
Le piège : un ID, un handle, un SKU, une URL ou une colonne de prix est traduit en même temps que le contenu. Le fichier s’importe sans erreur, mais chaque ligne pointe désormais vers le mauvais produit, la mauvaise page ou un lien mort.
Exemples réels que j’ai rencontrés :
- Une traduction CSV Shopify où le champ
vendora été traduit de “Nike” à “Nique” en français. Tous les produits Nike ont disparu du filtre de marque du jour au lendemain. - Une traduction de contenu CMS où la colonne
sluga été traduite, brisant 400 liens internes et tous les backlinks acquis par l’entreprise. - Un projet de localisation d’application où la colonne
keya été traduite, rendant l’application incapable de charger la moindre chaîne de caractères correspondante.
Comment l’éviter : n’utilisez jamais un outil qui traduit “tout par défaut”. Avec AI Glot, vous nommez les colonnes à traduire en une simple phrase. Les ID, handles, prix, URL et SKU restent identiques à la source, octet pour octet. La structure attendue par votre CMS ou votre boutique est garantie.
Erreur 2 : Massacrer les balises HTML dans le texte traduit
C’est l’erreur la plus frustrante, car tout semble correct jusqu’à l’aperçu de la page.
Lorsqu’un outil de traduction de site web comme Weglot exporte son CSV, les cellules de contenu sont rarement en texte brut. Elles regorgent de balises inline : <wg-1>, <wg-2>, <strong>, <a href="...">. Ces balises encadrent un groupe de mots pour le style ou le lien. Le travail du traducteur n’est pas seulement de traduire les mots, mais de déplacer les balises pour qu’elles encadrent toujours l’équivalent dans la langue cible.
C’est là que DeepL, les outils d’IA génériques et même les freelances humains échouent :
- La phrase anglaise “Click
<wg-1>here</wg-1>to learn more” devient en allemand “Klicken Sie<wg-1>hier</wg-1>, um mehr zu erfahren,” mais le modèle perd la balise, l’applique au mauvais mot ou le duplique.
- Lorsqu’une expression anglaise devient deux mots allemands, ou inversement, la limite de la balise doit se déplacer. Un traducteur naïf laisse soit la balise au mauvais endroit (le mauvais mot est désormais lié), soit la supprime complètement (le lien disparaît).
J’ai personnellement vécu ce cauchemar : une phase de traduction qui semblait parfaite dans le tableur mais qui, une fois réimportée, produisait des pages où l’appel à l’action n’était plus lié, ou où le style gras tombait sur la mauvaise moitié de la phrase.
Comment l’éviter : utilisez un outil qui considère la préservation des balises comme une fonctionnalité essentielle. AI Glot est conçu pour la traduction native de CSV, il traite donc les balises inline comme des éléments structurels qui doivent encadrer l’équivalent sémantique dans la langue cible. Et si vous avez une règle ponctuelle pour un lot spécifique (comme “ne jamais couper les balises <wg-cta>”), vous pouvez l’ajouter directement via des instructions par lot avant le lancement, en complément du glossaire de marque.
Erreur 3 : La perte de l’encodage UTF-8 (alias le désastre des caractères “?”)
Si vous avez déjà ouvert un CSV traduit dans Excel et vu une série de ? ou de é là où devraient se trouver des accents français, vous avez rencontré cette erreur.
Les fichiers CSV sont sensibles à l’encodage des caractères. Lorsqu’un fichier passe d’Excel à Google Sheets, puis par une fenêtre de chat LLM et revient, l’encodage peut passer silencieusement de l’UTF-8 à un défaut régional (Windows-1252, ISO-8859-1, etc.). Une fois cela arrivé, chaque caractère accentué de vos traductions allemandes, françaises, espagnoles ou polonaises est massacré.
Comment l’éviter :
- Exportez et réimportez toujours en UTF-8 avec BOM lorsque votre plateforme le permet.
- Évitez les allers-retours via Excel pour les langues utilisant des caractères non-ASCII ; privilégiez Google Sheets ou un éditeur natif CSV.
- Utilisez une plateforme de traduction qui préserve explicitement l’UTF-8 tout au long du processus. AI Glot lit, traite et écrit en UTF-8 par défaut, donc le fichier que vous téléchargez est prêt pour l’importation.
Erreur 4 : Traduire les en-têtes de colonnes sans le vouloir
Les en-têtes sont des identifiants de champs que votre système d’importation lit pour savoir à quoi correspond chaque colonne. Si title devient titre ou body_html devient corps_html, votre CMS ne reconnaîtra pas le fichier et l’importation échouera ou, pire, placera les données dans les mauvais champs.
C’est exactement ce qui arrive quand on colle un CSV dans ChatGPT en demandant “traduis ceci en français”. Le modèle n’a aucun moyen de savoir que la ligne 1 est structurelle et que les lignes suivantes sont du contenu.
Comment l’éviter :
- Soyez explicite sur le périmètre. Indiquez à AI Glot quelles colonnes traduire et il laissera les en-têtes intacts par défaut. Demandez-lui de traduire aussi les en-têtes quand un fichier en a réellement besoin (un tableau de données public, par exemple).
- En cas de doute, passez le fichier par l’étape de révision d’abord. Voir “les en-têtes seront préservés” avant le lancement ne coûte rien et sauve l’importation.
Le tueur silencieux : le fichier semble correct et le nombre de lignes est bon, mais quelque part au milieu, une traduction a introduit une virgule, un guillemet ou un saut de ligne qui n’a pas été correctement échappé. À partir de cette ligne, chaque cellule est décalée d’une colonne vers la gauche ou la droite. Le CMS importe le fichier sans broncher et vos titres de produits se retrouvent dans la colonne des prix.
Cela arrive parce que :
- Les outils d’IA “améliorent” parfois la ponctuation lors de la traduction (en transformant
"en"ou«), ce qui brise les règles d’échappement CSV. - Les traductions peuvent naturellement introduire des virgules là où la source n’en avait pas (“Hello world” → “Bonjour, le monde”).
- Les traductions longues incluent occasionnellement des sauts de ligne que le rédacteur n’a pas remarqués.
Comment l’éviter : utilisez un outil qui gère l’échappement CSV au niveau structurel plutôt que de le traiter comme du texte brut. AI Glot génère une sortie correctement échappée (champs entre guillemets, guillemets échappés, sauts de ligne préservés dans les cellules) pour que ce que vous réimportez soit techniquement exact.
Vue d’ensemble : pourquoi le périmètre est crucial
Si vous avez lu jusqu’ici, vous avez probablement remarqué un schéma : chacune de ces erreurs provient d’un outil qui ne sait pas quelles parties de votre CSV sont du contenu et lesquelles sont de la structure. Les outils de chat IA génériques ne font pas cette distinction. Même certaines plateformes de traduction la confondent.
C’est précisément pour cela qu’AI Glot vous demande de décrire la tâche en une phrase simple avant de l’exécuter, et vous pouvez en lire davantage sur la traduction CSV :
- Une seule colonne cible : “traduire la colonne anglaise en français.” Idéal pour un fichier glossaire ou un CSV à langues appairées.
- Plusieurs colonnes de langues à la fois : “traduire la colonne anglaise dans les colonnes fr, de, es et it.” Idéal pour les tableurs avec une colonne par langue.
- Un sous-ensemble de colonnes choisi : “traduire le titre et la description, laisser tout le reste intact.” Le périmètre idéal pour Webflow CMS, Shopify, WordPress ou tout export CMS où la plupart des colonnes sont des métadonnées structurelles.
- Le fichier entier : “traduire chaque cellule et en-tête.” Réservé aux fichiers où l’intégralité du contenu est réellement traduisible (un fichier de chaînes d’application plat, par exemple).
Quoi que vous décriviez, AI Glot vous présente un plan, les langues, le périmètre, le nombre de mots et le coût avant d’utiliser un seul crédit.
Associez cela à des instructions par lot (comme “préserver ces balises” ou “ne pas traduire ce nom de marque”) et à un glossaire d’espace de travail appliqué automatiquement à toutes vos paires de langues, et les cinq erreurs ci-dessus deviennent structurellement impossibles plutôt que des pièges dont vous devez vous souvenir.
Quand les CSV sont l’outil idéal
Une petite note d’honnêteté avant de conclure. La traduction massive via CSV n’est pas la solution adaptée à toutes les situations.
- Pour un communiqué de presse, une page d’accueil ou une page produit phare, faites appel à un traducteur professionnel. Il apporte sa connaissance de la marque et du secteur, ainsi que la compétence linguistique nécessaire pour véhiculer le message dans la langue cible. Aucune IA ne pourra égaler cela pour vos contenus les plus stratégiques.
- Pour quelques paragraphes de texte occasionnels, ChatGPT ou Claude suffisent. Vous devrez configurer manuellement un glossaire et copier-coller le résultat, mais pour des tâches ponctuelles, c’est tout à fait raisonnable.
- Pour les travaux de traduction par lots, qu’il s’agisse de centaines ou de milliers de lignes de catalogue, de CMS, de blog ou de contenu d’application, c’est là qu’AI Glot intervient. Payer 1 000 € par élément pour mille éléments n’est pas un flux de travail : apprendre comment effectuer des traductions en masse en est un.
Une checklist que vous ne devriez pas avoir à mémoriser
Les cinq erreurs mentionnées plus haut représentent la vaste majorité des imports CSV corrompus que j’ai rencontrés dans des projets de localisation réels. Ce ne sont pas des cas isolés ou obscurs, elles sont prévisibles, et chacune d’elles disparaît lorsque l’outil comprend la structure du fichier qu’il traduit.
Si vous préférez ne pas mémoriser une checklist à chaque traduction de fichier, inscrivez-vous sur AI Glot et lancez un lot gratuit. Un périmètre défini en anglais simple, la protection par glossaire, des instructions par lot et une étape de révision avant même de dépenser un seul crédit. Votre ré-import vous remerciera.