IA · Plus de 120 langues

Traducteur CSV

Catalogues de produits, exportations et ensembles de données traduits colonne par colonne, avec les délimiteurs, les guillemets et les colonnes d'identifiants laissés exactement comme votre analyseur s'attend à les trouver.

Taille de fichier max. 1 Go Conserve la mise en forme d'origine
Inscrivez-vous gratuitement

Téléchargez ou déposez le document à traduire

Taille de fichier max. 1 Go

.PDF .DOCX .PPTX .XLSX .TXT .JPG .PNG .IDML .EPUB .HTML
Afrikaans (Afrikaans)
Shqip (Albanian)
አማርኛ (Amharique)
العربية (Arabic)
Հայերեն (Arménien)
Azərbaycan dili (Azerbaïdjanais)
Euskara (Basque)
Беларуская (Biélorusse)
বাংলা (Bengali)
Bosanski (Bosnian)
Български (Bulgarian)
မြန်မာဘာသာ (Birman)
Català (Catalan)
Cebuano (Cebuano)
Chichewa (Chichewa)
中文 简体 (Chinois simplifié)
中文 繁體 (Chinois traditionnel)
Corsu (Corse)
Hrvatski (Croatian)
Čeština (Czech)
Dansk (Danish)
Nederlands (Dutch)
English (English)
Esperanto (Esperanto)
Eesti (Estonian)
Suomi (Finnish)
Français (French)
Frysk (Frison)
Galego (Galicien)
ქართული (Géorgien)
Deutsch (German)
Ελληνικά (Greek)
ગુજરાતી (Gujarati)
Kreyòl Ayisyen (Haïtien)
Hausa (Haoussa)
ʻŌlelo Hawaiʻi (Hawaïen)
עברית (Hebrew)
हिंदी (Hindi)
Hmoob (Hmong)
Magyar (Hungarian)
Íslenska (Islandais)
Igbo (Igbo)
Bahasa Indonesia (Indonésien)
Gaeilge (Irlandais)
Italiano (Italian)
日本語 (Japanese)
Basa Jawa (Javanese)
ಕನ್ನಡ (Kannada)
Қазақ тілі (Kazakh)
ខ្មែរ (Khmer)
Ikinyarwanda (Kinyarwanda)
한국어 (Korean)
Kurdî (Kurdish)
Кыргызча (Kirghiz)
ລາວ (Laotien)
Latina (Latin)
Latviešu (Letton)
Lietuvių (Lituanien)
Lëtzebuergesch (Luxembourgeois)
Македонски (Macédonien)
Malagasy (Malgache)
Bahasa Melayu (Malay)
മലയാളം (Malayalam)
Malti (Maltais)
Te Reo Māori (Maori)
मराठी (Marathi)
Монгол хэл (Mongol)
नेपाली (Népalais)
Norsk (Norwegian)
ଓଡ଼ିଆ (Odia)
فارسی (Persian)
Polski (Polish)
Português (Portugais)
ਪੰਜਾਬੀ (Punjabi)
Română (Romanian)
Русский (Russian)
Gagana Samoa (Samoan)
Gàidhlig (Gaélique écossais)
Српски (Serbian)
Sesotho (Sotho)
Shona (Shona)
سنڌي (Sindhi)
සිංහල (Cingalais)
Slovenčina (Slovakian)
Slovenščina (Slovenian)
Soomaali (Somali)
Español (Spanish)
Basa Sunda (Soundanais)
Kiswahili (Swahili)
Svenska (Swedish)
Tagalog (Tagalog)
Tojiki (Tadjik)
தமிழ் (Tamil)
Tatarça (Tatar)
తెలుగు (Telugu)
ไทย (Thaï)
Türkçe (Turkish)
Türkmençe (Turkmène)
Українська (Ukrainian)
اردو (Urdu)
ئۇيغۇرچە (Ouïghour)
O'zbekcha (Ouzbek)
Tiếng Việt (Vietnamese)
Cymraeg (Gallois)
isiXhosa (Xhosa)
ייִדיש (Yiddish)
Yorùbá (Yoruba)
isiZulu (Zoulou)
Afrikaans (Afrikaans)
Shqip (Albanian)
አማርኛ (Amharique)
العربية (Arabic)
Հայերեն (Arménien)
Azərbaycan dili (Azerbaïdjanais)
Euskara (Basque)
Беларуская (Biélorusse)
বাংলা (Bengali)
Bosanski (Bosnian)
Български (Bulgarian)
မြန်မာဘာသာ (Birman)
Català (Catalan)
Cebuano (Cebuano)
Chichewa (Chichewa)
中文 简体 (Chinois simplifié)
中文 繁體 (Chinois traditionnel)
Corsu (Corse)
Hrvatski (Croatian)
Čeština (Czech)
Dansk (Danish)
Nederlands (Dutch)
English (English)
Esperanto (Esperanto)
Eesti (Estonian)
Suomi (Finnish)
Français (French)
Frysk (Frison)
Galego (Galicien)
ქართული (Géorgien)
Deutsch (German)
Ελληνικά (Greek)
ગુજરાતી (Gujarati)
Kreyòl Ayisyen (Haïtien)
Hausa (Haoussa)
ʻŌlelo Hawaiʻi (Hawaïen)
עברית (Hebrew)
हिंदी (Hindi)
Hmoob (Hmong)
Magyar (Hungarian)
Íslenska (Islandais)
Igbo (Igbo)
Bahasa Indonesia (Indonésien)
Gaeilge (Irlandais)
Italiano (Italian)
日本語 (Japanese)
Basa Jawa (Javanese)
ಕನ್ನಡ (Kannada)
Қазақ тілі (Kazakh)
ខ្មែរ (Khmer)
Ikinyarwanda (Kinyarwanda)
한국어 (Korean)
Kurdî (Kurdish)
Кыргызча (Kirghiz)
ລາວ (Laotien)
Latina (Latin)
Latviešu (Letton)
Lietuvių (Lituanien)
Lëtzebuergesch (Luxembourgeois)
Македонски (Macédonien)
Malagasy (Malgache)
Bahasa Melayu (Malay)
മലയാളം (Malayalam)
Malti (Maltais)
Te Reo Māori (Maori)
मराठी (Marathi)
Монгол хэл (Mongol)
नेपाली (Népalais)
Norsk (Norwegian)
ଓଡ଼ିଆ (Odia)
فارسی (Persian)
Polski (Polish)
Português (Portugais)
ਪੰਜਾਬੀ (Punjabi)
Română (Romanian)
Русский (Russian)
Gagana Samoa (Samoan)
Gàidhlig (Gaélique écossais)
Српски (Serbian)
Sesotho (Sotho)
Shona (Shona)
سنڌي (Sindhi)
සිංහල (Cingalais)
Slovenčina (Slovakian)
Slovenščina (Slovenian)
Soomaali (Somali)
Español (Spanish)
Basa Sunda (Soundanais)
Kiswahili (Swahili)
Svenska (Swedish)
Tagalog (Tagalog)
Tojiki (Tadjik)
தமிழ் (Tamil)
Tatarça (Tatar)
తెలుగు (Telugu)
ไทย (Thaï)
Türkçe (Turkish)
Türkmençe (Turkmène)
Українська (Ukrainian)
اردو (Urdu)
ئۇيغۇرچە (Ouïghour)
O'zbekcha (Ouzbek)
Tiếng Việt (Vietnamese)
Cymraeg (Gallois)
isiXhosa (Xhosa)
ייִדיש (Yiddish)
Yorùbá (Yoruba)
isiZulu (Zoulou)
ARABE PORTUGAIS RUSSE ITALIEN CORÉEN NÉERLANDAIS POLONAIS TURC SUÉDOIS ANGLAIS ESPAGNOL FRANÇAIS ALLEMAND CHINOIS JAPONAIS HINDI BENGALI VIETNAMIEN THAÏ GREC HÉBREU ARABE PORTUGAIS RUSSE ITALIEN CORÉEN NÉERLANDAIS POLONAIS TURC SUÉDOIS ANGLAIS ESPAGNOL FRANÇAIS ALLEMAND CHINOIS JAPONAIS HINDI BENGALI VIETNAMIEN THAÏ GREC HÉBREU

La structure est soutenue par deux caractères

Les valeurs séparées par des virgules sont à peine un format. Il existe une description largement suivie du dialecte commun, mais aucune autorité ne l'applique, donc ce que vous recevez réellement est l'une des plusieurs conventions. La grille entière repose sur deux décisions : quel caractère sépare les champs d'un enregistrement, et quelle séquence termine un enregistrement. Se tromper sur l'un ou l'autre transforme une table soignée en une seule colonne irrégulière.

Le séparateur n'est pas toujours une virgule. Les tableurs dans les pays qui écrivent les décimales avec une virgule utilisent par défaut un point-virgule à la place, c'est pourquoi une exportation d'une machine allemande ou française refuse souvent de s'ouvrir proprement ailleurs. Les tabulations et les barres verticales sont toutes deux couramment utilisées, généralement choisies précisément parce que le contenu est plein de virgules.

Chaque enregistrement doit contenir le même nombre de champs que l'en-tête, car ce nombre est la façon dont un analyseur sait quelle valeur appartient à quelle colonne. Rien dans les données n'annonce cela. C'est un invariant qui soit tient, soit cesse silencieusement de tenir à mi-chemin d'une grande exportation, moment auquel tout ce qui suit décale d'une colonne vers la gauche et semble plausible.

Quatre façons dont le texte traduit casse un enregistrement

Ce sont les échecs qui ne s'annoncent pas eux-mêmes. L'exportation s'ouvre toujours, le nombre de lignes semble toujours à peu près correct, et les dégâts apparaissent plus tard dans tout ce qui consomme les données.

  1. Un nouveau séparateur apparaît à l'intérieur d'une valeur. Une description de produit anglaise sans virgules devient une description française avec deux. Si le champ n'était pas cité auparavant, il doit maintenant l'être, sinon l'analyseur lit une valeur comme trois et décale toutes les colonnes après.
  2. Un guillemet atterrit à l'intérieur d'une valeur citée. À l'intérieur d'un champ délimité, un guillemet double littéral doit être écrit deux fois pour s'échapper lui-même. Les langues qui citent avec des marques différentes, et tout processus qui convertit les marques droites en marques typographiques, peuvent laisser un caractère non échappé au milieu d'une valeur où il termine le champ prématurément.
  3. Un saut de ligne se glisse dans une cellule. Un enregistrement se termine à un saut de ligne, sauf si ce saut de ligne se trouve entre guillemets. Une copie marketing traduite qui gagne un saut de paragraphe divisera un enregistrement en deux, et la seconde moitié aura le mauvais nombre de champs.
  4. Un espace réservé est traduit. Les chaînes destinées aux logiciels contiennent souvent des jetons de substitution, un signe de pourcentage suivi d'une lettre, un emplacement numéroté entre accolades, une variable nommée. Ce sont des adresses pour les valeurs insérées à l'exécution, pas des mots, et en traduire une signifie que la valeur n'apparaît jamais.

La moitié de vos colonnes ne sont pas du langage

Un ensemble de données mélange des prose destinées aux humains avec des clés destinées aux machines, et elles sont côte à côte sans rien pour les distinguer, sauf l'en-tête de colonne. Déterminez lesquelles sont lesquelles avant de commencer, car un identifiant traduit est pire qu'une description non traduite.

Laissez ceux-ci tranquilles

  • La ligne d'en-tête elle-même où les en-têtes sont des noms de champs utilisés par le code plutôt que des étiquettes montrées à une personne
  • Codes de stock, numéros de catalogue, identifiants uniques et tout ce qui est utilisé comme clé pour joindre deux ensembles de données
  • Adresses Web et la partie slug de celles-ci, car la modifier casse le lien et son classement
  • Valeurs d'état que le logiciel compare à une liste fixe, comme un état de commande ou un indicateur oui-non
  • Codes de pays, de langue et de devise, qui sont déjà des abréviations normalisées
  • Dates écrites dans l'ordre année-mois-jour, nombres et tout ce qui sera analysé plutôt que lu

Ce sont ceux que vous vouliez

  • Titres de produits et longues descriptions, qui constituent généralement le gros du nombre de mots
  • Noms de catégories et de collections tels que les clients les voient
  • Valeurs d'attributs ayant un sens, comme une couleur, un matériau ou un mot de taille
  • Chaînes d'interface extraites pour la localisation, moins leurs espaces réservés
  • Corps d'articles d'aide, réponses types et modèles d'e-mails conservés sous forme de lignes
  • En-têtes de colonnes où l'exportation est destinée à être ouverte par une personne plutôt que par un programme

Deux choses qui endommagent les données avant même que la traduction ne commence

L'ouvrir dans une feuille de calcul

Double-cliquer sur un export et le sauvegarder à nouveau est le moyen le plus fiable de corrompre un catalogue. Les logiciels de tableur devinent le type de chaque valeur qu'ils voient, et leurs suppositions sont confiantes et erronées :

  • Un numéro d'article à treize chiffres se transforme en notation scientifique et perd ses derniers chiffres pour de bon
  • Un code postal commençant par un zéro perd son zéro
  • Tout ce qui ressemble à un jour et un mois est réécrit comme une date au format local
  • Les longs identifiants dépassant quinze chiffres sont arrondis, silencieusement

Si vous devez inspecter les données au préalable, utilisez la boîte de dialogue d'importation et définissez les colonnes d'identifiants sur texte plutôt que de laisser le programme décider. Mieux encore, téléchargez l'exportation exactement telle que votre système l'a produite.

La question de la marque d'ordre d'octets

Rien à l'intérieur des données n'indique quel encodage de caractères il utilise, donc un marqueur de trois octets est parfois placé tout au début pour en signaler un. Ce marqueur aide et nuit selon ce qui ouvre les données ensuite.

Les logiciels de tableur sous Windows l'utilisent pour reconnaître le contenu Unicode, et sans lui, les caractères accentués et non latins apparaissent comme des chaînes de symboles. De nombreuses bibliothèques de programmation, en revanche, ne le suppriment pas, de sorte que le premier en-tête de colonne arrive avec trois caractères invisibles collés devant et chaque recherche sur cet en-tête échoue.

Décidez en fonction de la destination : conservez le marqueur si une personne ouvrira le résultat dans un tableur, supprimez-le si un programme le lira. La réponse à presque toutes les questions sur les caractères accentués corrompus se trouve dans ce paragraphe.

Combien coûte le traitement d'un jeu de données

Tarification au volume de texte, donc un catalogue large avec des valeurs courtes coûte moins cher qu'un catalogue étroit rempli de longues descriptions.

Essai de 7 jours

LE PLUS POPULAIRE
2,00 $ aujourd'hui

puis 14,99 $/mois après la fin de l'essai

  • Essai d'accès complet de 7 jours
  • Limite d'essai : 10 pages ou 3 000 mots
  • Traduction IA à 0,005 $/mot
  • 120+ langues
  • PDF, DOCX, XLSX, PPTX, IDML, TXT, JPG, PNG, CSV, JSON
  • Accès équipe et glossaires personnalisés
  • Support par e-mail

Mensuel

POPULAR
14,99 $/mois

Prix régulier 29,99 $, maintenant 50 % de réduction

  • 100 pages ou 30 000 mots par mois
  • Traduction IA à 0,005 $/mot
  • 120+ langues
  • Stockage illimité de fichiers
  • PDF, DOCX, XLSX, PPTX, IDML, TXT, JPG, PNG, CSV, JSON
  • Accès équipe et glossaires personnalisés
  • Support par e-mail prioritaire
🎉 Meilleure offre : économisez 44,88 $/an

Annuel

ÉCONOMISEZ 25 %
135 $/an

~11,25 $/mois, économisez 25 % par rapport au mensuel

  • 100 pages ou 30 000 mots par mois
  • Traduction IA à 0,005 $/mot
  • 120+ langues
  • Stockage illimité de fichiers
  • PDF, DOCX, XLSX, PPTX, IDML, TXT, JPG, PNG, CSV, JSON
  • Accès équipe et glossaires personnalisés
  • Support par e-mail prioritaire

Lignes entrantes, lignes sortantes

Agrandissez une miniature pour comparer une page source avec son résultat. Ce que les paires démontrent :

  • Le nombre de colonnes par enregistrement est inchangé de haut en bas.
  • Les valeurs qui étaient entre guillemets le sont toujours.
  • Les codes, les clés et les valeurs numériques passent sans être modifiés.
  • Seules les colonnes lisibles par l'homme reviennent dans une nouvelle langue.
Données tabulaires en anglais, la sourceLes mêmes données tabulaires rendues en espagnolUn deuxième ensemble de données tabulaires en anglais, la sourceLe même deuxième ensemble de données tabulaires rendu en allemand

Rien ici n'a été ouvert dans un tableur entre les deux états.

Voir tous les exemples de traduction →

Un ordre de travail qui évite les retouches

La localisation d'un catalogue est un pipeline, et les erreurs coûteuses se produisent toutes aux extrémités plutôt qu'au milieu.

  1. 1

    Exporter proprement et noter le dialecte

    Prenez l'exportation directement du système qui détient les données. Ouvrez-la une fois dans un éditeur de texte brut, pas un tableur, et notez quel caractère sépare les champs et si les valeurs sont entourées de guillemets.

  2. 2

    Marquer les colonnes que vous ne voulez pas toucher

    Identifiants, clés, liens, valeurs de statut et codes. Si l'exportation est très large, il est souvent plus rapide de la réduire aux colonnes qui contiennent de la prose et de la joindre ensuite par la clé.

  3. 3

    Télécharger et choisir vos langues

    Créez un compte avec une adresse e-mail, déposez les données, et définissez la source et la cible. Les téléchargements vont jusqu'à 1 Go, donc un catalogue complet est traité comme une seule tâche plutôt que d'être divisé en lots.

  4. 4

    Réimporter d'abord dans une copie de staging

    Chargez le résultat dans un environnement de test avant la production. Vérifiez le nombre d'enregistrements par rapport à l'original, examinez les valeurs traduites les plus longues pour les problèmes de mise en page, et confirmez que les caractères accentués ont survécu au transfert.

FAQ sur la traduction de CSV

Questions des personnes ayant des ensembles de données

Le délimiteur change-t-il si je traduis dans une langue qui utilise des virgules décimales ?

Le séparateur que vous avez utilisé lors du téléversement est le séparateur que vous récupérez. Le changer reviendrait à réécrire la structure plutôt que le contenu, et cela casserait tout ce qui consomme les données à l'autre bout. Si vous avez spécifiquement besoin d'une version séparée par des points-virgules car le résultat sera ouvert dans une feuille de calcul sur une machine configurée de cette façon, convertissez-le après la traduction avec un outil qui comprend les deux dialectes.

Comment puis-je empêcher la traduction des codes produit et des identifiants ?

Gardez-les dans des colonnes clairement identifiées et, si possible, envoyez uniquement les colonnes de texte pour le traitement et rejoignez-les ensuite à partir de la clé. Les valeurs qui sont manifestement des codes plutôt que des mots sont laissées telles quelles, mais l'arrangement le plus sûr est celui où l'ambiguïté ne se pose jamais. Ne laissez jamais une feuille de calcul toucher ces colonnes entre-temps, car elle les reformatera quelle que soit la traduction.

Mes caractères accentués sont revenus sous forme de chaînes de symboles. Que s'est-il passé ?

C'est un problème d'incompatibilité d'encodage, pas un problème de traduction. Le résultat est très probablement un Unicode correct lu par quelque chose qui attendait un encodage hérité à une seule octet, ou vice versa. Ouvrez-le dans un éditeur de texte qui vous permet de choisir explicitement l'encodage et confirmez ce que vous avez réellement avant de supposer que quelque chose a été perdu. Si une feuille de calcul est la destination, le marqueur d'ordre des octets au début est généralement ce qui le décide.

Que deviennent les valeurs contenant des virgules ou des sauts de ligne ?

Elles restent encadrées. Toute valeur contenant le séparateur, une marque de citation ou un saut de ligne doit être entourée de guillemets, et un guillemet littéral à l'intérieur d'une telle valeur doit être doublé. Parce que le texte traduit peut acquérir une ponctuation que la source n'avait pas, cet encadrement doit être appliqué au résultat plutôt que copié de la source.

Les espaces réservés et les jetons de variable survivront-ils ?

Ils devraient, et il est utile de vérifier un échantillon. Les jetons comme un signe de pourcentage suivi d'une lettre, un emplacement numéroté entre accolades ou une variable nommée sont des adresses pour les valeurs insérées à l'exécution. En traduire un signifie que la valeur n'atteint jamais l'écran, alors analysez une poignée des chaînes d'interface les plus longues dans la sortie avant l'expédition.

Mes chaînes deviennent beaucoup plus longues en allemand. Est-ce que cela importe ici ?

Pas pour les données elles-mêmes, qui n'ont pas de largeur. Cela importe pour ce qui les affiche. Une expansion d'un cinquième à un tiers par rapport à l'anglais est normale pour l'allemand et le russe, tandis que le chinois et le japonais se contractent généralement. Triez la colonne traduite par longueur et regardez les extrêmes par rapport à votre propre mise en page, et vérifiez toute colonne de base de données avec une limite de caractères fixe.

Quelle quantité de données puis-je envoyer en une seule fois ?

Jusqu'à 1 Go, soit cinq mille pages de contenu équivalent, dans un forfait payant. Cela couvre des catalogues de centaines de milliers de lignes. Envoyer l'ensemble en une seule tâche est également préférable pour la cohérence, car un terme qui apparaît à la ligne 12 et à la ligne 90 000 est traité de la même manière.

Qu'est-ce qui est facturé sur un export large ?

Le texte, pas la grille. Les cellules vides, les colonnes numériques et les colonnes d'identifiants ne sont pas du prose. Pour commencer, 2 $ vous donnent sept jours avec 10 pages ou 3 000 mots ; l'option mensuelle est de 14,99 $ pour 100 pages ou 30 000 mots ; un an coûte 135 $. Au-delà d'une allocation, le tarif est d'un demi-centime par mot, ce qui rend un grand catalogue facile à estimer à partir d'un décompte de mots.

Envoyer l'exportation, conserver la structure

Téléchargez les données exactement comme votre système les a produites, choisissez la langue cible, et récupérez une grille avec le même nombre de colonnes dans chaque enregistrement et les clés toujours joignables.

Nos partenaires

Accenture
Bloomberg
Citrix
P&G
SAP