Traducteur TXT
Le texte brut ne contient aucun balisage à protéger et aucun schéma à suivre, ce qui en fait la chose la plus simple à traduire et la plus facile à gâcher discrètement. Téléchargez des manuscrits, des notes, des transcriptions ou des exportations et récupérez-les avec le codage des caractères, les sauts de ligne et l'indentation intacts.
Téléchargez ou déposez le document à traduire
Taille de fichier max. 1 Go
L'extension ne promet presque rien
Chaque autre format de document contient une description de lui-même. Un document de traitement de texte nomme ses polices et déclare son jeu de caractères. Une page de balisage entoure son contenu de balises qui indiquent ce qu'est chaque partie. Le texte brut ne déclare rien de tout cela. C'est une suite d'octets avec un accord que quelqu'un les lira comme des caractères, et tout l'accord n'est pas écrit.
Trois choses doivent donc être déterminées plutôt que lues : à quel codage de caractères appartiennent les octets, quelle séquence l'auteur a utilisée pour terminer une ligne, et si les sauts de ligne sont significatifs ou simplement la largeur de la fenêtre de l'éditeur de quelqu'un. Le logiciel devine les trois à chaque fois que vous ouvrez un tel document, et il a généralement raison, ce qui explique précisément pourquoi les échecs sont surprenants lorsqu'ils surviennent.
L'avantage est réel. Il n'y a pas de style à préserver, pas de moteur de mise en page à combattre, pas d'objet intégré à perdre. Si le codage et la structure de ligne survivent, tout a survécu. Le reste de cette page concerne ces deux choses.
Ce que les gens gardent réellement en texte brut
L'extension est attachée à des choses qui ne sont pas de la prose du tout, et chacune d'elles nécessite un type de soin différent. Savoir ce que vous tenez décide si le travail prend une minute ou nécessite une préparation.
- Prose continue. Manuscrits, notes, brouillons d'articles, transcriptions d'interviews, corps d'articles extraits. C'est le cas le plus simple, et la seule chose à surveiller est de savoir si les paragraphes sont séparés par une ligne vide ou par rien du tout.
- Sous-titres et légendes. Indices numérotés, une ligne de synchronisation et une ou deux lignes de dialogue. Les synchronisations sont des coordonnées et doivent être reproduites exactement, tandis que les lignes de dialogue doivent rester suffisamment courtes pour être lues rapidement, ce qui est important car les lignes traduites sont souvent plus longues que celles qu'elles remplacent.
- Paramètres et listes de propriétés. Une clé, un séparateur et une valeur sur chaque ligne. La clé à gauche est un identifiant que le logiciel recherche par nom ; la toucher désactive silencieusement le paramètre. Seule la valeur à droite, et seulement lorsque cette valeur est un message plutôt qu'un chemin ou un interrupteur, est la langue.
- Journaux et sortie machine. Horodatages, mots de gravité, identifiants et traces de pile. La traduction d'un mot de gravité brise tout filtre qui le recherche, et une trace de pile n'est pas de la prose dans quelque langue que ce soit.
- Exportations tabulaires déguisées. Valeurs séparées par des tabulations, enregistrées avec la mauvaise extension. Si votre contenu est réellement une grille, il appartient plutôt au traducteur CSV, qui comprend les enregistrements et les colonnes.
- Notes de lecture et texte de licence. Prose avec des titres créés à partir de lettres majuscules et de lignes de tirets, des clauses numérotées et des paragraphes à retour à la ligne forcé. La structure falsifiée est la partie qui pose problème.
Trois propriétés invisibles qui décident du résultat
Aucune de ces propriétés n'est visible lorsque vous regardez le contenu à l'écran, et chacune d'elles peut transformer une bonne traduction en une traduction inutilisable.
Quel codage les octets appartiennent
Avant que Unicode ne devienne la norme, chaque région linguistique avait son propre schéma à un ou plusieurs octets : des schémas distincts pour le cyrillique, pour les accents d'Europe occidentale, pour le grec, pour le japonais, pour le chinois simplifié et traditionnel, pour le coréen. Des documents écrits selon ces schémas sont encore en circulation, et rien n'indique lequel s'applique. Ouvrez-en un avec la mauvaise hypothèse et les caractères accentués se transforment en suites de non-sens tandis que les lettres simples semblent correctes, donc les dégâts sont faciles à manquer d'un coup d'œil. Vérifiez dans un éditeur qui vous permet de choisir explicitement le codage, et rouvrez jusqu'à ce que les accents et les caractères non latins s'affichent correctement.
Comment une ligne se termine
Les outils Windows terminent une ligne avec deux caractères de contrôle, tout ce qui descend de Unix en utilise un, et les très anciens documents Macintosh utilisaient le dernier tout seul. La plupart des éditeurs modernes acceptent les trois, mais de nombreux scripts de traitement ne le font pas, et le mélange des conventions à l'intérieur d'un même document produit des marques parasites à la fin de chaque ligne ou un document qui s'affiche comme un seul paragraphe ininterrompu. Gardez une convention tout au long, et préférez celle que le système qui consommera le résultat attend.
Qu'un saut de ligne ait une signification
Un texte mis en forme manuellement à une largeur fixe comporte un saut à la fin de chaque ligne, et ces sauts sont un artefact de la largeur plutôt qu'une partie de l'écriture. Un paragraphe est normalement marqué par une ligne vide entre les blocs. Traiter chaque ligne mise en forme comme une unité découpe les phrases en fragments et les traduit hors contexte, ce qui se lit mal dans n'importe quelle langue. Conserver le paragraphe comme unité est correct, et cela signifie que la sortie sera mise en forme différemment de l'original. C'est attendu, pas un défaut.
Tout ce qui est aligné avec des espaces sera mal aligné
Pourquoi les colonnes décalent
Sans mise en forme, la seule façon d'aligner quoi que ce soit est de compter les caractères. Les tableaux dessinés avec des barres verticales et des tirets, les titres soulignés par des rangées de signes égal, les registres complétés par des espaces, les plans indentés et les boîtes faites de caractères de dessin de lignes dépendent tous du fait que chaque entrée occupe la même largeur qu'auparavant.
La traduction modifie la largeur de presque tout. L'allemand et le russe sont généralement un cinquième à un tiers plus longs que l'anglais ; le chinois et le japonais utilisent moins de caractères mais chacun occupe deux colonnes dans un affichage à largeur fixe. Dans un cas comme dans l'autre, l'alignement se déplace. Attendez-vous à devoir réajuster les tableaux dessinés à la main par la suite, et demandez-vous si le contenu nécessite plutôt une vraie feuille de calcul.
Les espaces en début de ligne sont du contenu
Dans un document de configuration, dans un extrait de code, et dans n'importe quel plan, les espaces en début de ligne ont un sens : ils indiquent l'imbrication, ou ils marquent un bloc comme littéral. Une tabulation et une série d'espaces se ressemblent à l'écran et sont des octets différents, donc un outil qui normalise l'un en l'autre modifie le document sans qu'on s'en aperçoive.
Il en va de même pour les petites séquences d'échappement écrites sous forme de barre oblique inverse et d'une lettre, qui représentent un saut de ligne ou une tabulation à l'intérieur d'une seule ligne d'une entrée de configuration. Ce sont deux caractères ordinaires qu'un programme ultérieur interprétera, et ils doivent arriver intacts de l'autre côté.
Coût pour un travail en texte brut
Facturé sur les mots du document, donc un long journal avec quelques messages uniques coûte beaucoup moins cher que sa taille ne le suggère.
Free
Aucune carte bancaire requise pour l'inscription
- Traduction IA à 0,005 $/mot
- 1 $ par page pour les scans et les PDF image
- 120+ langues
- Fichiers jusqu'à 20 Mo et 20 pages
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG et CSV
- Stockage de fichiers 24 heures seulement
- Éditeur PDF et convertisseur PDF en DOCX
- Annuler à tout moment
- Non inclus : Support par e-mail
- Non inclus : Accès équipe
- Non inclus : Aperçus PDF gratuits illimités
- Non inclus : Glossaire
Storage
ou 149 $/an
- Traduction IA à 0,005 $/mot
- 1 $ par page pour les scans et les PDF image
- 120+ langues
- Fichiers jusqu'à 100 Mo et 100 pages
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG et CSV
- Stockage illimité de fichiers
- Éditeur PDF et convertisseur PDF en DOCX
- Support par e-mail
- Annuler à tout moment
- Non inclus : Accès équipe
- Non inclus : Aperçus PDF gratuits illimités
- Non inclus : Glossaire
Pro
ou 499 $/an
- Traduction IA à 0,004 $/mot
- 0,80 $ par page pour les scans et les PDF image
- 120+ langues
- Fichiers jusqu'à 1 000 Mo et 5 000 pages
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG et CSV
- Stockage illimité de fichiers
- Éditeur PDF et convertisseur PDF en DOCX
- Support par e-mail
- Accès équipe pour jusqu'à 5 membres
- Aperçus PDF gratuits illimités
- Glossaire
- Annuler à tout moment
Entreprise
149,99 $/mois, sur demande. Traduction IA à 0,003 $/mot (0,60 $ par page), fichiers jusqu'à 1 000 Mo et 5 000 pages, stockage de fichiers illimité et accès équipe pour jusqu'à 15 membres.
Documents exemples, côte à côte
Cliquez sur une miniature pour ouvrir la vue complète. La lecture côte à côte d'une paire montre :
- Les sauts de paragraphe et les espacements des lignes vides atterrissent là où ils étaient.
- Les caractères accentués et non latins s'affichent plutôt que de se dégrader en symboles.
- L'indentation et les séquences numérotées conservent leur imbrication.
- Le résultat s'ouvre comme du texte modifiable, pas comme une image de texte.




Chaque paire provient d'un seul téléchargement sans aucune retouche manuelle après.
Voir tous les exemples de traduction →Cinq minutes de préparation, puis le téléchargement
Presque toutes les plaintes concernant la traduction de texte brut remontent à quelque chose qui était déjà vrai du document avant son téléchargement. Ces vérifications les attrapent toutes.
- 1
Vérifier que le codage se lit correctement
Ouvrez le document dans un éditeur qui affiche et vous permet de modifier le codage. Si les caractères accentués ou non latins ressemblent à des séquences de symboles sans rapport, vous le lisez avec le mauvais schéma. Corrigez cela d'abord et enregistrez une copie Unicode, car aucune traduction ne peut récupérer des caractères qui ont déjà été mal lus.
- 2
Décider ce qui est de la prose et ce qui ne l'est pas
Lorsque le contenu est constitué de configurations, de journaux ou de sous-titres, identifiez les parties qui doivent rester intactes : les clés à gauche d'un séparateur, les mots de gravité, les numéros de repère et les lignes de synchronisation. Si la majeure partie du document est du contenu machine avec un peu de prose, extraire la prose d'abord est plus rapide que de réparer le résultat.
- 3
Créer un compte et télécharger
Inscrivez-vous avec une adresse e-mail et envoyez le document. Les téléchargements uniques vont jusqu'à 1 Go, ce qui couvre les manuscrits, les archives de journaux et les exportations de journaux sans les diviser en plusieurs parties.
- 4
Définir les deux langues et traduire
Nommer la source est plus important ici que dans un document formaté, car il n'y a ni balisage ni métadonnées dont le système pourrait déduire quoi que ce soit. Choisissez ensuite la cible et lancez le travail.
- 5
Rouvrir le résultat et vérifier les trois mêmes choses
Le codage, les fins de ligne, et si quelque chose aligné à la main nécessite un réajustement. Si le document doit entrer dans un pipeline de compilation ou un lecteur multimédia, exécutez-le une fois dans ce pipeline avant de vous y fier.
Si votre contenu n'est pas vraiment du texte brut
- Traducteur CSV pour données tabulaires
- Traducteur JSON pour chaînes structurées
- Traducteur HTML pour pages balisées
- Traducteur de documents Word
- Convertir un document Word en texte
- Extraire du texte d'un PDF
- Transformer du texte en tableur
- Traducteur EPUB pour ebooks
- Traducteur de livres pour manuscrits
- Traducteur de feuilles de calcul Excel
Questions fréquentes sur le texte brut
Mon document est revenu plein de symboles étranges à la place des lettres accentuées. Pourquoi ?
C'est un problème d'encodage et cela précède presque toujours la traduction. Les octets écrits selon un ancien schéma régional, lus comme s'ils étaient de l'Unicode, produisent exactement ce schéma : les lettres simples semblent correctes tandis que les caractères accentués et non latins se transforment en séquences de symboles non liés. Ouvrez l'original dans un éditeur qui vous permet de choisir l'encodage, trouvez celui qui l'affiche correctement, enregistrez une copie Unicode et partez de là.
Mes sauts de ligne seront-ils aux mêmes endroits après ?
Les limites de paragraphe le seront. Les lignes individuelles renvoyées ne le seront pas, et ne peuvent pas l'être, car la formulation traduite occupe un nombre différent de caractères. Là où l'original était renvoyé à la main dans une largeur de colonne fixe, le résultat se brisera à des points différents. Si une largeur spécifique est importante pour la destination du document, renvoyez-la après la traduction avec l'outil qui la consomme.
Puis-je traduire un document de sous-titres de cette façon ?
Oui, et deux choses nécessitent une attention particulière. Les numéros de repère et les lignes de synchronisation sont des coordonnées plutôt que des mots et doivent être conservés exactement, et le dialogue traduit est souvent plus long que l'original, ce qui peut pousser une ligne au-delà de ce qu'un spectateur peut lire dans le temps disponible. Examinez les lignes les plus longues par rapport aux synchronisations et raccourcissez là où une indication est devenue trop dense.
Qu'en est-il d'un document de paramètres ou de propriétés ?
Seule la partie droite est linguistique, et pas tout. La clé avant le séparateur est un identifiant que le logiciel recherche par nom, donc le traduire désactive silencieusement le paramètre. Les valeurs qui sont des chemins de fichiers, des commutateurs, des nombres ou des références à d'autres clés ne sont pas non plus de la prose. Lorsqu'un document est principalement composé de clés avec quelques messages, extraire les messages d'abord est plus rapide que de vérifier tout le résultat.
Mon tableau dessiné à la main a perdu son alignement. Cela peut-il être évité ?
Pas en texte brut, car l'alignement y est fait d'espaces comptés et la traduction modifie le nombre de caractères qu'occupe une phrase. L'allemand et le russe s'étendent généralement, le chinois et le japonais se contractent en caractères tandis que chacun prend deux colonnes d'affichage. Le rembourrage ultérieur est la solution. Pour tout ce qui est véritablement tabulaire, un tableur ou une exportation séparée par des virgules est un meilleur support.
Quelle est la taille maximale d'un document que je peux téléverser ?
Un seul téléversement peut atteindre 1 Go ou cinq mille pages de contenu équivalent sur les plans Pro et Enterprise, de sorte que les manuscrits complets, les collections de transcriptions et les longs exportations sont traités en une seule fois. L'envoi dans son intégralité plutôt qu'en morceaux permet également de maintenir la cohérence de la terminologie récurrente de la première à la dernière page.
Le résultat est-il modifiable, ou une image ?
Modifiable. Ce qui revient est un document texte que vous pouvez ouvrir dans n'importe quel éditeur et continuer à travailler, avec le même contenu de caractères et la même structure que l'original. Rien n'est pixellisé et rien n'est verrouillé.
Quel est le coût pour un long document ?
La tarification suit le nombre de mots plutôt que le nombre d'octets. Chaque document est facturé individuellement à 0,005 $ par mot sur les plans Free et Storage, 0,004 $ sur Pro ou 0,003 $ sur Enterprise, avec un minimum de 0,99 $, et un abonnement ajoute du stockage et des limites plus élevées mais n'inclut aucune traduction. Ainsi, un manuscrit peut être estimé directement à partir de son nombre de mots avant de commencer.
Envoyez le document, conservez la structure
Vérifiez l'encodage, téléchargez, choisissez les langues, et récupérez un texte modifiable avec les paragraphes, l'indentation et les caractères non latins là où ils doivent être.
Nos partenaires
Services de traduction connexes
Formats de fichiers
Outils PDF
Paires de langues populaires
