Basato su AI · 120+ Lingue

Traduttore CSV

Cataloghi di prodotti, esportazioni e set di dati tradotti colonna per colonna, con delimitatori, virgolette e colonne identificative lasciate esattamente come il tuo parser si aspetta di trovarle.

Dimensione massima file 1 GB Mantiene la formattazione originale
Registrati Gratis

Carica o trascina il documento da tradurre

Dimensione massima file 1 GB

.PDF .DOCX .PPTX .XLSX .TXT .JPG .PNG .IDML .EPUB .HTML
Afrikaans (Afrikaans)
Shqip (Albanian)
አማርኛ (Amarico)
العربية (Arabic)
Հայերեն (Armeno)
Azərbaycan dili (Azero)
Euskara (Basco)
Беларуская (Bielorusso)
বাংলা (Bengali)
Bosanski (Bosnian)
Български (Bulgarian)
မြန်မာဘာသာ (Birmano)
Català (Catalano)
Cebuano (Cebuano)
Chichewa (Chichewa)
中文 简体 (Cinese Semplificato)
中文 繁體 (Cinese Tradizionale)
Corsu (Corso)
Hrvatski (Croatian)
Čeština (Czech)
Dansk (Danish)
Nederlands (Dutch)
English (English)
Esperanto (Esperanto)
Eesti (Estonian)
Suomi (Finnish)
Français (French)
Frysk (Frisone)
Galego (Galiziano)
ქართული (Georgiano)
Deutsch (German)
Ελληνικά (Greek)
ગુજરાતી (Gujarati)
Kreyòl Ayisyen (Haitiano)
Hausa (Hausa)
ʻŌlelo Hawaiʻi (Hawaiano)
עברית (Hebrew)
हिंदी (Hindi)
Hmoob (Hmong)
Magyar (Hungarian)
Íslenska (Islandese)
Igbo (Igbo)
Bahasa Indonesia (Indonesiano)
Gaeilge (Irlandese)
Italiano (Italian)
日本語 (Japanese)
Basa Jawa (Javanese)
ಕನ್ನಡ (Kannada)
Қазақ тілі (Kazako)
ខ្មែរ (Khmer)
Ikinyarwanda (Kinyarwanda)
한국어 (Korean)
Kurdî (Kurdish)
Кыргызча (Kirghiso)
ລາວ (Lao)
Latina (Latino)
Latviešu (Lettone)
Lietuvių (Lituano)
Lëtzebuergesch (Lussemburghese)
Македонски (Macedone)
Malagasy (Malgascio)
Bahasa Melayu (Malay)
മലയാളം (Malayalam)
Malti (Maltese)
Te Reo Māori (Maori)
मराठी (Marathi)
Монгол хэл (Mongolo)
नेपाली (Nepalese)
Norsk (Norwegian)
ଓଡ଼ିଆ (Odia)
فارسی (Persian)
Polski (Polish)
Português (Portoghese)
ਪੰਜਾਬੀ (Punjabi)
Română (Romanian)
Русский (Russian)
Gagana Samoa (Samoano)
Gàidhlig (Scozzese)
Српски (Serbian)
Sesotho (Sesotho)
Shona (Shona)
سنڌي (Sindhi)
සිංහල (Singalese)
Slovenčina (Slovakian)
Slovenščina (Slovenian)
Soomaali (Somalo)
Español (Spanish)
Basa Sunda (Sundanese)
Kiswahili (Swahili)
Svenska (Swedish)
Tagalog (Tagalog)
Тоҷикӣ (Tagico)
தமிழ் (Tamil)
Татарча (Tatari)
తెలుగు (Telugu)
ไทย (Thai)
Türkçe (Turkish)
Türkmençe (Turkmeno)
Українська (Ukrainian)
اردو (Urdu)
ئۇيغۇرچە (Uiguro)
O'zbekcha (Uzbeko)
Tiếng Việt (Vietnamese)
Cymraeg (Gallese)
isiXhosa (Xhosa)
ייִדיש (Yiddish)
Yorùbá (Yoruba)
isiZulu (Zulu)
Afrikaans (Afrikaans)
Shqip (Albanian)
አማርኛ (Amarico)
العربية (Arabic)
Հայերեն (Armeno)
Azərbaycan dili (Azero)
Euskara (Basco)
Беларуская (Bielorusso)
বাংলা (Bengali)
Bosanski (Bosnian)
Български (Bulgarian)
မြန်မာဘာသာ (Birmano)
Català (Catalano)
Cebuano (Cebuano)
Chichewa (Chichewa)
中文 简体 (Cinese Semplificato)
中文 繁體 (Cinese Tradizionale)
Corsu (Corso)
Hrvatski (Croatian)
Čeština (Czech)
Dansk (Danish)
Nederlands (Dutch)
English (English)
Esperanto (Esperanto)
Eesti (Estonian)
Suomi (Finnish)
Français (French)
Frysk (Frisone)
Galego (Galiziano)
ქართული (Georgiano)
Deutsch (German)
Ελληνικά (Greek)
ગુજરાતી (Gujarati)
Kreyòl Ayisyen (Haitiano)
Hausa (Hausa)
ʻŌlelo Hawaiʻi (Hawaiano)
עברית (Hebrew)
हिंदी (Hindi)
Hmoob (Hmong)
Magyar (Hungarian)
Íslenska (Islandese)
Igbo (Igbo)
Bahasa Indonesia (Indonesiano)
Gaeilge (Irlandese)
Italiano (Italian)
日本語 (Japanese)
Basa Jawa (Javanese)
ಕನ್ನಡ (Kannada)
Қазақ тілі (Kazako)
ខ្មែរ (Khmer)
Ikinyarwanda (Kinyarwanda)
한국어 (Korean)
Kurdî (Kurdish)
Кыргызча (Kirghiso)
ລາວ (Lao)
Latina (Latino)
Latviešu (Lettone)
Lietuvių (Lituano)
Lëtzebuergesch (Lussemburghese)
Македонски (Macedone)
Malagasy (Malgascio)
Bahasa Melayu (Malay)
മലയാളം (Malayalam)
Malti (Maltese)
Te Reo Māori (Maori)
मराठी (Marathi)
Монгол хэл (Mongolo)
नेपाली (Nepalese)
Norsk (Norwegian)
ଓଡ଼ିଆ (Odia)
فارسی (Persian)
Polski (Polish)
Português (Portoghese)
ਪੰਜਾਬੀ (Punjabi)
Română (Romanian)
Русский (Russian)
Gagana Samoa (Samoano)
Gàidhlig (Scozzese)
Српски (Serbian)
Sesotho (Sesotho)
Shona (Shona)
سنڌي (Sindhi)
සිංහල (Singalese)
Slovenčina (Slovakian)
Slovenščina (Slovenian)
Soomaali (Somalo)
Español (Spanish)
Basa Sunda (Sundanese)
Kiswahili (Swahili)
Svenska (Swedish)
Tagalog (Tagalog)
Тоҷикӣ (Tagico)
தமிழ் (Tamil)
Татарча (Tatari)
తెలుగు (Telugu)
ไทย (Thai)
Türkçe (Turkish)
Türkmençe (Turkmeno)
Українська (Ukrainian)
اردو (Urdu)
ئۇيغۇرچە (Uiguro)
O'zbekcha (Uzbeko)
Tiếng Việt (Vietnamese)
Cymraeg (Gallese)
isiXhosa (Xhosa)
ייִדיש (Yiddish)
Yorùbá (Yoruba)
isiZulu (Zulu)
ARABO PORTOGHESE RUSSO ITALIANO COREANO OLANDESE POLACCO TURCO SVEDESE INGLESE SPAGNOLO FRANCESE TEDESCO CINESE GIAPPONESE HINDI BENGALI VIETNAMITA THAI GRECO EBRAICO ARABO PORTOGHESE RUSSO ITALIANO COREANO OLANDESE POLACCO TURCO SVEDESE INGLESE SPAGNOLO FRANCESE TEDESCO CINESE GIAPPONESE HINDI BENGALI VIETNAMITA THAI GRECO EBRAICO

La struttura è sorretta da due caratteri

I valori separati da virgola sono a malapena un formato. Esiste una descrizione ampiamente seguita del dialetto comune, ma nessuna autorità la impone, quindi ciò che ricevi effettivamente è una di diverse convenzioni. L'intera griglia poggia su due decisioni: quale carattere separa i campi in un record e quale sequenza termina un record. Sbaglia una delle due e una tabella ordinata diventa un'unica colonna irregolare.

Il separatore non è sempre una virgola. Il software per fogli di calcolo nei paesi che scrivono i decimali con la virgola utilizza di default un punto e virgola, motivo per cui un'esportazione da una macchina tedesca o francese spesso rifiuta di aprirsi correttamente altrove. Anche tabulazioni e barre verticali sono di uso comune, solitamente scelti proprio perché il contenuto è pieno di virgole.

Ogni record deve avere lo stesso numero di campi dell'intestazione, perché quel conteggio è il modo in cui un parser sa quale valore appartiene a quale colonna. Nulla nei dati lo annuncia. È un invariante che o regge o smette silenziosamente di reggere a metà di una grande esportazione, momento in cui tutto ciò che segue si sposta di una colonna a sinistra e sembra plausibile.

Quattro modi in cui il testo tradotto rompe un record

Questi sono i fallimenti che non si annunciano. L'esportazione si apre ancora, il conteggio delle righe sembra ancora approssimativamente corretto e il danno si manifesta in seguito in qualunque cosa consumi i dati.

  1. Appare un nuovo separatore all'interno di un valore. Una descrizione del prodotto in inglese senza virgole diventa una in francese con due. Se il campo non era quotato prima, ora deve esserlo, altrimenti il parser legge un valore come tre e sposta tutte le colonne successive.
  2. Una virgoletta finisce all'interno di un valore quotato. All'interno di un campo racchiuso, una virgoletta doppia letterale deve essere scritta due volte per auto-escaparsi. Le lingue che quotano con segni diversi, e qualsiasi processo che converte i segni dritti in quelli tipografici, possono lasciare un carattere non escapato nel mezzo di un valore dove termina il campo prematuramente.
  3. Un'interruzione di riga si insinua in una cella. Un record termina a un'interruzione di riga a meno che tale interruzione di riga non si trovi tra virgolette. Il testo di marketing tradotto che acquisisce un'interruzione di paragrafo dividerà un record in due, e la seconda metà avrà il numero errato di campi.
  4. Un segnaposto viene tradotto. Le stringhe destinate al software contengono spesso token di sostituzione, un segno di percentuale seguito da una lettera, uno slot numerato tra parentesi graffe, una variabile con nome. Sono indirizzi per valori inseriti a runtime, non parole, e tradurne uno significa che il valore non appare mai.

Metà delle tue colonne non sono lingua

Un set di dati mescola prosa destinata agli esseri umani con chiavi destinate alle macchine, e siedono fianco a fianco senza nulla per distinguerle se non l'intestazione della colonna. Determina quali sono quali prima di iniziare, perché un identificatore tradotto è peggio di una descrizione non tradotta.

Lascia stare queste

  • La riga di intestazione stessa dove le intestazioni sono nomi di campo utilizzati dal codice piuttosto che etichette mostrate a una persona
  • Codici articolo, numeri di catalogo, identificatori univoci e qualsiasi cosa utilizzata come chiave per unire due set di dati
  • Indirizzi web e la porzione slug di uno, poiché modificarla interrompe il collegamento e il suo posizionamento
  • Valori di stato che il software confronta con un elenco fisso, come uno stato dell'ordine o un flag sì-no
  • Codici di paese, lingua e valuta, che sono già abbreviazioni standardizzate
  • Date scritte in ordine anno-mese-giorno, numeri e tutto ciò che verrà analizzato piuttosto che letto

Questi sono quelli che cercavi

  • Titoli dei prodotti e descrizioni lunghe, che di solito costituiscono la maggior parte del conteggio delle parole
  • Nomi di categorie e collezioni come li vedono i clienti
  • Valori degli attributi con significato, come un colore, un materiale o una parola che indica la dimensione
  • Stringhe dell'interfaccia estratte per la localizzazione, meno i loro segnaposto
  • Corpi degli articoli di supporto, risposte predefinite e modelli di email conservati come righe
  • Intestazioni di colonna in cui l'esportazione è destinata ad essere aperta da una persona piuttosto che da un programma

Due cose che danneggiano i dati prima ancora che inizi la traduzione

Aprirlo in un foglio di calcolo

Fare doppio clic su un'esportazione e salvarla di nuovo è il modo più affidabile per corrompere un catalogo. Il software per fogli di calcolo indovina il tipo di ogni valore che vede, e le sue congetture sono sicure e sbagliate:

  • Un numero di articolo di tredici cifre si trasforma in notazione scientifica e perde le sue ultime cifre per sempre
  • Un codice postale che inizia con uno zero perde lo zero
  • Qualsiasi cosa che assomigli a un giorno e un mese viene riscritta come una data nel formato locale
  • Identificatori lunghi oltre quindici cifre vengono arrotondati, silenziosamente

Se devi ispezionare prima i dati, usa la finestra di dialogo di importazione e imposta le colonne identificative su testo anziché lasciare che sia il programma a decidere. Meglio ancora, carica l'esportazione esattamente come l'ha prodotta il tuo sistema.

La questione del byte order mark

Nulla all'interno dei dati indica quale codifica di caratteri utilizza, quindi un marcatore di tre byte viene talvolta posizionato all'inizio per segnalarne una. Quel marcatore aiuta e ostacola a seconda di cosa apre i dati successivamente.

Il software per fogli di calcolo su Windows lo utilizza per riconoscere il contenuto Unicode e, senza di esso, i caratteri accentati e non latini vengono visualizzati come stringhe di simboli. Molte librerie di programmazione, al contrario, non lo rimuovono, quindi l'intestazione della prima colonna arriva con tre caratteri invisibili incollati davanti e ogni ricerca su quell'intestazione fallisce.

Decidi in base alla destinazione: mantieni il marcatore se una persona aprirà il risultato in un foglio di calcolo, rimuovilo se un programma lo leggerà. La risposta a quasi ogni domanda sui caratteri accentati corrotti si trova in questo paragrafo.

Quanto costa elaborare un set di dati

Prezzo per volume di testo, quindi un catalogo ampio con valori brevi è più economico di uno stretto pieno di lunghe descrizioni.

Free

$0

Non è richiesta carta di credito per l'iscrizione

  • Traduzione AI a $0,005/parola
  • $1 per pagina per scansioni e PDF immagine
  • 120+ lingue
  • File fino a 20 MB e 20 pagine
  • DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG e CSV
  • Solo archiviazione file di 24 ore
  • Editor PDF e convertitore da PDF a DOCX
  • Annulla in qualsiasi momento
  • Non incluso: Supporto via email
  • Non incluso: Accesso al team
  • Non incluso: Anteprime PDF illimitate gratuite
  • Non incluso: Glossario

Storage

14,99 $/mese

o $149/anno

  • Traduzione AI a $0,005/parola
  • $1 per pagina per scansioni e PDF immagine
  • 120+ lingue
  • File fino a 100 MB e 100 pagine
  • DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG e CSV
  • Archiviazione illimitata di file
  • Editor PDF e convertitore da PDF a DOCX
  • Supporto via email
  • Annulla in qualsiasi momento
  • Non incluso: Accesso al team
  • Non incluso: Anteprime PDF illimitate gratuite
  • Non incluso: Glossario

Pro

$49,99/mese

o $499/anno

  • Traduzione AI $0,004/parola
  • $0,80 per pagina per scansioni e PDF immagine
  • 120+ lingue
  • File fino a 1.000 MB e 5.000 pagine
  • DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG e CSV
  • Archiviazione illimitata di file
  • Editor PDF e convertitore da PDF a DOCX
  • Supporto via email
  • Accesso al team per un massimo di 5 membri
  • Anteprime PDF illimitate gratuite
  • Glossario
  • Annulla in qualsiasi momento

Enterprise

$149,99/mese, su richiesta. Traduzione AI a $0,003/parola ($0,60 per pagina), file fino a 1.000 MB e 5.000 pagine, archiviazione file illimitata e accesso al team per un massimo di 15 membri.

Contatta le vendite

Righe in entrata, righe in uscita

Ingrandisci un'anteprima per confrontare una pagina di origine con il suo risultato. Ciò che le coppie dimostrano:

  • Il numero di colonne per record rimane invariato dall'alto verso il basso.
  • I valori che erano racchiusi tra virgolette sono ancora racchiusi.
  • Codici, chiavi e valori numerici passano intatti.
  • Solo le colonne leggibili dall'uomo tornano in una nuova lingua.
Dati tabulari in inglese, l'origineGli stessi dati tabulari visualizzati in spagnoloUn secondo set di dati tabulari in inglese, l'origineLo stesso secondo set di dati tabulari visualizzato in tedesco

Nulla qui è stato aperto in un foglio di calcolo tra i due stati.

Vedi tutti gli esempi di traduzione →

Un ordine di lavoro che evita rilavorazioni

La localizzazione di un catalogo è una pipeline e gli errori costosi si verificano sempre alle sue estremità piuttosto che al centro.

  1. 1

    Esporta in modo pulito e annota il dialetto

    Prendi l'esportazione direttamente dal sistema proprietario dei dati. Aprila una volta in un editor di testo semplice, non in un foglio di calcolo, e annota quale carattere separa i campi e se i valori sono racchiusi tra virgolette.

  2. 2

    Segna le colonne che non vuoi vengano modificate

    Identificatori, chiavi, link, valori di stato e codici. Se l'esportazione è molto ampia, è spesso più veloce tagliarla alle colonne che contengono testo e ricongiungerla in seguito tramite la chiave.

  3. 3

    Carica e scegli le tue lingue

    Crea un account con un indirizzo email, carica i dati e imposta origine e destinazione. Gli upload arrivano fino a 1 GB, quindi un catalogo completo viene elaborato come un unico lavoro anziché essere suddiviso in lotti.

  4. 4

    Reimporta prima in una copia di staging

    Carica il risultato in un ambiente di test prima della produzione. Verifica il numero di record rispetto all'originale, esamina i valori tradotti più lunghi per problemi di layout e conferma che i caratteri accentati siano sopravvissuti al trasferimento.

FAQ sulla traduzione di CSV

Domande da persone con set di dati

Il delimitatore cambia se traduco in una lingua che usa virgole decimali?

Il separatore che hai caricato è il separatore che ottieni indietro. Cambiarlo significherebbe riscrivere la struttura piuttosto che il contenuto, e interromperebbe qualsiasi cosa che elabora i dati all'altra estremità. Se hai specificamente bisogno di una versione separata da punto e virgola perché il risultato verrà aperto in un foglio di calcolo su una macchina configurata in quel modo, convertila dopo la traduzione con uno strumento che comprende entrambi i dialetti.

Come impedisco la traduzione di codici prodotto e identificatori?

Mantienili in colonne chiaramente identificate e, ove possibile, invia solo le colonne di testo per l'elaborazione e riuniscile in seguito sulla chiave. I valori che sono ovviamente codici piuttosto che parole vengono lasciati così come sono, ma la disposizione più sicura è quella in cui l'ambiguità non si presenta mai. Non lasciare mai che un foglio di calcolo tocchi quelle colonne nel frattempo, perché le riformatterà indipendentemente da qualsiasi traduzione.

I miei caratteri accentati sono tornati come stringhe di simboli. Cosa è successo?

Si tratta di una mancata corrispondenza di codifica, non di un problema di traduzione. Il risultato è quasi certamente Unicode corretto letto da qualcosa che si aspetta una codifica legacy a singolo byte, o viceversa. Aprilo in un editor di testo che ti consente di scegliere esplicitamente la codifica e conferma ciò che hai effettivamente prima di presumere che qualcosa sia andato perso. Se la destinazione è un foglio di calcolo, il marcatore di ordine dei byte all'inizio è solitamente ciò che lo decide.

Cosa succede ai valori che contengono virgole o interruzioni di riga?

Rimangono racchiusi. Qualsiasi valore che contiene il separatore, una virgoletta o un a capo deve essere racchiuso tra virgolette, e una virgoletta letterale all'interno di tale valore deve essere raddoppiata. Poiché il testo tradotto può acquisire punteggiatura che l'originale non aveva, tale racchiusura deve essere applicata al risultato piuttosto che copiata dalla sorgente.

I segnaposto e i token variabili sopravvivranno?

Dovrebbero, ed è utile controllare un campione. Token come un segno di percentuale seguito da una lettera, uno slot numerato tra parentesi graffe o una variabile denominata sono indirizzi per valori inseriti in fase di esecuzione. Tradurne uno significa che il valore non raggiunge mai lo schermo, quindi controlla un campione delle stringhe di interfaccia più lunghe nell'output prima della spedizione.

Le mie stringhe diventano molto più lunghe in tedesco. Ha importanza qui?

Non per i dati stessi, che non hanno larghezza. Ha importanza per ciò che li visualizza. L'espansione da un quinto a un terzo rispetto all'inglese è normale per il tedesco e il russo, mentre il cinese e il giapponese di solito si contraggono. Ordina la colonna tradotta per lunghezza e guarda gli estremi rispetto al tuo layout, e controlla qualsiasi colonna del database con un limite di caratteri fisso.

Quanto grande dataset posso inviare in una volta?

Fino a 1 GB, o cinquemila pagine di contenuto equivalente, nei piani Pro ed Enterprise. Ciò copre cataloghi con centinaia di migliaia di righe. Inviare l'intera cosa come un unico lavoro è anche meglio per la coerenza, perché un termine che appare nella riga 12 e nella riga 90.000 viene gestito allo stesso modo.

Cosa mi viene addebitato per un'esportazione ampia?

Il testo, non la griglia. Celle vuote, colonne numeriche e colonne identificative non sono prosa. Ogni file viene fatturato singolarmente, poiché nessun piano include parole in bundle: mezzo centesimo per parola con Free e Storage, $0,004 con Pro e $0,003 con Enterprise, con $0,99 come limite inferiore. Ciò rende facile stimare un catalogo di grandi dimensioni da un conteggio parole.

Invia l'esportazione, mantieni la struttura

Carica i dati esattamente come li ha prodotti il tuo sistema, scegli la lingua di destinazione e ottieni una griglia con lo stesso numero di colonne in ogni record e le chiavi ancora collegabili.

I nostri partner

Accenture
Bloomberg
Citrix
P&G
SAP