Traduttore CSV
Cataloghi di prodotti, esportazioni e set di dati tradotti colonna per colonna, con delimitatori, virgolette e colonne identificative lasciate esattamente come il tuo parser si aspetta di trovarle.
Carica o trascina il documento da tradurre
Dimensione massima file 1 GB
La struttura è sorretta da due caratteri
I valori separati da virgola sono a malapena un formato. Esiste una descrizione ampiamente seguita del dialetto comune, ma nessuna autorità la impone, quindi ciò che ricevi effettivamente è una di diverse convenzioni. L'intera griglia poggia su due decisioni: quale carattere separa i campi in un record e quale sequenza termina un record. Sbaglia una delle due e una tabella ordinata diventa un'unica colonna irregolare.
Il separatore non è sempre una virgola. Il software per fogli di calcolo nei paesi che scrivono i decimali con la virgola utilizza di default un punto e virgola, motivo per cui un'esportazione da una macchina tedesca o francese spesso rifiuta di aprirsi correttamente altrove. Anche tabulazioni e barre verticali sono di uso comune, solitamente scelti proprio perché il contenuto è pieno di virgole.
Ogni record deve avere lo stesso numero di campi dell'intestazione, perché quel conteggio è il modo in cui un parser sa quale valore appartiene a quale colonna. Nulla nei dati lo annuncia. È un invariante che o regge o smette silenziosamente di reggere a metà di una grande esportazione, momento in cui tutto ciò che segue si sposta di una colonna a sinistra e sembra plausibile.
Quattro modi in cui il testo tradotto rompe un record
Questi sono i fallimenti che non si annunciano. L'esportazione si apre ancora, il conteggio delle righe sembra ancora approssimativamente corretto e il danno si manifesta in seguito in qualunque cosa consumi i dati.
- Appare un nuovo separatore all'interno di un valore. Una descrizione del prodotto in inglese senza virgole diventa una in francese con due. Se il campo non era quotato prima, ora deve esserlo, altrimenti il parser legge un valore come tre e sposta tutte le colonne successive.
- Una virgoletta finisce all'interno di un valore quotato. All'interno di un campo racchiuso, una virgoletta doppia letterale deve essere scritta due volte per auto-escaparsi. Le lingue che quotano con segni diversi, e qualsiasi processo che converte i segni dritti in quelli tipografici, possono lasciare un carattere non escapato nel mezzo di un valore dove termina il campo prematuramente.
- Un'interruzione di riga si insinua in una cella. Un record termina a un'interruzione di riga a meno che tale interruzione di riga non si trovi tra virgolette. Il testo di marketing tradotto che acquisisce un'interruzione di paragrafo dividerà un record in due, e la seconda metà avrà il numero errato di campi.
- Un segnaposto viene tradotto. Le stringhe destinate al software contengono spesso token di sostituzione, un segno di percentuale seguito da una lettera, uno slot numerato tra parentesi graffe, una variabile con nome. Sono indirizzi per valori inseriti a runtime, non parole, e tradurne uno significa che il valore non appare mai.
Metà delle tue colonne non sono lingua
Un set di dati mescola prosa destinata agli esseri umani con chiavi destinate alle macchine, e siedono fianco a fianco senza nulla per distinguerle se non l'intestazione della colonna. Determina quali sono quali prima di iniziare, perché un identificatore tradotto è peggio di una descrizione non tradotta.
Lascia stare queste
- La riga di intestazione stessa dove le intestazioni sono nomi di campo utilizzati dal codice piuttosto che etichette mostrate a una persona
- Codici articolo, numeri di catalogo, identificatori univoci e qualsiasi cosa utilizzata come chiave per unire due set di dati
- Indirizzi web e la porzione slug di uno, poiché modificarla interrompe il collegamento e il suo posizionamento
- Valori di stato che il software confronta con un elenco fisso, come uno stato dell'ordine o un flag sì-no
- Codici di paese, lingua e valuta, che sono già abbreviazioni standardizzate
- Date scritte in ordine anno-mese-giorno, numeri e tutto ciò che verrà analizzato piuttosto che letto
Questi sono quelli che cercavi
- Titoli dei prodotti e descrizioni lunghe, che di solito costituiscono la maggior parte del conteggio delle parole
- Nomi di categorie e collezioni come li vedono i clienti
- Valori degli attributi con significato, come un colore, un materiale o una parola che indica la dimensione
- Stringhe dell'interfaccia estratte per la localizzazione, meno i loro segnaposto
- Corpi degli articoli di supporto, risposte predefinite e modelli di email conservati come righe
- Intestazioni di colonna in cui l'esportazione è destinata ad essere aperta da una persona piuttosto che da un programma
Due cose che danneggiano i dati prima ancora che inizi la traduzione
Aprirlo in un foglio di calcolo
Fare doppio clic su un'esportazione e salvarla di nuovo è il modo più affidabile per corrompere un catalogo. Il software per fogli di calcolo indovina il tipo di ogni valore che vede, e le sue congetture sono sicure e sbagliate:
- Un numero di articolo di tredici cifre si trasforma in notazione scientifica e perde le sue ultime cifre per sempre
- Un codice postale che inizia con uno zero perde lo zero
- Qualsiasi cosa che assomigli a un giorno e un mese viene riscritta come una data nel formato locale
- Identificatori lunghi oltre quindici cifre vengono arrotondati, silenziosamente
Se devi ispezionare prima i dati, usa la finestra di dialogo di importazione e imposta le colonne identificative su testo anziché lasciare che sia il programma a decidere. Meglio ancora, carica l'esportazione esattamente come l'ha prodotta il tuo sistema.
La questione del byte order mark
Nulla all'interno dei dati indica quale codifica di caratteri utilizza, quindi un marcatore di tre byte viene talvolta posizionato all'inizio per segnalarne una. Quel marcatore aiuta e ostacola a seconda di cosa apre i dati successivamente.
Il software per fogli di calcolo su Windows lo utilizza per riconoscere il contenuto Unicode e, senza di esso, i caratteri accentati e non latini vengono visualizzati come stringhe di simboli. Molte librerie di programmazione, al contrario, non lo rimuovono, quindi l'intestazione della prima colonna arriva con tre caratteri invisibili incollati davanti e ogni ricerca su quell'intestazione fallisce.
Decidi in base alla destinazione: mantieni il marcatore se una persona aprirà il risultato in un foglio di calcolo, rimuovilo se un programma lo leggerà. La risposta a quasi ogni domanda sui caratteri accentati corrotti si trova in questo paragrafo.
Quanto costa elaborare un set di dati
Prezzo per volume di testo, quindi un catalogo ampio con valori brevi è più economico di uno stretto pieno di lunghe descrizioni.
Free
Non è richiesta carta di credito per l'iscrizione
- Traduzione AI a $0,005/parola
- $1 per pagina per scansioni e PDF immagine
- 120+ lingue
- File fino a 20 MB e 20 pagine
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG e CSV
- Solo archiviazione file di 24 ore
- Editor PDF e convertitore da PDF a DOCX
- Annulla in qualsiasi momento
- Non incluso: Supporto via email
- Non incluso: Accesso al team
- Non incluso: Anteprime PDF illimitate gratuite
- Non incluso: Glossario
Storage
o $149/anno
- Traduzione AI a $0,005/parola
- $1 per pagina per scansioni e PDF immagine
- 120+ lingue
- File fino a 100 MB e 100 pagine
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG e CSV
- Archiviazione illimitata di file
- Editor PDF e convertitore da PDF a DOCX
- Supporto via email
- Annulla in qualsiasi momento
- Non incluso: Accesso al team
- Non incluso: Anteprime PDF illimitate gratuite
- Non incluso: Glossario
Pro
o $499/anno
- Traduzione AI $0,004/parola
- $0,80 per pagina per scansioni e PDF immagine
- 120+ lingue
- File fino a 1.000 MB e 5.000 pagine
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG e CSV
- Archiviazione illimitata di file
- Editor PDF e convertitore da PDF a DOCX
- Supporto via email
- Accesso al team per un massimo di 5 membri
- Anteprime PDF illimitate gratuite
- Glossario
- Annulla in qualsiasi momento
Enterprise
$149,99/mese, su richiesta. Traduzione AI a $0,003/parola ($0,60 per pagina), file fino a 1.000 MB e 5.000 pagine, archiviazione file illimitata e accesso al team per un massimo di 15 membri.
Righe in entrata, righe in uscita
Ingrandisci un'anteprima per confrontare una pagina di origine con il suo risultato. Ciò che le coppie dimostrano:
- Il numero di colonne per record rimane invariato dall'alto verso il basso.
- I valori che erano racchiusi tra virgolette sono ancora racchiusi.
- Codici, chiavi e valori numerici passano intatti.
- Solo le colonne leggibili dall'uomo tornano in una nuova lingua.




Nulla qui è stato aperto in un foglio di calcolo tra i due stati.
Vedi tutti gli esempi di traduzione →Un ordine di lavoro che evita rilavorazioni
La localizzazione di un catalogo è una pipeline e gli errori costosi si verificano sempre alle sue estremità piuttosto che al centro.
- 1
Esporta in modo pulito e annota il dialetto
Prendi l'esportazione direttamente dal sistema proprietario dei dati. Aprila una volta in un editor di testo semplice, non in un foglio di calcolo, e annota quale carattere separa i campi e se i valori sono racchiusi tra virgolette.
- 2
Segna le colonne che non vuoi vengano modificate
Identificatori, chiavi, link, valori di stato e codici. Se l'esportazione è molto ampia, è spesso più veloce tagliarla alle colonne che contengono testo e ricongiungerla in seguito tramite la chiave.
- 3
Carica e scegli le tue lingue
Crea un account con un indirizzo email, carica i dati e imposta origine e destinazione. Gli upload arrivano fino a 1 GB, quindi un catalogo completo viene elaborato come un unico lavoro anziché essere suddiviso in lotti.
- 4
Reimporta prima in una copia di staging
Carica il risultato in un ambiente di test prima della produzione. Verifica il numero di record rispetto all'originale, esamina i valori tradotti più lunghi per problemi di layout e conferma che i caratteri accentati siano sopravvissuti al trasferimento.
Domande da persone con set di dati
Il delimitatore cambia se traduco in una lingua che usa virgole decimali?
Il separatore che hai caricato è il separatore che ottieni indietro. Cambiarlo significherebbe riscrivere la struttura piuttosto che il contenuto, e interromperebbe qualsiasi cosa che elabora i dati all'altra estremità. Se hai specificamente bisogno di una versione separata da punto e virgola perché il risultato verrà aperto in un foglio di calcolo su una macchina configurata in quel modo, convertila dopo la traduzione con uno strumento che comprende entrambi i dialetti.
Come impedisco la traduzione di codici prodotto e identificatori?
Mantienili in colonne chiaramente identificate e, ove possibile, invia solo le colonne di testo per l'elaborazione e riuniscile in seguito sulla chiave. I valori che sono ovviamente codici piuttosto che parole vengono lasciati così come sono, ma la disposizione più sicura è quella in cui l'ambiguità non si presenta mai. Non lasciare mai che un foglio di calcolo tocchi quelle colonne nel frattempo, perché le riformatterà indipendentemente da qualsiasi traduzione.
I miei caratteri accentati sono tornati come stringhe di simboli. Cosa è successo?
Si tratta di una mancata corrispondenza di codifica, non di un problema di traduzione. Il risultato è quasi certamente Unicode corretto letto da qualcosa che si aspetta una codifica legacy a singolo byte, o viceversa. Aprilo in un editor di testo che ti consente di scegliere esplicitamente la codifica e conferma ciò che hai effettivamente prima di presumere che qualcosa sia andato perso. Se la destinazione è un foglio di calcolo, il marcatore di ordine dei byte all'inizio è solitamente ciò che lo decide.
Cosa succede ai valori che contengono virgole o interruzioni di riga?
Rimangono racchiusi. Qualsiasi valore che contiene il separatore, una virgoletta o un a capo deve essere racchiuso tra virgolette, e una virgoletta letterale all'interno di tale valore deve essere raddoppiata. Poiché il testo tradotto può acquisire punteggiatura che l'originale non aveva, tale racchiusura deve essere applicata al risultato piuttosto che copiata dalla sorgente.
I segnaposto e i token variabili sopravvivranno?
Dovrebbero, ed è utile controllare un campione. Token come un segno di percentuale seguito da una lettera, uno slot numerato tra parentesi graffe o una variabile denominata sono indirizzi per valori inseriti in fase di esecuzione. Tradurne uno significa che il valore non raggiunge mai lo schermo, quindi controlla un campione delle stringhe di interfaccia più lunghe nell'output prima della spedizione.
Le mie stringhe diventano molto più lunghe in tedesco. Ha importanza qui?
Non per i dati stessi, che non hanno larghezza. Ha importanza per ciò che li visualizza. L'espansione da un quinto a un terzo rispetto all'inglese è normale per il tedesco e il russo, mentre il cinese e il giapponese di solito si contraggono. Ordina la colonna tradotta per lunghezza e guarda gli estremi rispetto al tuo layout, e controlla qualsiasi colonna del database con un limite di caratteri fisso.
Quanto grande dataset posso inviare in una volta?
Fino a 1 GB, o cinquemila pagine di contenuto equivalente, nei piani Pro ed Enterprise. Ciò copre cataloghi con centinaia di migliaia di righe. Inviare l'intera cosa come un unico lavoro è anche meglio per la coerenza, perché un termine che appare nella riga 12 e nella riga 90.000 viene gestito allo stesso modo.
Cosa mi viene addebitato per un'esportazione ampia?
Il testo, non la griglia. Celle vuote, colonne numeriche e colonne identificative non sono prosa. Ogni file viene fatturato singolarmente, poiché nessun piano include parole in bundle: mezzo centesimo per parola con Free e Storage, $0,004 con Pro e $0,003 con Enterprise, con $0,99 come limite inferiore. Ciò rende facile stimare un catalogo di grandi dimensioni da un conteggio parole.
Invia l'esportazione, mantieni la struttura
Carica i dati esattamente come li ha prodotti il tuo sistema, scegli la lingua di destinazione e ottieni una griglia con lo stesso numero di colonne in ogni record e le chiavi ancora collegabili.
I nostri partner
Servizi di traduzione correlati
Formati File
Strumenti PDF
Coppie linguistiche popolari
