CSV-tõlkija
Tootekataloogid, ekspordid ja andmekogud tõlgitakse veergude kaupa, kusjuures eraldajad, jutumärgid ja identifikaatoriveerud jäetakse täpselt nii, nagu teie parser neid ootab.
Laadi üles või lohista dokument tõlkimiseks
Max. faili suurus 1 GB
Struktuuri toetavad kaks märki
Komaga eraldatud väärtused on vaevalt formaat. On olemas laialt levinud kirjeldus ühisest murdest, kuid ükski ametivõim seda ei jõusta, nii et see, mida te tegelikult saate, on üks mitmest konventsioonist. Kogu tabel põhineb kahel otsusel: milline märk eraldab kirje väljad ja milline jada lõpetab kirje. Kui kumbki on vale, muutub korralik tabel üheks ebajärjekindlaks veeruks.
Eraldaja ei ole alati koma. Riikides, kus kümnendkohti kirjutatakse komaga, kasutavad arvutustabeli programmid vaikimisi hoopis semikoolonit, mistõttu Saksamaa või Prantsusmaa masina eksport sageli mujal puhtalt ei avane. Vahelehed ja vertikaalribad on mõlemad tavalises kasutuses, tavaliselt valitud just seetõttu, et sisu on täis komasid.
Iga kirje peab sisaldama sama palju välju kui päis, sest see arv on see, kuidas parser teab, milline väärtus kuulub millisesse veergu. Andmetes pole midagi, mis seda teataks. See on invariant, mis kas kehtib või vaikselt lakkab kehtimast suure ekspordi keskel, mille punktis kõik allpool nihkub ühe veeru võrra vasakule ja näeb välja usutav.
Neli viisi, kuidas tõlgitud tekst kirjet rikub
Need on vead, mis ei anna endast teada. Eksport avaneb ikka, kirjete arv tundub endiselt enam-vähem õige ja kahju ilmneb hiljem ükskõik milles, mis andmeid kasutab.
- Väärtuse sees ilmub uus eraldaja. Ingliskeelne tootekirjeldus ilma komadeta muutub kahe komaga prantsuskeelseks. Kui väli polnud varem jutumärkides, peab see nüüd olema, vastasel juhul loeb parser ühe väärtuse kolmeks ja nihutab kõik sellele järgnevad veerud.
- Jutumärk satub jutumärkides oleva väärtuse sisse. Suletud välja sees tuleb sisemine jutumärk kirjutada kaks korda, et seda tühistada. Keeled, mis kasutavad jutumärke erinevate märkidena, ja mis tahes protsess, mis teisendab sirged märgid tüpograafilisteks, võivad jätta tühistamata märgi keset väärtust, kus see lõpetab välja enneaegselt.
- Reavahetus hiilib lahtrisse. Kirje lõpeb reavahetusega, välja arvatud juhul, kui see reavahetus asub jutumärkides. Tõlgitud turundustekst, millele lisandub lõigivahetus, jagab ühe kirje kaheks ja teisel poolel on vale arv välju.
- Kohatäide tõlgitakse. Tarkvarasse mõeldud stringid sisaldavad sageli asendustunnuseid, protsendimärki järgides tähte, nummerdatud pesa suletud sulgudes, nimetatud muutujat. Need on käitusajal sisestatavate väärtuste aadressid, mitte sõnad, ja nende tõlkimine tähendab, et väärtust ei kuvata kunagi.
Pool teie veerudest pole keel
Andmekogu segab inimestele mõeldud proosat masinatele mõeldud võtmetega, ja need asuvad kõrvuti, ilma et neid eristaks miski muu kui veeru pealkiri. Tehke enne alustamist kindlaks, kumb on kumb, sest tõlgitud identifikaator on halvem kui tõlkimata kirjeldus.
Jätke need rahule
- Päiserida ise, kus pealkirjad on koodi kasutatavad väljanimetused, mitte inimesele näidatavad sildid
- Laokoodid, katalooginümbrit, unikaalsed identifikaatorid ja kõik, mida kasutatakse kahe andmekogu ühendamiseks võtmena
- Veebiaadressid ja nende slug-osa, kuna selle muutmine rikub lingi ja selle positsiooni otsingumootorites
- Oleku väärtused, mida tarkvara võrdleb fikseeritud loendiga, nagu tellimuse olek või jah-ei lipp
- Riigi, keele ja valuuta koodid, mis on juba standardiseeritud lühendid
- Aasta-kuu-päev järjekorras kuupäevad, numbrid ja kõik, mida pargitakse, mitte ei loeta
Need on need, mille järele sa tulid
- Toote pealkirjad ja pikad kirjeldused, mis tavaliselt moodustavad suurema osa sõnade arvust
- Kategooria ja kollektsiooni nimed, nagu kliendid neid näevad
- Tähendusega atribuutide väärtused, nagu värv, materjal või suuruse sõna
- Lokaliseerimiseks välja võetud liidese stringid, ilma nende kohthoidjateta
- Tugartiklite tekstid, eelnevalt salvestatud vastused ja e-posti mallid, mida hoitakse ridadena
- Veerusildid, kus eksport on mõeldud avamiseks inimese, mitte programmi poolt
Kaks asja, mis kahjustavad andmeid enne, kui tõlge isegi algab
Selle avamine arvutustabelis
Ekspordi dubleerimine ja uuesti salvestamine on kõige usaldusväärsem viis kataloogi rikkumiseks. Arvutustabeli tarkvara arvab iga nähtud väärtuse tüübi kohta ja selle arvamused on enesekindlad ja valed:
- Kolmeteistkümne numbriga artiklinumber muutub teaduslikuks tähistuseks ja kaotab jäädavalt oma viimased numbrid
- Nulliga algav postiaadress kaotab nulli
- Kõik, mis meenutab päeva ja kuud, kirjutatakse ümber kohalikus formaadis kuupäevaks
- Viisteist numbrit ületavad pikad identifikaatorid ümardatakse vaikselt
Kui peate andmeid esmalt kontrollima, kasutage importimise dialoogi ja määrake identifikaatori veerud tekstiks, mitte ärge laske programmil otsustada. Parem veel, laadige eksport üles täpselt nii, nagu teie süsteem selle tootis.
Byte order mark küsimus
Andmete sees ei ole midagi, mis ütleks, millist märgistuskoode see kasutab, nii et kolme baidi märgistust kasutatakse mõnikord kõige alguses ühe signaali andmiseks. See märgistus aitab ja kahjustab sõltuvalt sellest, mis andmeid järgmisena avab.
Windowsi arvutustabeli tarkvara kasutab seda Unicode sisu äratundmiseks ja ilma selleta tulevad täpitähed ja mitte-ladina tähemärgid välja sümbolite jadadena. Paljud programmeerimisraamatukogud seevastu ei eemalda seda, nii et esimene veerusilt saab kolme nähtamatu tähemärgiga külge ja iga selle sildiga otsing ebaõnnestub.
Otsustage sihtkoha järgi: säilitage märgistus, kui inimene avab tulemust arvutustabelis, eemaldage see, kui programm seda loeb. Vastus peaaegu igale küsimusele rikutud täpitähtede kohta on kusagil selles lõigus.
Kui palju maksab andmekogumi töötlemine
Hinnastatud teksti mahu järgi, nii et lai kataloog lühikeste väärtustega on odavam kui kitsas, täis pikki kirjeldusi.
Free
Kaardiandmeid pole registreerumiseks vaja
- 0,005 $ / sõna tehisintellekti tõlge
- 1 $ lehekülje eest skannitud ja pildiga PDF-ide puhul
- 120+ keelt
- Failid kuni 20 MB ja 20 lehekülge
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG ja CSV
- Ainult 24-tunnine failide salvestusruum
- PDF-redaktor ja PDF-failide teisendaja DOCX-vormingusse
- Tühista igal ajal
- Ei sisaldu: E-posti tugi
- Ei sisaldu: Meeskonna juurdepääs
- Ei sisaldu: Piiramatud tasuta PDF-eelvaated
- Ei sisaldu: Sõnastik
Storage
või 149 $/aasta
- 0,005 $ / sõna tehisintellekti tõlge
- 1 $ lehekülje eest skannitud ja pildiga PDF-ide puhul
- 120+ keelt
- Failid kuni 100 MB ja 100 lehekülge
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG ja CSV
- Piiramatu failimälu
- PDF-redaktor ja PDF-failide teisendaja DOCX-vormingusse
- E-posti tugi
- Tühista igal ajal
- Ei sisaldu: Meeskonna juurdepääs
- Ei sisaldu: Piiramatud tasuta PDF-eelvaated
- Ei sisaldu: Sõnastik
Pro
või 499 $/aasta
- 0,004 $ sõna eest tehisintellekti tõlge
- 0,80 $ lehekülje eest skannitud ja pildiga PDF-ide puhul
- 120+ keelt
- Failid kuni 1000 MB ja 5000 lehekülge
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG ja CSV
- Piiramatu failimälu
- PDF-redaktor ja PDF-failide teisendaja DOCX-vormingusse
- E-posti tugi
- Meeskonna juurdepääs kuni 5 liikmele
- Piiramatud tasuta PDF-eelvaated
- Sõnastik
- Tühista igal ajal
Ettevõtetele
149,99 $/kuu, nõudmisel. Tehisintellekti tõlge 0,003 $/sõna (0,60 $ lehekülje eest), failid kuni 1000 MB ja 5000 lehekülge, piiramatu failide salvestusruum ja meeskonna juurdepääs kuni 15 liikmele.
Read sisse, read välja
Suurendage pisipilti, et võrrelda lähtelehte selle tulemusega. Mida paarid näitavad:
- Veeru arv kirje kohta on muutumatult ülevalt alla.
- Väärtused, mis olid jutumärkides, on endiselt jutumärkides.
- Koodid, võtmed ja numbrilised väärtused läbivad puutumatult.
- Ainult inimloetavad veerud tulevad tagasi uues keeles.




Siin ei avatud midagi arvutustabelis kahe oleku vahel.
Vaata kõiki tõlke näiteid →Töötav tellimus, mis väldib ümbertegemist
Kataloogi lokaliseerimine on torujuhe ja kallid vead juhtuvad kõik selle otstes, mitte keskel.
- 1
Ekspordi puhtalt ja märgi üles murre
Võtke eksport otse süsteemist, mis andmeid omab. Avage see üks kord lihtteksti redigeerijas, mitte arvutustabelis, ja märkige, milline märk eraldab väljad ja kas väärtused on jutumärkides.
- 2
Märkige veerud, mida te ei soovi puudutada
Identifikaatorid, võtmed, lingid, oleku väärtused ja koodid. Kui eksport on väga lai, on sageli kiirem lõigata see proosat sisaldavate veergudeni ja hiljem võtme järgi uuesti ühendada.
- 3
Laadige üles ja valige oma keeled
Looge konto e-posti aadressiga, sisestage andmed ja määrake lähtekeel ja sihtkeel. Üleslaadimised ulatuvad 1 GB-ni, nii et täielik kataloog läbib ühe tööna, mitte ei jagata partiideks.
- 4
Importige esmalt testkoopiasse
Laadige tulemus enne tootmisesse minekut testkeskkonda. Kontrollige kirjete arvu originaaliga, vaadake pikkade tõlgitud väärtuste korral paigutusprobleeme ja veenduge, et aktsendiga tähemärgid on reisist ellu jäänud.
Küsimused andmekogumitega inimestelt
Kas eraldaja muutub, kui tõlgin keelde, mis kasutab koma kümnendkohana?
Teie üleslaadimisel kasutatud eraldaja on sama, mida saate tagasi. Selle muutmine tähendaks struktuuri ümberkirjutamist, mitte sisu ja see rikuks kõik, mis andmeid teises otsas tarbib. Kui vajate spetsiifiliselt semikooloniga eraldatud versiooni, kuna tulemus avatakse arvutis, mis on nii seadistatud, siis teisendage see pärast tõlkimist tööriistaga, mis mõistab mõlemat dialekti.
Kuidas ma saan tootekoodid ja identifikaatorid tõlkimise eest hoida?
Hoidke neid selgelt identifitseeritud veergudes ja, kus võimalik, saatke töötlemiseks ainult proosaveerud ning ühendage hiljem võtme abil uuesti. Väärtused, mis on ilmselgelt koodid, mitte sõnad, jäetakse nii nagu nad on, kuid kõige turvalisem korraldus on see, kus ebaselgust ei teki kunagi. Ärge kunagi laske arvutustabelil nende veergudega vahepeal kokku puutuda, sest see vormindab need ümber olenemata tõlkest.
Minu tähemärgid tulid tagasi sümbolijadena. Mis juhtus?
See on kodeerimisest tingitud probleem, mitte tõlke probleem. Tulemus on peaaegu kindlasti õige Unicode, mida loeb midagi, mis ootab vanemat ühebaitist kodeeringut, või vastupidi. Avage see tekstiredaktoris, mis võimaldab teil kodeeringut selgesõnaliselt valida ja kinnitage, mida teil tegelikult on, enne kui eeldada, et midagi on kadunud. Kui sihtkohaks on arvutustabel, otsustab selle tavaliselt alguses olev baitide järjekorra märk.
Mis juhtub väärtustega, mis sisaldavad komasid või reavahetusi?
Need jäävad suletuks. Iga väärtus, mis sisaldab eraldajat, jutumärki või reavahetust, peab olema jutumärkides ja sellise väärtuse sees olev jutumärk peab olema kahekordistatud. Kuna tõlgitud tekst võib saada interpunktsiooni, mida originaalil polnud, tuleb see sulgemine rakendada tulemusele, mitte kopeerida allikast.
Kas kohahoidjad ja muutujad säilivad?
Nad peaksid ja tasub proovida. Märgid nagu protsendimärk koos tähega, nummerdatud pesa suletud või nimetatud muutuja on aadressid väärtustele, mis sisestatakse käitusajal. Ühe tõlkimine tähendab, et väärtus ei jõua ekraanile, nii et enne saatmist kontrollige väljundi pikimaid liidese ridu.
Minu read muutuvad saksa keeles palju pikemaks. Kas see on siin oluline?
Mitte andmete endi jaoks, millel pole laiust. See on oluline selle kuvamiseks. Laienemine viiendikult kolmandiku võrra inglise keelest on saksa ja vene keeles tavaline, samas kui hiina ja jaapani keel tavaliselt kahanevad. Sorteerige tõlgitud veerg pikkuse järgi ja vaadake ekstreemumeid oma paigutuse suhtes ning kontrollige mis tahes andmebaasi veergu fikseeritud tähemärgipiiranguga.
Kui suurt andmekogumit ma korraga saata saan?
Kuni 1 GB või viis tuhat lehekülge võrdväärset sisu Pro ja Enterprise paketiga. See katab sadu tuhandeid ridu sisaldavad kataloogid. Kogu asja ühe tööna saatmine on ka järjepidevuse huvides parem, sest termin, mis esineb reas 12 ja reas 90 000, käsitletakse samamoodi.
Mille eest ma laia ekspordi eest tasun?
Tekst, mitte tabel. Tühjad lahtrid, numbrirühmad ja identifikaatorirühmad ei ole proosa. Iga faili eest tasutakse eraldi, kuna ükski pakett ei sisalda sõnu: pool senti sõna kohta Free ja Storage'i puhul, 0,004 dollarit Pro puhul ja 0,003 dollarit Enterprise'i puhul, kusjuures alammäär on 0,99 dollarit. See muudab suure kataloogi sõnade arvu järgi hõlpsasti hinnatavaks.
Saatke eksport, säilitage struktuur
Laadige andmed üles täpselt nii, nagu teie süsteem need tootnud on, valige sihtkeel ja saate tagasi ruudustiku, mille igas kirjes on sama arv veerge ja võtmed on endiselt ühendatavad.
Meie partnerid
Seotud tõlketeenused
Failivormingud
PDF-tööriistad
