AI-alapú · 120+ nyelv

CSV fordító

Termékkatalógusok, exportok és adathalmazok oszloponként fordítva, a határolóelemekkel, az idézőjelekkel és az azonosító oszlopokkal pontosan úgy, ahogy a parser várja, hogy találja őket.

Max. fájlméret 1 GB Megtartja az eredeti formázást
Regisztráljon ingyen

Töltse fel vagy húzza ide a dokumentumot a fordításhoz

Max. fájlméret 1 GB

.PDF .DOCX .PPTX .XLSX .TXT .JPG .PNG .IDML .EPUB .HTML
Afrikaans (Afrikaans)
Shqip (Albanian)
አማርኛ (amhara)
العربية (Arabic)
Հայերեն (örmény)
Azərbaycan dili (azeri)
Euskara (baszk)
Беларуская (fehérorosz)
বাংলা (Bengali)
Bosanski (Bosnian)
Български (Bulgarian)
မြန်မာဘာသာ (burmai)
Català (katalán)
Cebuano (cebuano)
Chichewa (chichewa)
中文 简体 (kínai egyszerűsített)
中文 繁體 (kínai hagyományos)
Corsu (korzikai)
Hrvatski (Croatian)
Čeština (Czech)
Dansk (Danish)
Nederlands (Dutch)
English (English)
Eszperantó (Eszperantó)
Eesti (Estonian)
Suomi (Finnish)
Français (French)
Fríz (Fríz)
Galisz (Galisz)
Grúz (Grúz)
Deutsch (German)
Ελληνικά (Greek)
ગુજરાતી (Gujarati)
Haiti kreol (Haiti kreol)
Hausza (Hausza)
Hawaii (Hawaii)
עברית (Hebrew)
Hindi (Hindi)
Hmong (Hmong)
Magyar (Hungarian)
Izlandi (Izlandi)
Igbo (Igbo)
Indonéz (Indonéz)
Ír (Ír)
Italiano (Italian)
日本語 (Japanese)
Basa Jawa (Javanese)
Kannada (Kannada)
Kazah (Kazah)
Khmer (Khmer)
Kinyarwanda (Kinyarwanda)
한국어 (Korean)
Kurdî (Kurdish)
Kirgiz (Kirgiz)
Laoszi (Laoszi)
Latin (Latin)
Lett (Lett)
Litván (Litván)
Luxemburgi (Luxemburgi)
Macedón (Macedón)
Malagaszi (Malagaszi)
Bahasa Melayu (Malay)
Malajálam (Malajálam)
Máltai (Máltai)
Maori (Maori)
मराठी (Marathi)
Mongol (Mongol)
Nepáli (Nepáli)
Norsk (Norwegian)
Odia (Odia)
فارسی (Persian)
Polski (Polish)
Portugál (Portugál)
ਪੰਜਾਬੀ (Punjabi)
Română (Romanian)
Русский (Russian)
Szamoai (Szamoai)
Skót gael (Skót gael)
Српски (Serbian)
Szotho (Szotho)
Sona (Sona)
Szindhi (Szindhi)
Szingaléz (Szingaléz)
Slovenčina (Slovakian)
Slovenščina (Slovenian)
Szomáli (Szomáli)
Español (Spanish)
Szundai (Szundai)
Kiswahili (Szuaheli)
Svenska (Swedish)
Tagalog (Tagalog)
Tojikӣ (Tadzsik)
தமிழ் (Tamil)
Tatarça (Tatarszkij)
తెలుగు (Telugu)
ไทย (Thai)
Türkçe (Turkish)
Türkmençe (Türkmen)
Українська (Ukrainian)
اردو (Urdu)
ئۇيغۇرچە (Ujgur)
O'zbekcha (Üzbég)
Tiếng Việt (Vietnamese)
Cymraeg (Walesi)
isiXhosa (Xhosa)
ייִדיש (jiddisch)
Yorùbá (Joruba)
isiZulu (Zulu)
Afrikaans (Afrikaans)
Shqip (Albanian)
አማርኛ (amhara)
العربية (Arabic)
Հայերեն (örmény)
Azərbaycan dili (azeri)
Euskara (baszk)
Беларуская (fehérorosz)
বাংলা (Bengali)
Bosanski (Bosnian)
Български (Bulgarian)
မြန်မာဘာသာ (burmai)
Català (katalán)
Cebuano (cebuano)
Chichewa (chichewa)
中文 简体 (kínai egyszerűsített)
中文 繁體 (kínai hagyományos)
Corsu (korzikai)
Hrvatski (Croatian)
Čeština (Czech)
Dansk (Danish)
Nederlands (Dutch)
English (English)
Eszperantó (Eszperantó)
Eesti (Estonian)
Suomi (Finnish)
Français (French)
Fríz (Fríz)
Galisz (Galisz)
Grúz (Grúz)
Deutsch (German)
Ελληνικά (Greek)
ગુજરાતી (Gujarati)
Haiti kreol (Haiti kreol)
Hausza (Hausza)
Hawaii (Hawaii)
עברית (Hebrew)
Hindi (Hindi)
Hmong (Hmong)
Magyar (Hungarian)
Izlandi (Izlandi)
Igbo (Igbo)
Indonéz (Indonéz)
Ír (Ír)
Italiano (Italian)
日本語 (Japanese)
Basa Jawa (Javanese)
Kannada (Kannada)
Kazah (Kazah)
Khmer (Khmer)
Kinyarwanda (Kinyarwanda)
한국어 (Korean)
Kurdî (Kurdish)
Kirgiz (Kirgiz)
Laoszi (Laoszi)
Latin (Latin)
Lett (Lett)
Litván (Litván)
Luxemburgi (Luxemburgi)
Macedón (Macedón)
Malagaszi (Malagaszi)
Bahasa Melayu (Malay)
Malajálam (Malajálam)
Máltai (Máltai)
Maori (Maori)
मराठी (Marathi)
Mongol (Mongol)
Nepáli (Nepáli)
Norsk (Norwegian)
Odia (Odia)
فارسی (Persian)
Polski (Polish)
Portugál (Portugál)
ਪੰਜਾਬੀ (Punjabi)
Română (Romanian)
Русский (Russian)
Szamoai (Szamoai)
Skót gael (Skót gael)
Српски (Serbian)
Szotho (Szotho)
Sona (Sona)
Szindhi (Szindhi)
Szingaléz (Szingaléz)
Slovenčina (Slovakian)
Slovenščina (Slovenian)
Szomáli (Szomáli)
Español (Spanish)
Szundai (Szundai)
Kiswahili (Szuaheli)
Svenska (Swedish)
Tagalog (Tagalog)
Tojikӣ (Tadzsik)
தமிழ் (Tamil)
Tatarça (Tatarszkij)
తెలుగు (Telugu)
ไทย (Thai)
Türkçe (Turkish)
Türkmençe (Türkmen)
Українська (Ukrainian)
اردو (Urdu)
ئۇيغۇرچە (Ujgur)
O'zbekcha (Üzbég)
Tiếng Việt (Vietnamese)
Cymraeg (Walesi)
isiXhosa (Xhosa)
ייִדיש (jiddisch)
Yorùbá (Joruba)
isiZulu (Zulu)
ARAB PORTUGÁL RUSZ OLASZ KOREAI HOLLAND LENGYEL TÖRÖK SVÉD ANGOL SPANYOL FRANCIA NÉMET KÍNAI JAPÁN HINDI BENGÁLI VIETNÁMI THAI GÖRÖG HEBER ARAB PORTUGÁL RUSZ OLASZ KOREAI HOLLAND LENGYEL TÖRÖK SVÉD ANGOL SPANYOL FRANCIA NÉMET KÍNAI JAPÁN HINDI BENGÁLI VIETNÁMI THAI GÖRÖG HEBER

A szerkezetet két karakter tartja össze

A vesszővel elválasztott értékek alig számítanak formátumnak. Van egy széles körben követett leírás a közös dialektusról, de nincs hatóság, amely betartatná, így amit valójában kap, az a több konvenció egyikének egyike. Az egész rács két döntésen alapul: melyik karakter választja el a mezőket egy rekordban, és melyik sorozat zár le egy rekordot. Bármelyiket is rosszul csinálja, egy rendezett táblázat egyetlen, szabálytalan oszloppá válik.

A elválasztó nem mindig vessző. Az olyan országokban, ahol a tizedesvesszőt vesszővel írják, az Excel alapértelmezés szerint pontosvesszőt használ, ezért egy német vagy francia gépről származó export gyakran nem nyílik meg tisztán máshol. A tabulátorok és a függőleges vonalak is gyakran használatosak, általában azért választják őket, mert a tartalom tele van vesszőkkel.

Minden rekordnak ugyanannyi mezőt kell tartalmaznia, mint a fejlécnek, mert ez a szám határozza meg, hogy egy érték melyik oszlophoz tartozik. Az adatokban semmi sem jelzi ezt. Ez egy olyan invariáns, amely vagy teljesül, vagy csendben megszűnik teljesülni egy nagy export közepén, amely ponton minden alatta lévő oszlop egy oszloppal balra tolódik, és hihetőnek tűnik.

Négy mód, ahogyan a lefordított szöveg megtöri a rekordot

Ezek azok a hibák, amelyek nem jelentik be magukat. Az export továbbra is megnyílik, a sorok száma még mindig nagyjából helyesnek tűnik, és a kár később jelentkezik bármiben, ami a dữ liệu-t használja.

  1. Egy új elválasztó jelenik meg egy értéken belül. Egy vesszőket nem tartalmazó angol termékleírás két vesszővel rendelkező francia lesz. Ha a mezőt korábban nem idézték, most meg kell, különben a parser egy értéket háromnak olvas, és minden utána következő oszlopot eltol.
  2. Egy idézőjel egy idézett értéken belül landol. Egy zárt mezőn belül egy szó szerinti kettős idézőjelet kétszer kell írni, hogy elkerülje önmagát. Az olyan nyelvek, amelyek más idézőjelekkel idéznek, és bármely folyamat, amely az egyenes jeleket tipográfiaiakká alakítja, egy idézőjel nélküli karaktert hagyhat az érték közepén, ahol az korán befejezi a mezőt.
  3. Egy sortörés kúszik be egy cellába. Egy rekord egy új sorban ér véget, hacsak az új sor nem idézőjelek között van. A fordított marketing szöveg, amely egy bekezdéstörést kap, egy rekordot ketté oszt, és a második felének nem lesz megfelelő számú mezője.
  4. Egy helyőrző lefordítódik. A szoftverek számára szánt karakterláncok gyakran tartalmaznak helyettesítő tokeneket, egy százalékjelet egy betű követ, egy számozott foglalatot kapcsos zárójelben, egy nevesített változót. Ezek futásidőben beszúrt értékek címei, nem szavak, és az egyik lefordítása azt jelenti, hogy az érték soha nem jelenik meg.

Az oszlopok fele nem nyelv

Egy adathalmaz embereket célzó prózát és gépeket célzó kulcsokat kever, és egymás mellett ülnek, semmi sem különbözteti meg őket, csak a fejléc. Mielőtt elkezdené, derítse ki, melyik melyik, mert egy lefordított azonosító rosszabb, mint egy lefordítatlan leírás.

Hagyja ezeket békén

  • Maga a fejléc, ahol a címek mezőnevek, amelyeket kód használ, nem pedig személynek megjelenített címkék
  • Készletkódok, katalógusszámok, egyedi azonosítók és bármi, amit kulcsként használnak két adathalmaz összekapcsolására
  • Webcímek és az egyik slug része, mivel megváltoztatása megszakítja a linket és annak rangsorolását
  • Állapotértékek, amelyeket a szoftver egy rögzített listához hasonlít, például egy rendelési állapot vagy egy igen-nem jelző
  • Ország-, nyelv- és pénznemkódok, amelyek már szabványosított rövidítések
  • Év-hónap-nap sorrendben írt dátumok, számok és minden, amit feldolgozni kell, nem pedig olvasni

Ezek azok, amiért jöttél

  • Termékcímek és hosszú leírások, ami általában a szavak nagy részét teszi ki
  • Kategória- és gyűjteménynevek, ahogy az ügyfelek látják őket
  • Jelentéssel bíró attribútumértékek, mint például egy szín, egy anyag vagy egy méret megnevezése
  • Lokalizálásra kiemelt felületi sztringek, a helyőrzőik nélkül
  • Támogatási cikkek törzse, előre megírt válaszok és sablon e-mailek sorokként tárolva
  • Oszlopfejlécek, ahol az exportot személy, nem pedig program nyitja meg

Két dolog, ami adatokat károsít, még mielőtt a fordítás egyáltalán elkezdődne

Megnyitás táblázatkezelőben

Egy export dupla kattintással történő megnyitása és újra mentése a legmegbízhatóbb módja egy katalógus tönkretételének. A táblázatkezelő szoftverek megtippelik minden látott érték típusát, és ezek a tippek magabiztosak és tévesek:

  • Egy tizenhárom számjegyű cikkszám tudományos jelöléssé alakul, és véglegesen elveszíti utolsó számjegyeit
  • Egy nullával kezdődő irányítószám elveszíti a nullát
  • Bármi, ami napra és hónapra hasonlít, a helyi formátumban dátummá íródik át
  • Tizenöt számjegynél hosszabb azonosítók csendben lekerekítésre kerülnek

Ha először ellenőriznie kell az adatokat, használja az import párbeszédablakot, és állítsa az azonosító oszlopokat szövegre, ahelyett, hogy hagyná, hogy a program döntsön. Még jobb, ha az exportot pontosan úgy tölti fel, ahogy a rendszere előállította.

A byte order mark (BOM) kérdése

Az adatokon belül semmi sem jelzi, hogy milyen karakterkódolást használ, ezért néha egy három bájtos jelzőt helyeznek az elejére, hogy jelezzen egyet. Ez a jelző attól függően segít és árt, hogy mi nyitja meg az adatokat ezután.

A Windows táblázatkezelő szoftvere használja a Unicode tartalom felismerésére, és nélküle az ékezetes és nem latin karakterek szimbólumsorokként jelennek meg. Sok programkönyvtár ezzel szemben nem távolítja el, így az első oszlopfejléc három láthatatlan karakterrel érkezik az elejére ragasztva, és minden erre az oszlopfejlécre irányuló lekérdezés sikertelen lesz.

Döntse el a célállomás alapján: tartsa meg a jelzőt, ha egy személy táblázatkezelőben nyitja meg az eredményt, dobja el, ha egy program olvassa el. Majdnem minden, a sérült ékezetes karakterekkel kapcsolatos kérdésre a válasz ebben a bekezdésben található.

Mennyibe kerül egy adatkészlet feldolgozása

Szöveg mennyisége alapján árazva, így egy széles, rövid értékekkel rendelkező katalógus olcsóbb, mint egy keskeny, hosszú leírásokkal teli.

Free

$0

Nincs szükség kártyára a regisztrációhoz

  • 0,005 $/szó AI fordítás
  • 1 dollár oldalanként a beolvasott és kép PDF-ek esetében
  • 120+ nyelv
  • 20 MB és 20 oldal méretű fájlokig
  • DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG és CSV
  • Csak 24 órás fájltárolás
  • PDF szerkesztő és PDF-ből DOCX konverter
  • Bármikor lemondható
  • Nem tartalmazza: E-mail támogatás
  • Nem tartalmazza: Csapat hozzáférés
  • Nem tartalmazza: Korlátlan ingyenes PDF előnézet
  • Nem tartalmazza: Szószedet

Storage

14,99 $/hó

vagy 149 dollár/év

  • 0,005 $/szó AI fordítás
  • 1 dollár oldalanként a beolvasott és kép PDF-ek esetében
  • 120+ nyelv
  • 100 MB és 100 oldal méretű fájlokig
  • DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG és CSV
  • Korlátlan tárhely
  • PDF szerkesztő és PDF-ből DOCX konverter
  • E-mail támogatás
  • Bármikor lemondható
  • Nem tartalmazza: Csapat hozzáférés
  • Nem tartalmazza: Korlátlan ingyenes PDF előnézet
  • Nem tartalmazza: Szószedet

Pro

49,99 dollár/hó

vagy 499 dollár/év

  • 0,004 dollár/szó AI fordítás
  • 0,80 dollár oldalanként a beolvasott és kép PDF-ek esetében
  • 120+ nyelv
  • 1000 MB és 5000 oldal méretű fájlokig
  • DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG és CSV
  • Korlátlan tárhely
  • PDF szerkesztő és PDF-ből DOCX konverter
  • E-mail támogatás
  • Csapat hozzáférés legfeljebb 5 tag számára
  • Korlátlan ingyenes PDF előnézet
  • Szószedet
  • Bármikor lemondható

Vállalati

149,99 dollár/hó, kérésre. AI fordítás 0,003 dollár/szóért (0,60 dollár oldalanként), fájlok 1000 MB-ig és 5000 oldalig, korlátlan fájltárolás és csapat hozzáférés legfeljebb 15 tag számára.

Kapcsolatfelvétel az értékesítéssel

Sorok be, sorok ki

Nagyítson meg egy miniatűrt, hogy összehasonlítsa a forrásoldalt az eredményével. Amit a párok bemutatnak:

  • Az oszlopok száma rekordonként változatlan marad felülről lefelé.
  • Az idézőjelek közé zárt értékek továbbra is idézőjelek közé zártak.
  • A kódok, kulcsok és numerikus értékek érintetlenül haladnak át.
  • Csak az ember által olvasható oszlopok térnek vissza új nyelven.
Táblázatos adatok angolul, a forrásUgyanaz a táblázatos adat spanyolul megjelenítveTáblázatos adatok egy második készlete angolul, a forrásUgyanaz a második táblázatos adatkészlet németül megjelenítve

Itt semmi sem lett megnyitva táblázatkezelőben a két állapot között.

Nézze meg az összes fordítási példát →

Egy dolgozó megrendelés, amely elkerüli az ismételt munkát

Egy katalógus lokalizálása egy folyamat, és a költséges hibák mind a folyamat végein történnek, nem pedig a közepén.

  1. 1

    Tiszta exportálás és a nyelvjárás megjegyzése

    Vegye az exportot közvetlenül az adatokat birtokló rendszerből. Nyissa meg egyszer egy egyszerű szövegszerkesztőben, nem táblázatkezelőben, és jegyezze fel, hogy melyik karakter választja el a mezőket, és hogy az értékek idézőjelek közé vannak-e zárva.

  2. 2

    Jelölje meg azokat az oszlopokat, amelyeket nem akar érinteni

    Azonosítók, kulcsok, linkek, státuszértékek és kódok. Ha az export nagyon széles, gyakran gyorsabb, ha csak a prózát tartalmazó oszlopokra vágja, és később a kulcs alapján illeszti össze.

  3. 3

    Feltöltés és nyelvek kiválasztása

    Hozzon létre egy fiókot e-mail címmel, dobja be az adatokat, és állítsa be a forrás- és célnyelvet. A feltöltések 1 GB-ig terjednek, így egy teljes katalógus egyetlen feladatként fut át, ahelyett, hogy több részre bontva dolgoznánk fel.

  4. 4

    Importálja újra először egy tesztpéldányba

    Töltse be az eredményt egy tesztkörnyezetbe a gyártás előtt. Ellenőrizze a rekordok számát az eredetihez képest, nézze meg a leghosszabb fordított értékeket az elrendezési problémák miatt, és erősítse meg, hogy az ékezetes karakterek túlélték az utat.

CSV fordítási GYIK

Kérdések adatbázisokkal rendelkező emberektől

Változik a határoló, ha olyan nyelvre fordítok, amely tizedesvesszőt használ?

A feltöltéskor használt elválasztó az, amit visszakapsz. Ennek megváltoztatása a szerkezet átírását jelentené a tartalom helyett, és megszakítaná azt, amit a másik végén a feldolgozó eszköz vár. Ha kifejezetten pontosvesszővel elválasztott verzióra van szüksége, mert az eredményt egy olyan táblázatkezelőben fogja megnyitni, amelyik így van konfigurálva, akkor a fordítás után konvertálja át egy olyan eszközzel, amelyik mindkét dialektust ismeri.

Hogyan akadályozhatom meg, hogy a termékkódokat és azonosítókat lefordítsák?

Tartsa őket jól azonosított oszlopokban, és ahol lehetséges, csak a prózai oszlopokat küldje feldolgozásra, és utána illessze össze a kulcs alapján. Azok az értékek, amelyek nyilvánvalóan kódok, nem pedig szavak, változatlanul maradnak, de a legbiztonságosabb megoldás az, ahol a kétértelműség soha nem merül fel. Addig soha ne engedjen egy táblázatkezelőt érintkezni ezekkel az oszlopokkal, mert azok átformázzák őket, függetlenül bármilyen fordítástól.

Az ékezetes karaktereim szimbólumsorokká változtak. Mi történt?

Ez egy kódolási hiba, nem fordítási probléma. A kimenet szinte biztosan helyes Unicode, amelyet valami olyasmi olvas, ami örökölt, egybájtos kódolást vár, vagy fordítva. Nyissa meg egy szövegszerkesztőben, amely lehetővé teszi a kódolás explicit kiválasztását, és erősítse meg, hogy valójában mi van meg, mielőtt bármi elveszettnek feltételezne. Ha táblázatkezelő a cél, akkor az elején lévő byte-sorrend jelző általában eldönti.

Mi történik a vesszőket vagy sortöréseket tartalmazó értékekkel?

Zárójelben maradnak. Bármelyik értéknek, amely tartalmazza az elválasztót, egy idézőjelet vagy egy új sort, idézőjelbe kell tenni, és az ilyen értékben lévő literális idézőjelet meg kell duplázni. Mivel a lefordított szöveg olyan írásjeleket kaphat, amelyek az eredetiben nem szerepeltek, ezt a zárójelbe helyezést az eredményre kell alkalmazni, nem pedig a forrásból másolni.

A helyőrzők és a változó tokenek megmaradnak?

Kellene, és érdemes egy mintát ellenőrizni. Az olyan tokenek, mint egy százalékjel után egy betű, egy számozott hely a kapcsos zárójelben, vagy egy elnevezett változó, olyan címek, ahová futásidőben kerülnek be értékek. Ezek fordítása azt jelenti, hogy az érték soha nem jut el a képernyőre, ezért ellenőrizze a leghosszabb felületkarakterláncok egy maroknyi példányát a kimenetben, mielőtt elküldené.

A stringjeim sokkal hosszabbak lesznek németül. Számít ez itt?

Nem magának az adatnak, aminek nincs szélessége. A megjelenítőjének számít. Az angolhoz képesti egyötöd-egyharmados bővülés normális a német és az orosz esetében, míg a kínai és a japán általában összehúzódik. Rendezze a lefordított oszlopot hossz szerint, és nézze meg a szélső értékeket a saját elrendezéséhez képest, és ellenőrizze az összes rögzített karakterkorlátú adatbázisoszlopot.

Mekkora adathalmazt küldhetek be egyszerre?

Akár 1 GB, vagy ötezer oldalnyi tartalom a Pro és Enterprise csomagokban. Ez lefedi a több százezer soros katalógusokat. Az egész egyetlen feladatként történő elküldése jobb a következetesség szempontjából is, mivel az 1. sorban és a 90 000. sorban megjelenő kifejezést ugyanúgy kezelik.

Miért számítok fel díjat egy széles export esetén?

A szöveg, nem a rács. Az üres cellák, numerikus oszlopok és azonosító oszlopok nem prózai szövegek. Minden fájlt külön számlázunk, mivel egyetlen csomag sem tartalmaz beépített szavakat: fél cent per szó az Ingyenes és Storage csomagban, 0,004 dollár a Pro csomagban és 0,003 dollár az Enterprise csomagban, 0,99 dolláros minimummal. Ez megkönnyíti egy nagy katalógus becslését a szószám alapján.

Küldje el az exportot, tartsa meg a szerkezetet

Töltse fel az adatokat pontosan úgy, ahogy a rendszere előállította, válassza ki a célnyelvet, és kapjon vissza egy táblázatot, amely minden rekordban ugyanannyi oszloppal rendelkezik, és a kulcsok továbbra is összekapcsolhatók.

Partnereink

Accenture
Bloomberg
Citrix
P&G
SAP