Naša vlastita tehnologija prevođenja dokumenata

DocTranslator AI Engine

DocTranslator AI Engine je tehnologija prevođenja dokumenata koju sami razvijamo. Tamo gdje većina alata za prevođenje radi s običnim tekstom, ovaj radi sa stranicom: pronalazi gdje se nalazi svaki red, prevodi ga i upisuje prijevod natrag na isto mjesto, tako da datoteka koju preuzmete ima izgled datoteke koju ste prenijeli.

Dizajniran je i napisan od strane DocTranslator tima.

Kako funkcioniše

Četiri faze od učitavanja do gotove datoteke

  1. 01

    Čitaj

    Pročitajte datoteku

    Mehanizam prepoznaje vrstu datoteke iz njenog sadržaja, a ne iz naziva: PDF sa stvarnim tekstualnim slojem, sken, fotografija ili Office dokument. Svaka vrsta prolazi drugačijim putem.

  2. 02

    Odvojeno

    Odvojite riječi od stranice

    Izdiže se samo tekst. Slike, dijagrami, grafikoni, fotografije, potpisi i pečati ostaju na svom mjestu i nikada se ne šalju na prevođenje.

  3. 03

    Prevedi

    Prevedi i provjeri

    Svaki odlomak se prevodi i provjerava prije nego što se prihvati. Odlomak koji ne prođe provjeru prevodi se ponovo.

  4. 04

    Ponovo kreiraj

    Ponovo sastavi stranicu

    Prijevod se vraća na originalne pozicije, postavljen fontovima koji sadrže znakove ciljnog jezika.

A · Digitalni PDF-ovi

PDF-ovi sa tekstualnim slojem

U PDF-u izvezenom iz Worda, InDesigna ili sličnog programa, mehanizam čita tekst blok po blok i ćeliju tabele po ćeliju. Spaja redove paragrafa u jedan odlomak prije prevođenja, tako da rečenica koja se proteže kroz tri reda prevodi se kao jedna rečenica, a ne kao tri fragmenta. Zatim uklanja originalne riječi sa stranice, ostavlja slike, dijagrame i vektorske crteže netaknute i upisuje prijevod u istu kutiju.

Prijevod rijetko bude iste dužine kao izvornik. Njemački i ruski obično budu duži od engleskog, a kineski i japanski zahtijevaju manje znakova. Mehanizam omogućava da se tekst prilagodi unutar svoje originalne kutije i smanjuje veličinu fonta samo kada se prijevod još uvijek ne uklapa. Ćelije tabele se obrađuju jedna po jedna, tako da brojevi ostaju u svojim redovima i kolonama.

Tri spojene linije postaju jedan pasus, a duži prevod se uklapa unutar okvira koji je zauzimao originalni tekst.

B · Skenovi i fotografije

Skenovi i fotografije

01Skenirana stranica, zadržana kao pozadinska slika.
02Odabran je samo mastilo riječi. Pečati, linije i potpisi su izostavljeni.
03Prevod je napisan nazad na mjesto, na originalnom papiru.

Skenirana stranica je slika, tako da u njoj nema teksta za zamjenu. Mehanizam zadržava originalnu sliku kao pozadinu stranice, prepoznaje štampani tekst pomoću OCR-a, a zatim uklanja samo mastilo tih slova, popunjavajući svako mjesto bojom papira oko njega. Sve što nije tekući tekst ostaje netaknuto. Pečati, plombe, potpisi, fotografije, grafikoni i dijagrami ostaju tačno onakvi kakvi su skenirani, što je ono što želite na certifikatu ili potpisanom ugovoru.

Tabele zadržavaju svoju štampanu mrežu. Mehanizam pronalazi linije originalne tabele u slici, čisti tekst unutar svake ćelije bez dodirivanja ivica i upisuje prijevod u istu ćeliju. Linija odštampana postrance duž margine piše se nazad postrance.

Ponekad se linija ne može čisto izbrisati, na primjer kada se tekst nalazi na prometnoj pozadini. U tom slučaju mehanizam ostavlja originalni otisak na mjestu umjesto da ga razmazuje, i dodaje nevidljivu kopiju teksta kako bi stranica i dalje bila pretraživa.

C · Strukturirane datoteke

Word, Excel, PowerPoint, EPUB i HTML

Office datoteke već odvajaju svoj tekst od svog izgleda, tako da ih mehanizam prevodi iznutra. Zamjenjuje riječi svakog paragrafa, slajda i ćelije tabele i zadržava podebljano, kurziv i drugo oblikovanje na riječima kojima je pripadalo, čak i kada prijevod te riječi postavi u drugačiji redoslijed.

EPUB knjige i HTML stranice prevode se tekst po tekst, a njihov markup ostaje kakav je bio, tako da poglavlja, naslovi i linkovi nastavljaju raditi u prevedenoj kopiji.

ENThe report is ready today.
↓
DEDer Bericht ist heute fertig.

Podebljana riječ se pomjera na kraj njemačke rečenice, a njeno formatiranje se pomjera s njom.

Kvalitet

Provjere prije nego što se datoteka vrati

AI prijevod može podbaciti na načine koji se lako mogu promašiti pri brzom čitanju, stoga mehanizam provjerava svaki odlomak prije nego što ga prihvati:

  1. reject Odgovor koji ponavlja original umjesto da ga prevodi se odbija.
  2. reject Također i odgovor na pogrešnom jeziku, onaj koji se ponavlja ili prestaje na pola puta, i onaj sa slučajnim znakovima iz drugog pisma.
  3. retry Odbijeni odlomak se prevodi ponovo, prvo zajedno sa redovima oko njega radi konteksta, a zatim samostalno.
  4. compare Brojevi, web adrese i adrese e-pošte se upoređuju između originala i prijevoda, tako da se promijenjena cifra označava.
  5. reuse Rečenica koja se pojavljuje na nekoliko stranica prevodi se jednom, tako da naslov ili termin čita isto svugdje u dokumentu.
  6. discard Ako se veliki dio dokumenta vrati kao neprijeveden, mehanizam odbacuje taj rezultat umjesto da preda pola prevedenu datoteku.

Izradio i pokreće DocTranslator

Naš vlastiti kod, od čitanja stranice do njenog ponovnog kreiranja.

Mehanizam je razvijen od strane DocTranslator tima. Analiza stranice, obrada skenova i tabela, obnova svake stranice i gore navedene provjere su naš vlastiti kod. Budući da sami pišemo mehanizam, problem poput pomjerene tabele ili nedostajućeg znaka može se popraviti u samom mehanizmu.

Prijevodi na kineski, japanski, korejski, hindski, tajlandski i druga pisma postavljaju se u fontove koji sadrže te znakove, tako da ne dobijate prazne kutije tamo gdje bi trebala biti slova. Ugrađuju se samo znakovi koje dokument zapravo koristi, što smanjuje veličinu datoteke.

DocTranslator AI Engine FAQ

Da li je DocTranslator AI Engine napravio DocTranslator?

Da. Mehanizam je razvijen interno od strane DocTranslator tima. Analiza stranice, obrada skenova, rekonstrukcija izgleda i provjere kvaliteta su naš vlastiti kod.

Da li zadržava pečate i potpise na skeniranim dokumentima?

Da. Engine uklanja samo mastilo prepoznatog tekućeg teksta. Pečati, potpisi, fotografije, grafikoni i dijagrami ostaju onakvi kakvi su skenirani, tako da certifikat i dalje pokazuje svoj pečat, a ugovor svoje potpise nakon prevođenja.

Šta se dešava sa tabelama?

U PDF-u sa tekstualnim slojem, svaka ćelija se prevodi zasebno i upisuje nazad u istu ćeliju. Na skeniranom dokumentu, engine pronalazi odštampanu mrežu u slici, briše tekst unutar svake ćelije, a da ne dodiruje linije, i upisuje prijevod u ćeliju iz koje je potekao.

Hoće li prevedena datoteka izgledati potpuno isto kao original?

Slično, iako ne uvijek identično. Prijevod je obično duži ili kraći od izvornika, tako da se tekst može drugačije prelomiti ili postaviti malo manje da bi stao u okvir. Na gustoj stranici, kao što je fotografisana tabela, brzo pogledajte rezultat prije nego što pošaljete datoteku dalje.

Koje jezike podržava DocTranslator?

DocTranslator podržava 108 jezika, a možete prevoditi između bilo koja dva od njih. Lista svih jezika prikazuje svaki od njih.

Mogu li ga koristiti za vizu ili sudski podnesak?

Mehanizam proizvodi AI prijevode. Imigracioni uredi, sudovi i univerziteti obično traže ovjereni prijevod, potpisan od strane profesionalnog prevodioca koji potvrđuje da je tačan i potpun. Za to koristite našu uslugu ovjerenog prijevoda.

Prevedite dokument i sami provjerite izgled

Otpremite PDF, sken ili Office datoteku, odaberite dva od 108 jezika i uporedite rezultat sa svojim originalom. Prevođenje počinje od 0,99 USD po dokumentu.