आमचे स्वतःचे दस्तऐवज भाषांतर तंत्रज्ञान
DocTranslator AI Engine
DocTranslator AI Engine हे दस्तऐवज अनुवाद तंत्रज्ञान आहे जे आम्ही स्वतः विकसित करतो. जिथे बहुतेक अनुवाद साधने साध्या मजकुरासह कार्य करतात, हे साधन पृष्ठासह कार्य करते: ते प्रत्येक ओळ कुठे बसते हे शोधते, त्याचे भाषांतर करते आणि तेच ठिकाणी भाषांतर परत लिहिते, त्यामुळे तुम्ही डाउनलोड केलेली फाइल अपलोड केलेल्या फाइलच्या लेआउटसारखीच असते.
हे DocTranslator टीमने डिझाइन केले आहे आणि लिहिले आहे.
हे कसे कार्य करते
अपलोडपासून अंतिम फाइलपर्यंत चार टप्पे
- 01
वाचा
फाइल वाचा
फाइलचे नाव ऐवजी त्यातील मजकुरावरून इंजिन फाइलचा प्रकार ओळखते: टेक्स्ट लेयर असलेली PDF, स्कॅन, फोटो किंवा ऑफिस डॉक्युमेंट. प्रत्येक प्रकारासाठी वेगळी प्रक्रिया वापरली जाते.
- 02
वेगळे करा
पानावरील शब्द वेगळे करा
फक्त मजकूर काढला जातो. चित्रे, आकृत्या, तक्ते, फोटो, सह्या आणि शिक्के जिथे आहेत तिथेच राहतात आणि भाषांतरासाठी कधीही पाठवले जात नाहीत.
- 03
भाषांतरित करा
भाषांतर करा आणि तपासा
प्रत्येक उतारा भाषांतरित केला जातो आणि स्वीकारण्यापूर्वी तपासला जातो. तपासणीत अयशस्वी झालेला उतारा पुन्हा भाषांतरित केला जातो.
- 04
पुन्हा तयार करा
पान पुन्हा तयार करा
भाषांतर मूळ जागी परत जाते, लक्ष्य भाषेतील अक्षरे असलेल्या फॉन्टमध्ये सेट केले जाते.
A · डिजिटल PDF
टेक्स्ट लेयर असलेल्या PDFs
Word, InDesign किंवा तत्सम प्रोग्राममधून एक्सपोर्ट केलेल्या PDF मध्ये, इंजिन ब्लॉकनुसार आणि टेबल सेलनुसार मजकूर वाचते. भाषांतरित करण्यापूर्वी ते परिच्छेदातील ओळी एकत्र जोडते, त्यामुळे तीन ओळींमध्ये येणारे वाक्य तीन तुकड्यांऐवजी एक वाक्य म्हणून भाषांतरित होते. त्यानंतर ते पानावरील मूळ शब्द काढून टाकते, चित्रे, आकृत्या आणि वेक्टर रेखाचित्रे तशीच ठेवते आणि भाषांतर त्याच बॉक्समध्ये लिहिते.
भाषांतर मूळ मजकुराच्या लांबीचे क्वचितच असते. जर्मन आणि रशियन भाषेतील मजकूर सहसा इंग्रजीपेक्षा जास्त लांब असतो आणि चीनी व जपानी भाषांमध्ये कमी अक्षरे लागतात. इंजिन मजकूर मूळ ब्लॉकमध्ये आपोआप बसवते आणि भाषांतर अजूनही बसत नसल्यासच फॉन्टचा आकार कमी करते. टेबल सेल्स एका वेळी एक हाताळले जातात, त्यामुळे आकडे त्यांच्या स्वतःच्या ओळी आणि स्तंभांमध्ये राहतात.
B · स्कॅन आणि फोटो
स्कॅन आणि फोटो
स्कॅन केलेले पान एक चित्र असते, त्यामुळे त्यात बदलण्यासाठी कोणताही मजकूर नसतो. इंजिन मूळ इमेजला पानाच्या पार्श्वभूमीसारखे ठेवते, छापलेला मजकूर OCR वापरून ओळखते आणि नंतर फक्त त्या अक्षरांची शाई काढून टाकते, प्रत्येक जागा आजूबाजूच्या कागदाच्या रंगाने भरते. मजकूर नसलेली कोणतीही गोष्ट तशीच ठेवली जाते. शिक्के, सील, सह्या, फोटो, तक्ते आणि आकृत्या स्कॅन केल्याप्रमाणेच राहतात, जे प्रमाणपत्रावर किंवा स्वाक्षरी केलेल्या करारावर तुम्हाला हवे असते.
टेबल्स त्यांच्या छापलेल्या ग्रिडमध्ये राहतात. इंजिन इमेजमधील मूळ टेबलच्या रेषा शोधते, सेलच्या आतील मजकूर बॉर्डरला स्पर्श न करता साफ करते आणि त्याच सेलमध्ये भाषांतर लिहिते. मार्जिनच्या बाजूने छापलेली रेषा बाजूने परत लिहिली जाते.
कधीकधी एखादी ओळ स्वच्छपणे पुसली जात नाही, उदाहरणार्थ जेव्हा मजकूर व्यस्त पार्श्वभूमीवर असतो. अशावेळी इंजिन मूळ छपाई तशीच ठेवते, तिला पसरवण्याऐवजी, आणि मजकुराची एक अदृश्य प्रत जोडते जेणेकरून पान शोधण्यायोग्य राहील.
C · संरचित फाईल्स
Word, Excel, PowerPoint, EPUB आणि HTML
ऑफिस फाइल्स त्यांच्या लेआउटपासून मजकूर वेगळा ठेवतात, त्यामुळे इंजिन त्यांना आतून भाषांतरित करते. ते प्रत्येक परिच्छेद, स्लाइड आणि स्प्रेडशीट सेलचे शब्द बदलते आणि बोल्ड, इटॅलिक आणि इतर फॉरमॅटिंग त्या शब्दांवर ठेवते, जरी भाषांतरामुळे ते शब्द वेगळ्या क्रमाने आले तरीही.
EPUB पुस्तके आणि HTML पाने मजकुराप्रमाणे भाषांतरित केली जातात आणि त्यांचे मार्कअप जसे होते तसेच ठेवले जाते, त्यामुळे भाषांतरित प्रतीमध्ये अध्याय, शीर्षके आणि लिंक्स काम करत राहतात.
ENThe report is ready today.
↓
DEDer Bericht ist heute fertig.ठळक शब्द जर्मन वाक्याच्या शेवटी जातो आणि त्याचे स्वरूपण त्याच्यासोबत जाते.
गुणवत्ता
फाइल परत येण्यापूर्वी तपासणी
AI भाषांतर अशा प्रकारे अयशस्वी होऊ शकते जे पटकन वाचताना लक्षात येणे कठीण असते, म्हणून इंजिन प्रत्येक उतारा स्वीकारण्यापूर्वी तपासते:
rejectमूळ मजकुराचे भाषांतर करण्याऐवजी तोच मजकूर परत देणारे उत्तर नाकारले जाते.rejectचुकीच्या भाषेतील उत्तर, अर्धवट थांबलेले किंवा लूप होणारे उत्तर आणि दुसऱ्या लिपीतील अयोग्य अक्षरे असलेले उत्तर देखील नाकारले जाते.retryनाकारलेला उतारा पुन्हा भाषांतरित केला जातो, प्रथम संदर्भासाठी आजूबाजूच्या ओळींसह, नंतर एकटाच.compareमूळ आणि भाषांतरित मजकुरातील संख्या, वेब पत्ते आणि ईमेल पत्ते यांची तुलना केली जाते, त्यामुळे बदललेला आकडा ध्वजांकित केला जातो.reuseएकापेक्षा जास्त पानांवर दिसणारे वाक्य एकदाच भाषांतरित केले जाते, त्यामुळे दस्तऐवजात कुठेही शीर्षक किंवा संज्ञा समान वाचली जाते.discardजर दस्तऐवजाचा मोठा भाग भाषांतरित न करता परत आला, तर इंजिन अर्धा-भाषांतरित फाइल देण्याऐवजी तो निकाल टाकून देते.
DocTranslator द्वारे तयार आणि संचालित
आमचा स्वतःचा कोड, पृष्ठ वाचण्यापासून ते पुन्हा तयार करण्यापर्यंत.
हे इंजिन DocTranslator टीमने विकसित केले आहे. पृष्ठाचे विश्लेषण, स्कॅन आणि टेबल्सची हाताळणी, प्रत्येक पृष्ठाची पुनर्बांधणी आणि वरील तपासण्या हे आमचे स्वतःचे कोड आहेत. कारण आम्ही इंजिन स्वतः लिहितो, त्यामुळे शिफ्ट झालेले टेबल किंवा गहाळ अक्षर यासारख्या समस्या इंजिनमध्येच दुरुस्त केल्या जाऊ शकतात.
चीनी, जपानी, कोरियन, हिंदी, थाई आणि इतर लिपींमधील भाषांतरे त्या लिपींमधील अक्षरे असलेल्या फॉन्टमध्ये सेट केली जातात, त्यामुळे अक्षरे जिथे असायला हवी तिथे तुम्हाला रिकामे बॉक्स दिसत नाहीत. दस्तऐवजात प्रत्यक्षात वापरलेली अक्षरेच एम्बेड केली जातात, ज्यामुळे फाइलचा आकार कमी राहतो.
DocTranslator AI Engine FAQ
DocTranslator AI इंजिन DocTranslator द्वारे तयार केले आहे का?
होय. हे इंजिन DocTranslator टीमने अंतर्गत विकसित केले आहे. पृष्ठाचे विश्लेषण, स्कॅन हाताळणी, लेआउट पुनर्बांधणी आणि गुणवत्ता तपासणी हे आमचे स्वतःचे कोड आहेत.
हे स्कॅन केलेल्या दस्तऐवजांवरील स्टॅम्प, सील आणि स्वाक्षऱ्या ठेवते का?
होय. इंजिन ओळखलेल्या चालू मजकुराची शाई काढून टाकते. स्टॅम्प, सील, स्वाक्षऱ्या, फोटो, चार्ट आणि आकृत्या जशा स्कॅन केल्या होत्या तशाच राहतात, त्यामुळे प्रमाणपत्रावर भाषांतरानंतरही सील आणि करारावर स्वाक्षऱ्या दिसतात.
टेबल्सचे काय होते?
मजकूर लेयर असलेल्या PDF मध्ये, प्रत्येक सेल स्वतःच अनुवादित केला जातो आणि त्याच सेलमध्ये परत लिहिला जातो. स्कॅनवर, इंजिन प्रतिमेतील छापलेली ग्रिड शोधते, प्रत्येक सेलच्या आतील मजकूर ओळींना स्पर्श न करता साफ करते आणि भाषांतर ज्या सेलमध्ये होते त्या सेलमध्ये लिहिते.
अनुवादित फाईल मूळ फाईलसारखीच दिसेल का?
जवळपास, पण नेहमी तंतोतंत नाही. भाषांतर सामान्यतः त्याच्या स्त्रोतापेक्षा लांब किंवा लहान असते, त्यामुळे मजकूर वेगळ्या प्रकारे रॅप होऊ शकतो किंवा त्याचे बॉक्समध्ये बसण्यासाठी थोडे लहान केले जाऊ शकते. दाट पृष्ठावर, जसे की छायाचित्रित टेबल, फाईल पाठवण्यापूर्वी निकालावर एक नजर टाका.
DocTranslator कोणकोणत्या भाषांना सपोर्ट करते?
DocTranslator १०८ भाषांना सपोर्ट करते आणि तुम्ही त्यापैकी कोणत्याही दोन भाषांमध्ये भाषांतर करू शकता. संपूर्ण भाषा सूची मध्ये प्रत्येक भाषा दर्शविली आहे.
मी हे व्हिसा किंवा कोर्ट फाइलिंगसाठी वापरू शकतो का?
हे इंजिन AI भाषांतर तयार करते. इमिग्रेशन कार्यालये, न्यायालये आणि विद्यापीठे सहसा प्रमाणित भाषांतराची मागणी करतात, ज्यावर एका व्यावसायिक अनुवादकाने स्वाक्षरी केलेली असते जो ते अचूक आणि पूर्ण असल्याची पुष्टी करतो. त्यासाठी, आमची प्रमाणित भाषांतर सेवा वापरा.
दस्तऐवज भाषांतरित करा आणि लेआउट स्वतः तपासा
PDF, स्कॅन किंवा ऑफिस फाइल अपलोड करा, १०८ भाषांमधून दोन भाषा निवडा आणि तुमच्या मूळ दस्तऐवजाशी निकालाची तुलना करा. प्रति दस्तऐवज भाषांतर $0.99 पासून सुरू होते.
संबंधित साधने
फाइल स्वरूप
दस्तऐवज प्रकार
