हमारी अपनी दस्तावेज़ अनुवाद तकनीक
DocTranslator AI Engine
DocTranslator AI Engine वह दस्तावेज़ अनुवाद तकनीक है जिसे हम स्वयं विकसित करते हैं। जहाँ अधिकांश अनुवाद उपकरण सादे टेक्स्ट के साथ काम करते हैं, यह वाला पृष्ठ के साथ काम करता है: यह पता लगाता है कि प्रत्येक पंक्ति कहाँ स्थित है, उसका अनुवाद करता है और अनुवाद को उसी स्थान पर वापस लिखता है, इसलिए आपके द्वारा डाउनलोड की गई फ़ाइल में वही लेआउट होता है जो आपने अपलोड की थी।
इसे DocTranslator टीम द्वारा डिज़ाइन और लिखा गया है।
यह कैसे काम करता है
अपलोड से तैयार फ़ाइल तक चार चरण
- 01
पढ़ें
फ़ाइल पढ़ें
इंजन फ़ाइल को उसके नाम के बजाय उसकी सामग्री से पहचानता है: एक वास्तविक टेक्स्ट लेयर वाला PDF, एक स्कैन, एक तस्वीर या एक Office दस्तावेज़। प्रत्येक प्रकार एक अलग रास्ते से जाता है।
- 02
अलग करें
पृष्ठ से शब्दों को अलग करें
केवल टेक्स्ट को निकाला जाता है। चित्र, आरेख, चार्ट, तस्वीरें, हस्ताक्षर और मुहरें जहाँ हैं वहीं रहती हैं और कभी भी अनुवाद के लिए नहीं भेजी जातीं।
- 03
अनुवाद करें
अनुवाद करें और जाँचें
प्रत्येक अंश का अनुवाद किया जाता है और स्वीकार किए जाने से पहले उसकी जाँच की जाती है। जाँच में असफल रहने वाले अंश का फिर से अनुवाद किया जाता है।
- 04
पुनर्निर्माण करें
पृष्ठ को फिर से बनाएँ
अनुवाद मूल स्थानों पर वापस चला जाता है, उन फ़ॉन्ट में सेट किया जाता है जिनमें लक्ष्य भाषा के अक्षर होते हैं।
A · डिजिटल PDF
टेक्स्ट लेयर वाले PDF
Word, InDesign या इसी तरह के प्रोग्राम से निर्यात किए गए PDF में, इंजन टेक्स्ट को ब्लॉक दर ब्लॉक और तालिका सेल दर सेल पढ़ता है। यह अनुवाद करने से पहले एक पैराग्राफ की पंक्तियों को एक अंश में जोड़ता है, इसलिए तीन पंक्तियों में फैलने वाला वाक्य तीन टुकड़ों के बजाय एक वाक्य के रूप में अनुवादित होता है। फिर यह पृष्ठ से मूल शब्दों को हटा देता है, छवियों, आरेखों और वेक्टर ड्राइंग को अछूता छोड़ देता है, और अनुवाद को उसी बॉक्स में लिखता है।
एक अनुवाद शायद ही कभी उसके स्रोत के समान लंबाई का होता है। जर्मन और रूसी आमतौर पर अंग्रेजी से लंबे होते हैं, और चीनी और जापानी कम अक्षर लेते हैं। इंजन टेक्स्ट को उसके मूल ब्लॉक के भीतर लपेटने देता है और फ़ॉन्ट आकार को केवल तभी कम करता है जब अनुवाद अभी भी फिट नहीं होता है। तालिका सेल एक-एक करके संभाले जाते हैं, इसलिए आंकड़े अपनी पंक्तियों और स्तंभों में बने रहते हैं।
B · स्कैन और फ़ोटो
स्कैन और तस्वीरें
एक स्कैन किया गया पृष्ठ एक तस्वीर होती है, इसलिए उसमें बदलने के लिए कोई टेक्स्ट नहीं होता है। इंजन मूल छवि को पृष्ठ की पृष्ठभूमि के रूप में रखता है, मुद्रित टेक्स्ट को OCR के साथ पहचानता है, और फिर केवल उन अक्षरों की स्याही को हटा देता है, प्रत्येक स्थान को उसके चारों ओर के कागज के रंग से भर देता है। जो कुछ भी रनिंग टेक्स्ट नहीं है उसे अकेला छोड़ दिया जाता है। मुहरें, सील, हस्ताक्षर, तस्वीरें, चार्ट और आरेख ठीक वैसे ही रहते हैं जैसे उन्हें स्कैन किया गया था, जो आप किसी प्रमाण पत्र या हस्ताक्षरित अनुबंध पर चाहते हैं।
तालिकाएँ अपनी मुद्रित ग्रिड बनाए रखती हैं। इंजन छवि में मूल तालिका की रेखाओं को ढूंढता है, सीमाओं को छुए बिना प्रत्येक सेल के अंदर के टेक्स्ट को साफ़ करता है, और उसी सेल में अनुवाद लिखता है। किसी मार्जिन के साथ तिरछे छपी रेखा को तिरछे वापस लिखा जाता है।
कभी-कभी एक रेखा को साफ-सुथरा मिटाया नहीं जा सकता है, उदाहरण के लिए जहाँ टेक्स्ट एक व्यस्त पृष्ठभूमि पर स्थित है। उस स्थिति में इंजन उसे धब्बा लगाने के बजाय मूल प्रिंट को वैसे ही छोड़ देता है, और टेक्स्ट की एक अदृश्य प्रति जोड़ता है ताकि पृष्ठ अभी भी खोजा जा सके।
C · संरचित फ़ाइलें
Word, Excel, PowerPoint, EPUB और HTML
Office फ़ाइलें पहले से ही अपने लेआउट से अलग अपना टेक्स्ट रखती हैं, इसलिए इंजन उन्हें अंदर से अनुवाद करता है। यह प्रत्येक पैराग्राफ, स्लाइड और स्प्रेडशीट सेल के शब्दों को बदल देता है और उन शब्दों पर बोल्ड, इटैलिक और अन्य स्वरूपण को बनाए रखता है जिनसे वे संबंधित थे, भले ही अनुवाद उन शब्दों को अलग क्रम में रखता हो।
EPUB पुस्तकें और HTML पृष्ठ टेक्स्ट दर टेक्स्ट अनुवादित होते हैं, और उनका मार्कअप वैसे ही छोड़ दिया जाता है, इसलिए अध्याय, शीर्षक और लिंक अनुवादित प्रति में काम करते रहते हैं।
ENThe report is ready today.
↓
DEDer Bericht ist heute fertig.बोल्ड शब्द जर्मन वाक्य के अंत में चला जाता है, और उसका स्वरूपण उसके साथ चला जाता है।
गुणवत्ता
फ़ाइल वापस आने से पहले जाँच
AI अनुवाद उन तरीकों से विफल हो सकता है जिन्हें एक त्वरित पठन में याद करना आसान होता है, इसलिए इंजन स्वीकार करने से पहले प्रत्येक अंश की जाँच करता है:
rejectएक उत्तर जो मूल का अनुवाद करने के बजाय उसे दोहराता है, उसे अस्वीकार कर दिया जाता है।rejectगलत भाषा में एक उत्तर, जो लूप होता है या आधा रुक जाता है, और दूसरे स्क्रिप्ट से अवांछित अक्षर वाला उत्तर भी।retryएक अस्वीकृत अंश का फिर से अनुवाद किया जाता है, पहले संदर्भ के लिए उसके आसपास की पंक्तियों के साथ, फिर अपने आप।compareसंख्याएँ, वेब पते और ईमेल पते मूल और अनुवाद के बीच तुलना की जाती है, इसलिए एक बदली हुई आकृति को चिह्नित किया जाता है।reuseएक वाक्य जो कई पृष्ठों पर दिखाई देता है, उसे एक बार अनुवादित किया जाता है, इसलिए एक शीर्षक या शब्द दस्तावेज़ में हर जगह एक जैसा पढ़ा जाता है।discardयदि किसी दस्तावेज़ का एक बड़ा हिस्सा बिना अनुवाद के वापस आता है, तो इंजन आधे-अनुवादित फ़ाइल सौंपने के बजाय उस परिणाम को फेंक देता है।
DocTranslator द्वारा निर्मित और संचालित
हमारा अपना कोड, पृष्ठ को पढ़ने से लेकर उसे पुनर्निर्मित करने तक।
इंजन DocTranslator टीम द्वारा विकसित किया गया है। पेज विश्लेषण, स्कैन और तालिकाओं की हैंडलिंग, प्रत्येक पेज का पुनर्निर्माण और उपरोक्त जांच हमारा अपना कोड है। क्योंकि हम इंजन स्वयं लिखते हैं, इसलिए शिफ्ट की गई तालिका या गायब अक्षर जैसी समस्या को इंजन में ही ठीक किया जा सकता है।
चीनी, जापानी, कोरियाई, हिंदी, थाई और अन्य लिपियों में अनुवाद उन फ़ॉन्ट में सेट किए जाते हैं जिनमें वे अक्षर होते हैं, इसलिए आपको खाली बक्से नहीं मिलते जहाँ अक्षर होने चाहिए। केवल वे अक्षर जो दस्तावेज़ वास्तव में उपयोग करता है, एम्बेड किए जाते हैं, जो फ़ाइल आकार को कम रखता है।
DocTranslator AI Engine FAQ
क्या DocTranslator AI Engine DocTranslator द्वारा बनाया गया है?
हाँ। इंजन DocTranslator टीम द्वारा इन-हाउस विकसित किया गया है। पेज विश्लेषण, स्कैन हैंडलिंग, लेआउट पुनर्निर्माण और गुणवत्ता जांच हमारा अपना कोड है।
क्या यह स्कैन किए गए दस्तावेज़ों पर स्टैम्प, सील और हस्ताक्षर रखता है?
हाँ। इंजन केवल पहचाने गए रनिंग टेक्स्ट की स्याही को हटाता है। स्टैम्प, सील, हस्ताक्षर, फ़ोटो, चार्ट और आरेख वैसे ही छोड़ दिए जाते हैं जैसे उन्हें स्कैन किया गया था, इसलिए अनुवाद के बाद भी एक प्रमाण पत्र अपनी सील और एक अनुबंध अपने हस्ताक्षर दिखाता है।
टेबलों का क्या होता है?
टेक्स्ट लेयर वाले PDF में, प्रत्येक सेल का अपने आप अनुवाद किया जाता है और उसी सेल में वापस लिखा जाता है। स्कैन पर, इंजन छवि में मुद्रित ग्रिड को ढूंढता है, लाइनों को छुए बिना प्रत्येक सेल के अंदर के टेक्स्ट को साफ़ करता है, और अनुवाद को उस सेल में लिखता है जहाँ से वह आया था।
क्या अनुवादित फ़ाइल मूल की तरह ही दिखेगी?
लगभग वैसी ही, हालांकि हमेशा समान नहीं। एक अनुवाद आमतौर पर उसके स्रोत से लंबा या छोटा होता है, इसलिए टेक्स्ट अलग तरह से रैप हो सकता है या अपने बॉक्स में फिट होने के लिए थोड़ा छोटा सेट किया जा सकता है। एक घने पृष्ठ पर, जैसे कि एक तस्वीर वाली तालिका, फ़ाइल भेजने से पहले परिणाम पर एक त्वरित नज़र डालें।
DocTranslator किन भाषाओं का समर्थन करता है?
DocTranslator 108 भाषाओं का समर्थन करता है, और आप उनमें से किन्हीं दो के बीच अनुवाद कर सकते हैं। पूरी भाषा सूची हर एक को दिखाती है।
क्या मैं इसे वीज़ा या अदालत की फाइलिंग के लिए उपयोग कर सकता हूँ?
इंजन AI अनुवाद उत्पन्न करता है। आप्रवासन कार्यालय, अदालतें और विश्वविद्यालय आमतौर पर एक प्रमाणित अनुवाद मांगते हैं, जिस पर एक पेशेवर अनुवादक द्वारा हस्ताक्षर किए जाते हैं जो पुष्टि करता है कि यह सटीक और पूर्ण है। उसके लिए, हमारी प्रमाणित अनुवाद सेवा का उपयोग करें।
एक दस्तावेज़ का अनुवाद करें और लेआउट की स्वयं जाँच करें
एक PDF, एक स्कैन या एक Office फ़ाइल अपलोड करें, 108 भाषाओं में से दो चुनें और परिणाम की अपने मूल के साथ तुलना करें। प्रति दस्तावेज़ $0.99 से अनुवाद शुरू होता है।
संबंधित उपकरण
फ़ाइल प्रारूप
दस्तावेज़ प्रकार
