हमारी अपनी दस्तावेज़ अनुवाद तकनीक

DocTranslator AI Engine

DocTranslator AI Engine वह दस्तावेज़ अनुवाद तकनीक है जिसे हम स्वयं विकसित करते हैं। जहाँ अधिकांश अनुवाद उपकरण सादे टेक्स्ट के साथ काम करते हैं, यह वाला पृष्ठ के साथ काम करता है: यह पता लगाता है कि प्रत्येक पंक्ति कहाँ स्थित है, उसका अनुवाद करता है और अनुवाद को उसी स्थान पर वापस लिखता है, इसलिए आपके द्वारा डाउनलोड की गई फ़ाइल में वही लेआउट होता है जो आपने अपलोड की थी।

इसे DocTranslator टीम द्वारा डिज़ाइन और लिखा गया है।

यह कैसे काम करता है

अपलोड से तैयार फ़ाइल तक चार चरण

  1. 01

    पढ़ें

    फ़ाइल पढ़ें

    इंजन फ़ाइल को उसके नाम के बजाय उसकी सामग्री से पहचानता है: एक वास्तविक टेक्स्ट लेयर वाला PDF, एक स्कैन, एक तस्वीर या एक Office दस्तावेज़। प्रत्येक प्रकार एक अलग रास्ते से जाता है।

  2. 02

    अलग करें

    पृष्ठ से शब्दों को अलग करें

    केवल टेक्स्ट को निकाला जाता है। चित्र, आरेख, चार्ट, तस्वीरें, हस्ताक्षर और मुहरें जहाँ हैं वहीं रहती हैं और कभी भी अनुवाद के लिए नहीं भेजी जातीं।

  3. 03

    अनुवाद करें

    अनुवाद करें और जाँचें

    प्रत्येक अंश का अनुवाद किया जाता है और स्वीकार किए जाने से पहले उसकी जाँच की जाती है। जाँच में असफल रहने वाले अंश का फिर से अनुवाद किया जाता है।

  4. 04

    पुनर्निर्माण करें

    पृष्ठ को फिर से बनाएँ

    अनुवाद मूल स्थानों पर वापस चला जाता है, उन फ़ॉन्ट में सेट किया जाता है जिनमें लक्ष्य भाषा के अक्षर होते हैं।

A · डिजिटल PDF

टेक्स्ट लेयर वाले PDF

Word, InDesign या इसी तरह के प्रोग्राम से निर्यात किए गए PDF में, इंजन टेक्स्ट को ब्लॉक दर ब्लॉक और तालिका सेल दर सेल पढ़ता है। यह अनुवाद करने से पहले एक पैराग्राफ की पंक्तियों को एक अंश में जोड़ता है, इसलिए तीन पंक्तियों में फैलने वाला वाक्य तीन टुकड़ों के बजाय एक वाक्य के रूप में अनुवादित होता है। फिर यह पृष्ठ से मूल शब्दों को हटा देता है, छवियों, आरेखों और वेक्टर ड्राइंग को अछूता छोड़ देता है, और अनुवाद को उसी बॉक्स में लिखता है।

एक अनुवाद शायद ही कभी उसके स्रोत के समान लंबाई का होता है। जर्मन और रूसी आमतौर पर अंग्रेजी से लंबे होते हैं, और चीनी और जापानी कम अक्षर लेते हैं। इंजन टेक्स्ट को उसके मूल ब्लॉक के भीतर लपेटने देता है और फ़ॉन्ट आकार को केवल तभी कम करता है जब अनुवाद अभी भी फिट नहीं होता है। तालिका सेल एक-एक करके संभाले जाते हैं, इसलिए आंकड़े अपनी पंक्तियों और स्तंभों में बने रहते हैं।

तीन पंक्तियों का एक अनुच्छेद बन जाता है, और लंबा अनुवाद मूल पाठ के बॉक्स के अंदर फिट हो जाता है।

B · स्कैन और फ़ोटो

स्कैन और तस्वीरें

01स्कैन किया गया पृष्ठ, पृष्ठभूमि छवि के रूप में रखा गया।
02केवल शब्दों की स्याही का चयन किया जाता है। स्टाम्प, रेखाएँ और हस्ताक्षर छोड़ दिए जाते हैं।
03अनुवाद मूल कागज पर उसी स्थान पर वापस लिखा जाता है।

एक स्कैन किया गया पृष्ठ एक तस्वीर होती है, इसलिए उसमें बदलने के लिए कोई टेक्स्ट नहीं होता है। इंजन मूल छवि को पृष्ठ की पृष्ठभूमि के रूप में रखता है, मुद्रित टेक्स्ट को OCR के साथ पहचानता है, और फिर केवल उन अक्षरों की स्याही को हटा देता है, प्रत्येक स्थान को उसके चारों ओर के कागज के रंग से भर देता है। जो कुछ भी रनिंग टेक्स्ट नहीं है उसे अकेला छोड़ दिया जाता है। मुहरें, सील, हस्ताक्षर, तस्वीरें, चार्ट और आरेख ठीक वैसे ही रहते हैं जैसे उन्हें स्कैन किया गया था, जो आप किसी प्रमाण पत्र या हस्ताक्षरित अनुबंध पर चाहते हैं।

तालिकाएँ अपनी मुद्रित ग्रिड बनाए रखती हैं। इंजन छवि में मूल तालिका की रेखाओं को ढूंढता है, सीमाओं को छुए बिना प्रत्येक सेल के अंदर के टेक्स्ट को साफ़ करता है, और उसी सेल में अनुवाद लिखता है। किसी मार्जिन के साथ तिरछे छपी रेखा को तिरछे वापस लिखा जाता है।

कभी-कभी एक रेखा को साफ-सुथरा मिटाया नहीं जा सकता है, उदाहरण के लिए जहाँ टेक्स्ट एक व्यस्त पृष्ठभूमि पर स्थित है। उस स्थिति में इंजन उसे धब्बा लगाने के बजाय मूल प्रिंट को वैसे ही छोड़ देता है, और टेक्स्ट की एक अदृश्य प्रति जोड़ता है ताकि पृष्ठ अभी भी खोजा जा सके।

C · संरचित फ़ाइलें

Word, Excel, PowerPoint, EPUB और HTML

Office फ़ाइलें पहले से ही अपने लेआउट से अलग अपना टेक्स्ट रखती हैं, इसलिए इंजन उन्हें अंदर से अनुवाद करता है। यह प्रत्येक पैराग्राफ, स्लाइड और स्प्रेडशीट सेल के शब्दों को बदल देता है और उन शब्दों पर बोल्ड, इटैलिक और अन्य स्वरूपण को बनाए रखता है जिनसे वे संबंधित थे, भले ही अनुवाद उन शब्दों को अलग क्रम में रखता हो।

EPUB पुस्तकें और HTML पृष्ठ टेक्स्ट दर टेक्स्ट अनुवादित होते हैं, और उनका मार्कअप वैसे ही छोड़ दिया जाता है, इसलिए अध्याय, शीर्षक और लिंक अनुवादित प्रति में काम करते रहते हैं।

ENThe report is ready today.
↓
DEDer Bericht ist heute fertig.

बोल्ड शब्द जर्मन वाक्य के अंत में चला जाता है, और उसका स्वरूपण उसके साथ चला जाता है।

गुणवत्ता

फ़ाइल वापस आने से पहले जाँच

AI अनुवाद उन तरीकों से विफल हो सकता है जिन्हें एक त्वरित पठन में याद करना आसान होता है, इसलिए इंजन स्वीकार करने से पहले प्रत्येक अंश की जाँच करता है:

  1. reject एक उत्तर जो मूल का अनुवाद करने के बजाय उसे दोहराता है, उसे अस्वीकार कर दिया जाता है।
  2. reject गलत भाषा में एक उत्तर, जो लूप होता है या आधा रुक जाता है, और दूसरे स्क्रिप्ट से अवांछित अक्षर वाला उत्तर भी।
  3. retry एक अस्वीकृत अंश का फिर से अनुवाद किया जाता है, पहले संदर्भ के लिए उसके आसपास की पंक्तियों के साथ, फिर अपने आप।
  4. compare संख्याएँ, वेब पते और ईमेल पते मूल और अनुवाद के बीच तुलना की जाती है, इसलिए एक बदली हुई आकृति को चिह्नित किया जाता है।
  5. reuse एक वाक्य जो कई पृष्ठों पर दिखाई देता है, उसे एक बार अनुवादित किया जाता है, इसलिए एक शीर्षक या शब्द दस्तावेज़ में हर जगह एक जैसा पढ़ा जाता है।
  6. discard यदि किसी दस्तावेज़ का एक बड़ा हिस्सा बिना अनुवाद के वापस आता है, तो इंजन आधे-अनुवादित फ़ाइल सौंपने के बजाय उस परिणाम को फेंक देता है।

DocTranslator द्वारा निर्मित और संचालित

हमारा अपना कोड, पृष्ठ को पढ़ने से लेकर उसे पुनर्निर्मित करने तक।

इंजन DocTranslator टीम द्वारा विकसित किया गया है। पेज विश्लेषण, स्कैन और तालिकाओं की हैंडलिंग, प्रत्येक पेज का पुनर्निर्माण और उपरोक्त जांच हमारा अपना कोड है। क्योंकि हम इंजन स्वयं लिखते हैं, इसलिए शिफ्ट की गई तालिका या गायब अक्षर जैसी समस्या को इंजन में ही ठीक किया जा सकता है।

चीनी, जापानी, कोरियाई, हिंदी, थाई और अन्य लिपियों में अनुवाद उन फ़ॉन्ट में सेट किए जाते हैं जिनमें वे अक्षर होते हैं, इसलिए आपको खाली बक्से नहीं मिलते जहाँ अक्षर होने चाहिए। केवल वे अक्षर जो दस्तावेज़ वास्तव में उपयोग करता है, एम्बेड किए जाते हैं, जो फ़ाइल आकार को कम रखता है।

DocTranslator AI Engine FAQ

क्या DocTranslator AI Engine DocTranslator द्वारा बनाया गया है?

हाँ। इंजन DocTranslator टीम द्वारा इन-हाउस विकसित किया गया है। पेज विश्लेषण, स्कैन हैंडलिंग, लेआउट पुनर्निर्माण और गुणवत्ता जांच हमारा अपना कोड है।

क्या यह स्कैन किए गए दस्तावेज़ों पर स्टैम्प, सील और हस्ताक्षर रखता है?

हाँ। इंजन केवल पहचाने गए रनिंग टेक्स्ट की स्याही को हटाता है। स्टैम्प, सील, हस्ताक्षर, फ़ोटो, चार्ट और आरेख वैसे ही छोड़ दिए जाते हैं जैसे उन्हें स्कैन किया गया था, इसलिए अनुवाद के बाद भी एक प्रमाण पत्र अपनी सील और एक अनुबंध अपने हस्ताक्षर दिखाता है।

टेबलों का क्या होता है?

टेक्स्ट लेयर वाले PDF में, प्रत्येक सेल का अपने आप अनुवाद किया जाता है और उसी सेल में वापस लिखा जाता है। स्कैन पर, इंजन छवि में मुद्रित ग्रिड को ढूंढता है, लाइनों को छुए बिना प्रत्येक सेल के अंदर के टेक्स्ट को साफ़ करता है, और अनुवाद को उस सेल में लिखता है जहाँ से वह आया था।

क्या अनुवादित फ़ाइल मूल की तरह ही दिखेगी?

लगभग वैसी ही, हालांकि हमेशा समान नहीं। एक अनुवाद आमतौर पर उसके स्रोत से लंबा या छोटा होता है, इसलिए टेक्स्ट अलग तरह से रैप हो सकता है या अपने बॉक्स में फिट होने के लिए थोड़ा छोटा सेट किया जा सकता है। एक घने पृष्ठ पर, जैसे कि एक तस्वीर वाली तालिका, फ़ाइल भेजने से पहले परिणाम पर एक त्वरित नज़र डालें।

DocTranslator किन भाषाओं का समर्थन करता है?

DocTranslator 108 भाषाओं का समर्थन करता है, और आप उनमें से किन्हीं दो के बीच अनुवाद कर सकते हैं। पूरी भाषा सूची हर एक को दिखाती है।

क्या मैं इसे वीज़ा या अदालत की फाइलिंग के लिए उपयोग कर सकता हूँ?

इंजन AI अनुवाद उत्पन्न करता है। आप्रवासन कार्यालय, अदालतें और विश्वविद्यालय आमतौर पर एक प्रमाणित अनुवाद मांगते हैं, जिस पर एक पेशेवर अनुवादक द्वारा हस्ताक्षर किए जाते हैं जो पुष्टि करता है कि यह सटीक और पूर्ण है। उसके लिए, हमारी प्रमाणित अनुवाद सेवा का उपयोग करें।

एक दस्तावेज़ का अनुवाद करें और लेआउट की स्वयं जाँच करें

एक PDF, एक स्कैन या एक Office फ़ाइल अपलोड करें, 108 भाषाओं में से दो चुनें और परिणाम की अपने मूल के साथ तुलना करें। प्रति दस्तावेज़ $0.99 से अनुवाद शुरू होता है।

यह भी देखें

संबंधित उपकरण