TXT अनुवादक
सादा पाठ किसी भी मार्कअप को सुरक्षित रखने के लिए कोई मार्कअप नहीं रखता है और न ही पालन करने के लिए कोई स्कीमा रखता है, जो इसे अनुवाद करने के लिए सबसे सरल और चुपचाप खराब करने के लिए सबसे आसान बनाता है। पांडुलिपियाँ, नोट्स, लेख ड्राफ्ट, साक्षात्कार प्रतिलेख, स्क्रैप किए गए लेख निकाय अपलोड करें और उन्हें कैरेक्टर एन्कोडिंग, लाइन ब्रेक और इंडेंटेशन बरकरार रखते हुए वापस प्राप्त करें।
अनुवाद के लिए दस्तावेज़ अपलोड या ड्रॉप करें
अधिकतम फ़ाइल आकार 1 GB
एक्सटेंशन लगभग कुछ भी वादा नहीं करता है
अन्य सभी दस्तावेज़ प्रारूप स्वयं का विवरण रखता है। एक वर्ड प्रोसेसर दस्तावेज़ अपने फ़ॉन्ट का नाम बताता है और अपने कैरेक्टर सेट की घोषणा करता है। मार्कअप का एक पृष्ठ अपने कंटेंट को टैग में लपेटता है जो बताता है कि प्रत्येक भाग क्या है। सादा पाठ उनमें से कोई भी घोषित नहीं करता है। यह बाइट्स का एक रन है जिसमें यह समझौता है कि कोई व्यक्ति उन्हें वर्णों के रूप में पढ़ेगा, और पूरा समझौता अलिखित है।
इसलिए तीन चीजों का अनुमान लगाने के बजाय पढ़ा जाना चाहिए: बाइट्स किस कैरेक्टर एन्कोडिंग से संबंधित हैं, लेखक ने लाइन समाप्त करने के लिए किस क्रम का उपयोग किया, और क्या लाइन ब्रेक सार्थक हैं या केवल किसी के संपादक विंडो की चौड़ाई हैं। सॉफ़्टवेयर हर बार जब आप ऐसे दस्तावेज़ खोलते हैं तो तीनों का अनुमान लगाता है, और यह आमतौर पर सही होता है, यही कारण है कि जब वे आते हैं तो विफलताएँ आश्चर्यजनक होती हैं।
इसका सकारात्मक पक्ष वास्तविक है। संरक्षित करने के लिए कोई स्टाइलिंग नहीं है, लड़ने के लिए कोई लेआउट इंजन नहीं है, खोने के लिए कोई एम्बेडेड ऑब्जेक्ट नहीं है। यदि एन्कोडिंग और लाइन संरचना बची रहती है, तो सब कुछ बच गया है। इस पृष्ठ का शेष भाग उन दो चीजों के बारे में है।
लोग वास्तव में सादे पाठ में क्या रखते हैं
एक्सटेंशन उन चीजों से जुड़ा होता है जो बिल्कुल भी गद्य नहीं हैं, और उनमें से प्रत्येक को एक अलग तरह की देखभाल की आवश्यकता होती है। यह जानना कि आप क्या पकड़ रहे हैं, यह तय करता है कि काम में एक मिनट लगता है या तैयारी की आवश्यकता होती है।
- निरंतर गद्य। पांडुलिपियाँ, नोट्स, लेख ड्राफ्ट, साक्षात्कार प्रतिलेख, स्क्रैप किए गए लेख निकाय। यह सीधा मामला है, और एकमात्र चीज जिस पर ध्यान देना है वह यह है कि पैराग्राफ एक खाली लाइन से या बिल्कुल भी अलग हैं या नहीं।
- उपशीर्षक और कैप्शन। क्रमांकित संकेत, एक टाइमिंग लाइन और एक या दो पंक्तियों का संवाद। टाइमिंग निर्देशांक हैं और उन्हें ठीक से पुन: प्रस्तुत किया जाना चाहिए, जबकि संवाद पंक्तियों को गति से पढ़ने के लिए पर्याप्त छोटा रहना चाहिए, जो महत्वपूर्ण है क्योंकि अनुवादित पंक्तियाँ अक्सर उन पंक्तियों से लंबी होती हैं जिन्हें वे बदलते हैं।
- सेटिंग्स और प्रॉपर्टी सूची। प्रत्येक पंक्ति पर एक कुंजी, एक विभाजक और एक मान। बाईं ओर की कुंजी एक पहचानकर्ता है जिसे सॉफ़्टवेयर नाम से देखता है; इसे छूने से सेटिंग चुपचाप अक्षम हो जाती है। केवल दाईं ओर का मान, और केवल जहाँ वह मान संदेश के बजाय पथ या स्विच है, भाषा है।
- लॉग और मशीन आउटपुट। टाइमस्टैम्प, गंभीरता शब्द, पहचानकर्ता और स्टैक ट्रेस। किसी गंभीरता शब्द का अनुवाद करने से कोई भी फ़िल्टर टूट जाता है जो उसे ग्रैप करता है, और स्टैक ट्रेस किसी भी भाषा में गद्य नहीं है।
- छिपे हुए टेबल निर्यात। टैब द्वारा अलग किए गए मान, गलत एक्सटेंशन के साथ सहेजे गए। यदि आपकी सामग्री वास्तव में एक ग्रिड है, तो यह इसके बजाय CSV अनुवादक में आती है, जो रिकॉर्ड और कॉलम को समझता है।
- रीड-मी नोट्स और लाइसेंस टेक्स्ट। बड़े अक्षरों और डैश की पंक्तियों, क्रमांकित खंडों और हार्ड-रैप्ड पैराग्राफ से बने हेडिंग वाले गद्य। नकली संरचना वह हिस्सा है जो टूट जाता है।
तीन अदृश्य गुण जो परिणाम तय करते हैं
इनमें से कोई भी स्क्रीन पर सामग्री को देखते समय दिखाई नहीं देता है, और उनमें से प्रत्येक एक अच्छे अनुवाद को अनुपयोगी बना सकता है।
बाइट्स किस एन्कोडिंग से संबंधित हैं
यूनिकोड के डिफ़ॉल्ट बनने से पहले, प्रत्येक भाषा क्षेत्र की अपनी एकल-बाइट या बहु-बाइट योजना थी: सिरिलिक के लिए अलग, पश्चिमी यूरोपीय एक्सेंट के लिए, ग्रीक के लिए, जापानी के लिए, सरलीकृत और पारंपरिक चीनी के लिए, कोरियाई के लिए। उन योजनाओं के तहत लिखे गए दस्तावेज़ अभी भी प्रचलन में हैं, और उनमें से कोई भी यह नहीं कहता है कि कौन सी लागू होती है। गलत धारणा के तहत एक खोलें और एक्सेंटेड वर्ण बकवास के रन में बदल जाते हैं जबकि सादे अक्षर ठीक दिखते हैं, इसलिए नुकसान को एक त्वरित नज़र में याद करना आसान है। एक संपादक में जाँचें जो आपको एन्कोडिंग को स्पष्ट रूप से चुनने देता है, और एक्सेंट और गैर-लैटिन वर्णों के सही ढंग से पढ़े जाने तक फिर से खोलें।
एक लाइन कैसे समाप्त होती है
विंडोज टूल एक लाइन को दो नियंत्रण वर्णों के साथ समाप्त करते हैं, यूनिक्स से अवतरित सब कुछ एक का उपयोग करता है, और बहुत पुराने मैकिन्टोश दस्तावेज़ों ने अपने आप में दूसरे का उपयोग किया। अधिकांश आधुनिक संपादक तीनों को स्वीकार करते हैं, लेकिन कई प्रसंस्करण स्क्रिप्ट नहीं करते हैं, और एक दस्तावेज़ के अंदर सम्मेलनों को मिलाना वह है जो हर लाइन के अंत में अवांछित निशान पैदा करता है या एक दस्तावेज़ जो एक एकल अटूट पैराग्राफ के रूप में प्रदर्शित होता है। पूरे में एक सम्मेलन रखें, और उस प्रणाली को प्राथमिकता दें जिसकी परिणाम का उपभोग करने की अपेक्षा है।
क्या लाइन ब्रेक का कोई मतलब है
हाथ से एक निश्चित चौड़ाई पर लपेटी गई टेक्स्ट में हर लाइन के अंत में एक ब्रेक होता है, और वे ब्रेक लेखन का हिस्सा होने के बजाय चौड़ाई का एक कलाकृत हैं। एक पैराग्राफ सामान्यतः ब्लॉकों के बीच एक खाली लाइन द्वारा चिह्नित होता है। प्रत्येक लपेटी हुई लाइन को एक इकाई के रूप में मानना वाक्यों को टुकड़ों में काटता है और उन्हें संदर्भ से बाहर अनुवादित करता है, जो किसी भी भाषा में खराब लगता है। पैराग्राफ को इकाई के रूप में रखना सही है, और इसका मतलब है कि आउटपुट मूल से अलग बिंदुओं पर फिर से लपेटेगा। यह अपेक्षित है, दोष नहीं।
स्पेस के साथ संरेखित कुछ भी गलत संरेखित निकलेगा
कॉलम क्यों खिसक जाते हैं
स्टाइलिंग के बिना, किसी भी चीज़ को एक सीध में लाने का एकमात्र तरीका वर्णों को गिनना है। पाइप और डैश से बने टेबल, बराबर चिह्नों की पंक्तियों से रेखांकित हेडिंग, स्पेस से भरे हुए लेजर, इंडेंटेड आउटलाइन और लाइन-ड्राइंग वर्णों से बने बॉक्स, ये सभी इस बात पर निर्भर करते हैं कि प्रत्येक प्रविष्टि पहले के समान चौड़ाई ले।
अनुवाद लगभग हर चीज़ की चौड़ाई बदल देता है। जर्मन और रूसी आमतौर पर अंग्रेजी से एक-पांचवें से एक-तिहाई तक लंबे होते हैं; चीनी और जापानी कम वर्ण लेते हैं लेकिन प्रत्येक एक निश्चित-चौड़ाई वाले डिस्प्ले में दो कॉलम लेता है। किसी भी तरह से संरेखण बदल जाता है। हाथ से खींचे गए टेबल को बाद में फिर से पैड करने की उम्मीद करें, और विचार करें कि क्या सामग्री को इसके बजाय एक वास्तविक स्प्रेडशीट की आवश्यकता है।
अग्रणी व्हाइटस्पेस सामग्री है
एक सेटिंग्स दस्तावेज़ में, कोड के एक स्निपेट में, और किसी भी रूपरेखा में, पंक्ति की शुरुआत में रिक्त स्थान का अर्थ होता है: वे नेस्टिंग दिखाते हैं, या वे एक ब्लॉक को शाब्दिक के रूप में चिह्नित करते हैं। एक टैब और रिक्त स्थान की एक श्रृंखला स्क्रीन पर समान दिखती है और अलग-अलग बाइट्स होती है, इसलिए एक टूल जो एक को दूसरे में सामान्य करता है, दस्तावेज़ को बिना दिखाई दिए बदल देता है।
यही बात छोटे एस्केप अनुक्रमों पर भी लागू होती है जो एक बैकस्लैश और एक अक्षर के रूप में लिखे जाते हैं, जो एक सेटिंग्स प्रविष्टि की एकल पंक्ति के भीतर एक नई पंक्ति या टैब का प्रतिनिधित्व करते हैं। वे दो सामान्य वर्ण हैं जिन्हें बाद में कोई प्रोग्राम व्याख्या करेगा, और उन्हें दूसरी तरफ अपरिवर्तित पहुंचना चाहिए।
एक सादे पाठ कार्य के लिए लागत
दस्तावेज़ में शब्दों पर शुल्क लिया जाता है, इसलिए कुछ अद्वितीय संदेशों के साथ एक लंबा लॉग इसके आकार का सुझाव देने की तुलना में बहुत कम लागत वाला होता है।
Free
साइन अप करने के लिए कार्ड की आवश्यकता नहीं है
- $0.005/शब्द AI अनुवाद
- स्कैन और इमेज PDF के लिए $1 प्रति पृष्ठ
- 120+ भाषाएँ
- 20 MB और 20 पृष्ठों तक की फ़ाइलें
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG और CSV
- केवल 24-घंटे फ़ाइल स्टोरेज
- PDF संपादक और PDF से DOCX कनवर्टर
- कभी भी रद्द करें
- शामिल नहीं: ईमेल सहायता
- शामिल नहीं: टीम एक्सेस
- शामिल नहीं: असीमित मुफ्त PDF पूर्वावलोकन
- शामिल नहीं: शब्दावली
Storage
या $149/वर्ष
- $0.005/शब्द AI अनुवाद
- स्कैन और इमेज PDF के लिए $1 प्रति पृष्ठ
- 120+ भाषाएँ
- 100 MB और 100 पृष्ठों तक की फ़ाइलें
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG और CSV
- असीमित फ़ाइल संग्रहण
- PDF संपादक और PDF से DOCX कनवर्टर
- ईमेल सहायता
- कभी भी रद्द करें
- शामिल नहीं: टीम एक्सेस
- शामिल नहीं: असीमित मुफ्त PDF पूर्वावलोकन
- शामिल नहीं: शब्दावली
Pro
या $499/वर्ष
- $0.004/शब्द AI अनुवाद
- स्कैन और इमेज PDF के लिए $0.80 प्रति पृष्ठ
- 120+ भाषाएँ
- 1,000 MB और 5,000 पृष्ठों तक की फ़ाइलें
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG और CSV
- असीमित फ़ाइल संग्रहण
- PDF संपादक और PDF से DOCX कनवर्टर
- ईमेल सहायता
- 5 सदस्यों तक के लिए टीम एक्सेस
- असीमित मुफ्त PDF पूर्वावलोकन
- शब्दावली
- कभी भी रद्द करें
एंटरप्राइज
$149.99/माह, अनुरोध पर। $0.003/शब्द पर AI अनुवाद ($0.60 प्रति पृष्ठ), 1,000 MB और 5,000 पृष्ठों तक की फ़ाइलें, असीमित फ़ाइल स्टोरेज और 15 सदस्यों तक के लिए टीम एक्सेस।
नमूना दस्तावेज़, अगल-बगल
पूर्ण दृश्य खोलने के लिए एक थंबनेल पर क्लिक करें। एक जोड़ी में पढ़ने से पता चलता है:
- पैराग्राफ ब्रेक और खाली-लाइन स्पेसिंग वहीं उतरते हैं जहां वे पहले थे।
- उच्चारण और गैर-लैटिन वर्ण प्रतीकों में खराब होने के बजाय प्रस्तुत होते हैं।
- इंडेंटेशन और क्रमांकित अनुक्रम अपनी नेस्टिंग बनाए रखते हैं।
- परिणाम पाठ की तस्वीर के रूप में नहीं, बल्कि संपादन योग्य पाठ के रूप में खुलता है।




प्रत्येक जोड़ी बिना किसी मैन्युअल मरम्मत के एक ही अपलोड से आई है।
सभी अनुवाद उदाहरण देखें →तैयारी का पांच मिनट, फिर अपलोड
लगभग हर शिकायत सादे पाठ अनुवाद के बारे में उन चीजों पर वापस जाती है जो अपलोड होने से पहले दस्तावेज़ के लिए पहले से ही सच थीं। ये जांच उन सभी को पकड़ लेती हैं।
- 1
सुनिश्चित करें कि एन्कोडिंग सही ढंग से पढ़ती है
एक संपादक में दस्तावेज़ खोलें जो एन्कोडिंग दिखाता है और आपको बदलने देता है। यदि उच्चारण या गैर-लैटिन वर्ण असंबंधित प्रतीकों के अनुक्रमों की तरह दिखते हैं, तो आप इसे गलत योजना के तहत पढ़ रहे हैं। पहले उसे ठीक करें और यूनिकोड कॉपी सहेजें, क्योंकि कोई भी अनुवाद उन वर्णों को पुनर्प्राप्त नहीं कर सकता है जिन्हें पहले से ही गलत पढ़ा गया था।
- 2
तय करें कि क्या गद्य है और क्या नहीं
जहां सामग्री सेटिंग्स, लॉग या उपशीर्षक है, उन हिस्सों की पहचान करें जिन्हें अछूता रहना चाहिए: एक विभाजक के बाईं ओर कुंजियाँ, गंभीरता शब्द, क्यू नंबर और समय रेखाएँ। यदि दस्तावेज़ का अधिकांश भाग मशीन सामग्री है जिसमें थोड़ा गद्य है, तो गद्य को पहले निकालना परिणाम को ठीक करने की तुलना में तेज़ है।
- 3
एक खाता बनाएं और अपलोड करें
एक ईमेल पते के साथ साइन अप करें और दस्तावेज़ भेजें। एकल अपलोड 1 GB तक चलते हैं, जो पांडुलिपियों, ट्रांसक्रिप्ट अभिलेखागार और लॉग निर्यात को भागों में विभाजित किए बिना कवर करता है।
- 4
दोनों भाषाओं को सेट करें और अनुवाद करें
स्रोत का नामकरण यहां एक स्वरूपित दस्तावेज़ की तुलना में अधिक मायने रखता है, क्योंकि अनुमान लगाने के लिए कोई मार्कअप और कोई मेटाडेटा नहीं है। फिर लक्ष्य चुनें और कार्य शुरू करें।
- 5
परिणाम को फिर से खोलें और उन्हीं तीन चीजों की जांच करें
एन्कोडिंग, लाइन एंडिंग, और क्या हाथ से संरेखित किसी भी चीज़ को फिर से पैड करने की आवश्यकता है। यदि दस्तावेज़ बिल्ड पाइपलाइन या मीडिया प्लेयर में जा रहा है, तो उस पर भरोसा करने से पहले उसे एक बार उस पाइपलाइन के माध्यम से चलाएं।
यदि आपकी सामग्री वास्तव में सादा पाठ नहीं है
सादे टेक्स्ट के बारे में सामान्य प्रश्न
मेरा दस्तावेज़ एक्सेंटेड अक्षरों के बजाय अजीब प्रतीकों से भरा हुआ आया। क्यों?
यह एक एन्कोडिंग बेमेल है और यह लगभग हमेशा अनुवाद से पहले होता है। एक पुराने क्षेत्रीय योजना के तहत लिखे गए बाइट्स, यूनिकोड के रूप में पढ़े जाते हैं, ठीक उसी पैटर्न का उत्पादन करते हैं: सादे अक्षर सही दिखते हैं जबकि एक्सेंटेड और गैर-लैटिन वर्ण असंबंधित प्रतीकों की श्रृंखलाओं में बदल जाते हैं। मूल को एक ऐसे संपादक में खोलें जो आपको एन्कोडिंग चुनने देता है, वह ढूंढें जो इसे सही ढंग से प्रस्तुत करता है, एक यूनिकोड प्रतिलिपि सहेजें और वहां से शुरू करें।
क्या मेरे लाइन ब्रेक बाद में भी उसी स्थान पर रहेंगे?
पैराग्राफ की सीमाएँ रहेंगी। व्यक्तिगत रूप से लपेटी गई लाइनें नहीं रहेंगी, और न ही रह सकती हैं, क्योंकि अनुवादित शब्दावली अलग-अलग वर्णों की संख्या में होती है। जहां मूल को एक निश्चित कॉलम चौड़ाई पर हाथ से लपेटा गया था, परिणाम अलग-अलग बिंदुओं पर टूटेगा। यदि दस्तावेज़ जहां जा रहा है उसके लिए कोई विशिष्ट चौड़ाई मायने रखती है, तो अनुवाद के बाद इसे उस टूल से फिर से लपेटें जो इसे उपभोग करता है।
क्या मैं इस तरह से एक उपशीर्षक दस्तावेज़ का अनुवाद कर सकता हूँ?
हाँ, और दो बातों पर ध्यान देने की आवश्यकता है। क्यू संख्याएँ और समय रेखाएँ शब्दों के बजाय निर्देशांक हैं और उन्हें वैसे ही बने रहना चाहिए, और अनुवादित संवाद अक्सर मूल से लंबा होता है, जो एक लाइन को उस समय से आगे धकेल सकता है जो एक दर्शक उपलब्ध समय में पढ़ सकता है। सबसे लंबी लाइनों की तुलना उपलब्ध समय से करें और जहां एक क्यू बहुत सघन हो गया है उसे छोटा करें।
सेटिंग्स या गुण दस्तावेज़ के बारे में क्या?
केवल दाहिना पक्ष भाषा है, और वह भी सब नहीं। विभाजक से पहले की कुंजी एक पहचानकर्ता है जिसे सॉफ़्टवेयर नाम से ढूंढता है, इसलिए इसका अनुवाद करने से सेटिंग चुपचाप अक्षम हो जाती है। फ़ाइल पथ, स्विच, संख्याएँ या अन्य कुंजियों के संदर्भ वाले मान भी गद्य नहीं हैं। जहां एक दस्तावेज़ ज्यादातर संदेशों के साथ कुंजी है, संदेशों को पहले निकालना पूरे परिणाम की जाँच करने से तेज़ है।
मेरी हाथ से बनाई गई तालिका का संरेखण बिगड़ गया। क्या इससे बचा जा सकता है?
सादे पाठ में नहीं, क्योंकि वहां संरेखण गिने हुए रिक्त स्थान से बना होता है और अनुवाद वाक्यांशों द्वारा लिए जाने वाले वर्णों की संख्या को बदल देता है। जर्मन और रूसी आमतौर पर फैलते हैं, चीनी और जापानी सिकुड़ते हैं जबकि प्रत्येक एक दो डिस्प्ले कॉलम लेता है। बाद में पैडिंग करना इसका समाधान है। किसी भी वास्तविक सारणीबद्ध चीज़ के लिए, स्प्रेडशीट या अल्पविराम-पृथक निर्यात एक बेहतर घर है।
मैं कितना बड़ा दस्तावेज़ अपलोड कर सकता हूँ?
Pro और Enterprise प्लान पर एक सिंगल अपलोड 1 GB या पांच हजार पेजों की बराबर सामग्री तक पहुंच सकता है, इसलिए पूरी लंबाई की पांडुलिपियां, ट्रांसक्रिप्ट संग्रह और लंबे एक्सपोर्ट एक ही बार में हो जाते हैं। इसे टुकड़ों के बजाय पूरा भेजने से पहले पेज से आखिरी पेज तक आवर्ती शब्दावली सुसंगत रहती है।
क्या परिणाम संपादन योग्य है, या एक छवि?
संपादन योग्य। जो वापस आता है वह एक टेक्स्ट दस्तावेज़ है जिसे आप किसी भी संपादक में खोल सकते हैं और उसमें काम करना जारी रख सकते हैं, जिसमें मूल के समान वर्ण सामग्री और संरचना होती है। कुछ भी रास्टराइज़ नहीं किया गया है और कुछ भी लॉक नहीं है।
एक लंबे दस्तावेज़ के लिए इसकी लागत कितनी है?
कीमतें बाइट काउंट के बजाय वर्ड काउंट के अनुसार होती हैं। प्रत्येक दस्तावेज़ को Free और Storage पर $0.005 प्रति शब्द, Pro पर $0.004 या Enterprise पर $0.003 पर बिल किया जाता है, जिसमें $0.99 न्यूनतम है, और एक सब्सक्रिप्शन में स्टोरेज और उच्च सीमाएं जोड़ी जाती हैं लेकिन इसमें कोई अनुवाद शामिल नहीं होता है। इसलिए शुरू करने से पहले पांडुलिपि का अनुमान सीधे उसके शब्द गणना से लगाया जा सकता है।
दस्तावेज़ भेजें, संरचना बनाए रखें
एन्कोडिंग की जाँच करें, अपलोड करें, भाषाएँ चुनें, और पैराग्राफ, इंडेंटेशन और गैर-लैटिन वर्णों के साथ संपादन योग्य टेक्स्ट वापस प्राप्त करें जहाँ वे संबंधित हैं।
हमारे भागीदार
संबंधित अनुवाद सेवाएँ
फ़ाइल प्रारूप
PDF उपकरण
