CSV अनुवादक
उत्पादन कॅटलॉग, निर्यात आणि डेटासेट स्तंभानुसार स्तंभ अनुवादित केले जातात, डेलिमिटर्स, कोटिंग आणि आयडेंटिफायर स्तंभ जसे आहेत तसे ठेवले जातात जेणेकरून तुमचा पार्सर त्यांना शोधू शकेल.
भाषांतरित करण्यासाठी दस्तऐवज अपलोड करा किंवा ड्रॉप करा
कमाल फाइल आकार 1 GB
दोन वर्णांवर रचनेचा आधार आहे
कॉमा-सेपरेटेड व्हॅल्यूज (CSV) हे फारसे स्वरूप नाही. सामान्य बोलीभाषेचे एक व्यापकपणे अनुसरण केलेले वर्णन आहे, परंतु कोणताही अधिकार ते लागू करत नाही, त्यामुळे तुम्हाला प्रत्यक्षात जे मिळते ते अनेक पद्धतींपैकी एक आहे. संपूर्ण ग्रिड दोन निर्णयांवर आधारित आहे: कोणता वर्ण रेकॉर्डमधील फील्ड वेगळे करतो आणि कोणती क्रमवारी रेकॉर्ड समाप्त करते. यापैकी कोणतीही चूक झाल्यास एक व्यवस्थित टेबल एकाच विस्कळीत कॉलममध्ये बदलते.
सेपरेटर नेहमी कॉमा नसतो. ज्या देशांमध्ये दशांश (decimals) कॉमा वापरून लिहिले जातात, त्या देशांमधील स्प्रेडशीट सॉफ्टवेअर डिफॉल्टनुसार सेमीकोलन वापरते, म्हणूनच जर्मन किंवा फ्रेंच मशीनमधून केलेली निर्यात अनेकदा इतरत्र व्यवस्थित उघडण्यास नकार देते. टॅब आणि व्हर्टिकल बार दोन्ही सामान्यतः वापरले जातात, कारण त्यातील मजकूर कॉमांनी भरलेला असतो.
प्रत्येक रेकॉर्डमध्ये हेडरसारखीच फील्ड संख्या असणे आवश्यक आहे, कारण पार्सरला कोणता व्हॅल्यू कोणत्या कॉलमचा आहे हे समजण्यासाठी ती संख्या वापरली जाते. डेटामध्ये हे काहीही सूचित करत नाही. हे एक असे अपरिवर्तनीय (invariant) आहे जे एकतर टिकून राहते किंवा मोठ्या निर्यातीच्या मध्यभागी शांतपणे टिकणे थांबवते, ज्या क्षणी खालील सर्व काही एका कॉलमने डावीकडे सरकते आणि संभाव्य दिसते.
भाषांतरित मजकूर रेकॉर्ड तोडण्याचे चार मार्ग
या अशा त्रुटी आहेत ज्या स्वतःला घोषित करत नाहीत. निर्यात अजूनही उघडते, ओळींची संख्या अंदाजे योग्य दिसते आणि डेटा वापरणाऱ्या कोणत्याही गोष्टीत नंतर नुकसान दिसून येते.
- एका व्हॅल्यूमध्ये नवीन सेपरेटर दिसतो. कॉमा नसलेले इंग्रजी उत्पादन वर्णन दोन कॉमा असलेले फ्रेंच बनते. जर फील्ड आधी कोटेड (quoted) नसेल, तर आता ते असणे आवश्यक आहे, अन्यथा पार्सर एका व्हॅल्यूला तीन वाचतो आणि त्यानंतरचे सर्व कॉलम शिफ्ट करतो.
- कोटेड व्हॅल्यूमध्ये अवतरण चिन्ह येते. एन्क्लोज्ड फील्डमध्ये, अक्षरशः डबल कोट स्वतःला एस्केप करण्यासाठी दोनदा लिहावे लागते. वेगळे मार्क वापरून कोट करणाऱ्या भाषा आणि स्ट्रेट मार्क्सना टायपोग्राफिक मार्क्समध्ये रूपांतरित करणारी कोणतीही प्रक्रिया, फील्ड लवकर समाप्त करणाऱ्या व्हॅल्यूच्या मध्यभागी एस्केप नसलेले अक्षर सोडू शकते.
- सेलमध्ये नवीन ओळ येते. नवीन ओळीमध्ये रेकॉर्ड समाप्त होते, जोपर्यंत ती नवीन ओळ कोट्समध्ये नसेल. पॅराग्राफ ब्रेक मिळणारे अनुवादित मार्केटिंग कॉपी एका रेकॉर्डला दोनमध्ये विभाजित करेल आणि दुसऱ्या भागामध्ये फील्डची संख्या चुकीची असेल.
- एक प्लेसहोल्डर अनुवादित होतो. सॉफ्टवेअरसाठी असलेले स्ट्रिंग अनेकदा सबस्टिट्यूशन टोकन, अक्षराने सुरू होणारे टक्के चिन्ह, कंसात एक क्रमांकित स्लॉट, एक नावाचे व्हेरिएबल समाविष्ट करतात. ते रनटाइमवर घातल्या जाणाऱ्या व्हॅल्यूसाठीचे पत्ते आहेत, शब्द नाहीत, आणि एकाचे भाषांतर करणे म्हणजे व्हॅल्यू कधीही दिसणार नाही.
तुमचे अर्धे कॉलम भाषा नाहीत
डेटासेटमध्ये माणसांसाठी असलेला गद्य (prose) आणि मशीनसाठी असलेले की (keys) यांचे मिश्रण असते, आणि ते एकमेकांच्या शेजारी असतात, त्यांना वेगळे करण्यासाठी काहीही नसते, फक्त कॉलम हेडिंग असते. तुम्ही सुरू करण्यापूर्वी कोणते काय आहे हे ठरवा, कारण अनुवादित आयडेंटिफायर हे अनुवादित नसलेल्या वर्णनापेक्षा वाईट आहे.
यांना हात लावू नका
- हेडर रो स्वतःच, जिथे हेडिंग फील्ड नावे आहेत जी कोडद्वारे वापरली जातात, व्यक्तीला दाखवलेल्या लेबलांपेक्षा
- स्टॉक कोड, कॅटलॉग नंबर, युनिक आयडेंटिफायर आणि दोन डेटासेट जोडण्यासाठी की म्हणून वापरलेली कोणतीही गोष्ट
- वेब पत्ते आणि त्यातील स्लग भाग, कारण ते बदलल्याने लिंक आणि त्याची रँकिंग तुटते
- ऑर्डरची स्थिती किंवा होय-नाही फ्लॅग यासारख्या निश्चित यादीच्या तुलनेत सॉफ्टवेअरद्वारे वापरले जाणारे स्टेटस व्हॅल्यू
- देश, भाषा आणि चलन कोड, जे आधीच प्रमाणित संक्षिप्त रूपे आहेत
- वर्ष-महिना-दिवस क्रमाने लिहिलेल्या तारखा, संख्या आणि वाचण्याऐवजी पार्स केल्या जाणाऱ्या कोणत्याही गोष्टी
तुम्ही ज्यासाठी आला आहात त्या या गोष्टी आहेत
- उत्पादनांची शीर्षके आणि लांबलचक वर्णने, ज्यात सामान्यतः शब्दांची संख्या जास्त असते
- श्रेणी आणि संग्रह नावे जशी ग्राहकांना दिसतात
- अर्थपूर्ण गुणधर्म मूल्ये, जसे की रंग, साहित्य किंवा आकाराचा शब्द
- स्थानिकीकरणासाठी काढलेले इंटरफेस स्ट्रिंग, त्यांचे प्लेसहोल्डर वगळून
- पंक्ती म्हणून ठेवलेले समर्थन लेख, पूर्वनिर्धारित प्रतिसाद आणि ईमेल टेम्पलेट्स
- स्तंभ शीर्षके जिथे निर्यात एखाद्या व्यक्तीसाठी उघडली जावी अशी अपेक्षा आहे, प्रोग्रामसाठी नाही
दोन गोष्टी ज्या भाषांतर सुरू होण्यापूर्वी डेटा खराब करतात
स्प्रेडशीटमध्ये उघडणे
निर्यात उघडणे आणि पुन्हा सेव्ह करणे हे कॅटलॉग खराब करण्याचा सर्वात विश्वासार्ह मार्ग आहे. स्प्रेडशीट सॉफ्टवेअर प्रत्येक मूल्याचा प्रकार काय आहे याचा अंदाज लावते, आणि त्याचे अंदाज आत्मविश्वासाने आणि चुकीचे असतात:
- तेरा-अंकी उत्पादन क्रमांक वैज्ञानिक नोटेशनमध्ये बदलतो आणि त्याचे शेवटचे अंक कायमचे गमावतो
- शून्याने सुरू होणारा पोस्टल कोड शून्य गमावतो
- दिवस आणि महिना सारखी कोणतीही गोष्ट स्थानिक स्वरूपात तारखेनुसार पुन्हा लिहिली जाते
- पंधरा अंकांंपेक्षा मोठे लांब ओळख क्रमांक, शांतपणे, गोल केले जातात
तुम्हाला डेटा प्रथम तपासण्याची आवश्यकता असल्यास, आयात संवाद वापरा आणि ओळख स्तंभ मजकूर म्हणून सेट करा, प्रोग्रामला निर्णय घेऊ देण्याऐवजी. त्याहूनही उत्तम, तुमची प्रणाली जशी निर्यात तयार करते तशीच अपलोड करा.
बाइट ऑर्डर मार्क प्रश्न
डेटाच्या आत काहीही सांगत नाही की तो कोणता कॅरेक्टर एन्कोडिंग वापरतो, म्हणून तीन बाइट्सचे एक मार्कर कधीकधी एक सिग्नल देण्यासाठी अगदी सुरुवातीला ठेवले जाते. ते मार्कर मदत करते आणि हानी पोहोचवते, यावर अवलंबून की डेटा पुढे काय उघडेल.
विंडोजवरील स्प्रेडशीट सॉफ्टवेअर युनिकोड सामग्री ओळखण्यासाठी याचा वापर करते, आणि त्याशिवाय एक्सेंटेड आणि नॉन-लॅटिन वर्ण चिन्हांच्या स्ट्रिंग म्हणून बाहेर येतात. याउलट, अनेक प्रोग्रामिंग लायब्ररी ते काढत नाहीत, म्हणून पहिला स्तंभ शीर्षक तीन अदृश्य वर्णांसह समोर येतो आणि त्या शीर्षकावरील प्रत्येक लुकअप अयशस्वी होतो.
गंतव्यस्थानानुसार ठरवा: जर एखादी व्यक्ती स्प्रेडशीटमध्ये निकाल उघडणार असेल तर मार्कर ठेवा, जर प्रोग्राम वाचणार असेल तर ते काढून टाका. खराब झालेल्या एक्सेंटेड वर्णांबद्दलच्या जवळजवळ प्रत्येक प्रश्नाचे उत्तर या परिच्छेदात आहे.
डेटासेटवर प्रक्रिया करण्यासाठी किती खर्च येतो
मजकूराच्या व्हॉल्यूमनुसार किंमत ठरवली जाते, त्यामुळे लहान मूल्यांसह एक विस्तृत कॅटलॉग लांब वर्णनांनी भरलेल्या अरुंद कॅटलॉगपेक्षा स्वस्त असतो.
Free
साइन अप करण्यासाठी कार्डची आवश्यकता नाही
- $0.005/शब्द AI अनुवाद
- स्कॅन आणि इमेज PDF साठी प्रति पृष्ठ $1
- 120+ भाषा
- 20 MB पर्यंत आणि 20 पानांपर्यंतच्या फाइल्स
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG आणि CSV
- केवळ 24-तासांचे फाइल स्टोरेज
- PDF संपादक आणि PDF ते DOCX कन्व्हर्टर
- कधीही रद्द करा
- समाविष्ट नाही: ईमेल सपोर्ट
- समाविष्ट नाही: टीम ऍक्सेस
- समाविष्ट नाही: अमर्यादित मोफत PDF पूर्वावलोकन
- समाविष्ट नाही: शब्दसंग्रह
Storage
किंवा $149/वर्ष
- $0.005/शब्द AI अनुवाद
- स्कॅन आणि इमेज PDF साठी प्रति पृष्ठ $1
- 120+ भाषा
- 100 MB पर्यंत आणि 100 पानांपर्यंतच्या फाइल्स
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG आणि CSV
- अमर्यादित फाइल स्टोरेज
- PDF संपादक आणि PDF ते DOCX कन्व्हर्टर
- ईमेल सपोर्ट
- कधीही रद्द करा
- समाविष्ट नाही: टीम ऍक्सेस
- समाविष्ट नाही: अमर्यादित मोफत PDF पूर्वावलोकन
- समाविष्ट नाही: शब्दसंग्रह
Pro
किंवा $499/वर्ष
- प्रति शब्द $0.004 AI भाषांतर
- स्कॅन आणि इमेज PDF साठी प्रति पृष्ठ $0.80
- 120+ भाषा
- 1,000 MB पर्यंत आणि 5,000 पानांपर्यंतच्या फाइल्स
- DOCX, PDF, XLSX, PPTX, IDML, TXT, JPG, PNG आणि CSV
- अमर्यादित फाइल स्टोरेज
- PDF संपादक आणि PDF ते DOCX कन्व्हर्टर
- ईमेल सपोर्ट
- 5 सदस्यांपर्यंत टीम ऍक्सेस
- अमर्यादित मोफत PDF पूर्वावलोकन
- शब्दसंग्रह
- कधीही रद्द करा
एंटरप्राइज
$149.99/महिना, विनंतीनुसार. प्रति शब्द $0.003 दराने AI भाषांतर ($0.60 प्रति पृष्ठ), 1,000 MB पर्यंत आणि 5,000 पानांपर्यंतच्या फाइल्स, अमर्यादित फाइल स्टोरेज आणि 15 सदस्यांपर्यंत टीम ऍक्सेस.
पंक्ती आत, पंक्ती बाहेर
स्रोत पृष्ठ आणि त्याचे परिणाम यांची तुलना करण्यासाठी थंबनेल मोठे करा. जोड्या काय दर्शवतात:
- प्रति रेकॉर्ड स्तंभ संख्या वरपासून खालपर्यंत अपरिवर्तित आहे.
- अवतरण चिन्हात बंद केलेली मूल्ये अजूनही बंद आहेत.
- कोड, की आणि अंकीय मूल्ये न बदलता पास होतात.
- फक्त मानवी-वाचनीय स्तंभ नवीन भाषेत परत येतात.




दोन स्थितींमध्ये येथे काहीही स्प्रेडशीटमध्ये उघडले गेले नाही.
सर्व भाषांतर उदाहरणे पहा →पुन्हा काम टाळणारे एक कार्यक्षम ऑर्डर
कॅटलॉगचे स्थानिकीकरण एक पाइपलाइन आहे, आणि महागड्या चुका मध्यभागी होण्याऐवजी त्याच्या टोकांना होतात.
- 1
स्वच्छ निर्यात करा आणि बोलीभाषा नोंदवा
डेटाच्या मालकीच्या प्रणालीतून थेट निर्यात घ्या. स्प्रेडशीटमध्ये नाही, तर प्लेन टेक्स्ट एडिटरमध्ये एकदा उघडा आणि फील्ड वेगळे करणारे कॅरेक्टर कोणते आहे आणि मूल्ये अवतरण चिन्हात बंद आहेत की नाही हे नोंदवा.
- 2
तुम्हाला नको असलेले स्तंभ चिन्हांकित करा
ओळख क्रमांक, की, लिंक्स, स्थिती मूल्ये आणि कोड. जर निर्यात खूप विस्तृत असेल, तर गद्य असलेले स्तंभ कापून नंतर की वर पुन्हा जोडणे अनेकदा जलद असते.
- 3
तुमच्या भाषा अपलोड करा आणि निवडा
ईमेल पत्त्यासह खाते तयार करा, डेटा टाका आणि स्रोत आणि लक्ष्य सेट करा. अपलोड 1 GB पर्यंत चालतात, त्यामुळे संपूर्ण कॅटलॉग बॅचेसमध्ये विभागण्याऐवजी एकाच जॉबमध्ये जातो.
- 4
प्रथम स्टेजिंग कॉपीमध्ये पुन्हा इम्पोर्ट करा
उत्पादनात आणण्यापूर्वी निकाल चाचणी वातावरणात लोड करा. मूळ नोंदीशी रेकॉर्डची संख्या तपासा, लेआउट समस्यांसाठी सर्वात लांब भाषांतरित मूल्ये पहा आणि एक्सेंटेड कॅरेक्टर्स प्रवासात टिकून राहिले याची पुष्टी करा.
डेटासेट असलेल्या लोकांचे प्रश्न
जर मी अशा भाषेत भाषांतर केले जे दशांश चिन्ह वापरते, तर विभाजक बदलेल का?
तुम्ही ज्या विभाजकाने अपलोड केले आहे, तोच विभाजक तुम्हाला परत मिळेल. तो बदलल्यास सामग्रीऐवजी संरचना पुन्हा लिहावी लागेल आणि ते दुसऱ्या टोकाला डेटा वापरणाऱ्या कोणत्याही गोष्टीला ब्रेक करेल. जर तुम्हाला विशेषतः सेमीकोलन-सेपरेटेड आवृत्तीची आवश्यकता असेल कारण निकाल मशीनवर कॉन्फिगर केलेल्या स्प्रेडशीटमध्ये उघडला जाईल, तर भाषांतरानंतर दोन्ही बोली समजणाऱ्या टूलने ते रूपांतरित करा.
उत्पादन कोड आणि ओळखकर्त्यांचे भाषांतर होण्यापासून मी कसे थांबवू?
त्यांना स्पष्टपणे ओळखलेल्या कॉलम्समध्ये ठेवा आणि शक्य असल्यास, फक्त गद्य कॉलम्सवर प्रक्रिया करण्यासाठी पाठवा आणि नंतर की वर पुन्हा जोडा. जे व्हॅल्यूज स्पष्टपणे कोड आहेत, शब्द नाहीत, ते जसे आहेत तसे सोडले जातात, परंतु सर्वात सुरक्षित व्यवस्था ती आहे जिथे संदिग्धता कधीच उद्भवत नाही. या दरम्यान स्प्रेडशीटला त्या कॉलम्सना स्पर्श करू देऊ नका, कारण ते कोणत्याही भाषांतराची पर्वा न करता त्यांना रीफॉर्मेट करेल.
माझे एक्सेंटेड कॅरेक्टर्स चिन्हांच्या स्ट्रिंग म्हणून परत आले. काय झाले?
तो एन्कोडिंगचा गैरसमज आहे, भाषांतराची समस्या नाही. निकाल जवळजवळ निश्चितपणे योग्य युनिकोड आहे जो लेगसी सिंगल-बाइट एन्कोडिंगची अपेक्षा करणाऱ्या कशाद्वारे वाचला जात आहे, किंवा उलट. ते टेक्स्ट एडिटरमध्ये उघडा जे तुम्हाला एन्कोडिंग स्पष्टपणे निवडण्याची परवानगी देते आणि काहीही गमावले आहे असे गृहीत धरण्यापूर्वी तुमच्याकडे प्रत्यक्षात काय आहे याची पुष्टी करा. जर स्प्रेडशीट हे डेस्टिनेशन असेल, तर सुरुवातीला असलेला बाईट ऑर्डर मार्कर सामान्यतः ते ठरवतो.
कॉमा किंवा लाइन ब्रेक असलेल्या व्हॅल्यूजचे काय होते?
ते बंद राहतात. विभाजक, अवतरण चिन्ह किंवा नवीन ओळ असलेले कोणतेही व्हॅल्यू अवतरण चिन्हात गुंडाळलेले असणे आवश्यक आहे आणि अशा व्हॅल्यूमधील अक्षरशः अवतरण चिन्ह दुप्पट केले पाहिजे. भाषांतरित मजकुरात मूळमध्ये नसलेले विरामचिन्ह येऊ शकते, त्यामुळे ते अवतरण मूळमधून कॉपी करण्याऐवजी निकालावर लागू केले पाहिजे.
प्लेसहोल्डर आणि व्हेरिएबल टोकन टिकून राहतील का?
ते टिकले पाहिजेत, आणि नमुना तपासणे योग्य आहे. टक्केवारी चिन्हानंतर अक्षर, कंसात क्रमांकित स्लॉट किंवा नावाचे व्हेरिएबल यांसारखे टोकन रनटाइमवर टाकल्या जाणाऱ्या व्हॅल्यूजसाठी पत्ते आहेत. त्यापैकी एकाचे भाषांतर केल्यास व्हॅल्यू कधीही स्क्रीनवर पोहोचणार नाही, त्यामुळे शिपिंग करण्यापूर्वी आउटपुटमधील सर्वात लांब इंटरफेस स्ट्रिंगच्या काही नमुन्यांची तपासणी करा.
माझे स्ट्रिंग जर्मनमध्ये खूप मोठे होतात. याचा काही फरक पडतो का?
डेटा स्वतःसाठी नाही, ज्याची रुंदी नसते. जे ते प्रदर्शित करते त्यासाठी फरक पडतो. जर्मन आणि रशियनसाठी इंग्रजीपेक्षा पाचव्या ते एक तृतीयांश पर्यंत विस्तार सामान्य आहे, तर चीनी आणि जपानी सहसा आकुंचन पावतात. भाषांतरित कॉलम लांबीनुसार क्रमवारी लावा आणि तुमच्या स्वतःच्या लेआउटच्या तुलनेत टोकांकडे पहा, आणि निश्चित कॅरेक्टर मर्यादा असलेल्या कोणत्याही डेटाबेस कॉलमची तपासणी करा.
मी एका वेळी किती मोठा डेटासेट पाठवू शकतो?
Pro आणि Enterprise योजनांवर 1 GB पर्यंत, किंवा पाच हजार पृष्ठांच्या समतुल्य मजकूर. हे शेकडो हजारो पंक्तींमधील कॅटलॉग कव्हर करते. संपूर्ण गोष्ट एकाच वेळी पाठवणे सुसंगततेसाठी देखील चांगले आहे, कारण पंक्ती 12 आणि पंक्ती 90,000 मध्ये दिसणारा शब्द समान प्रकारे हाताळला जातो.
वाइड एक्सपोर्टसाठी मला कशाचे शुल्क आकारले जाते?
मजकूर, ग्रिड नाही. रिकाम्या पेशी, अंकीय स्तंभ आणि ओळख स्तंभ गद्य नाहीत. प्रत्येक फाइल स्वतंत्रपणे बिल केली जाते, कारण कोणत्याही योजनेत शब्द समाविष्ट नाहीत: Free आणि Storage वर प्रति शब्द अर्धा सेंट, Pro वर $0.004 आणि Enterprise वर $0.003, किमान $0.99 सह. यामुळे मोठ्या कॅटलॉगचा अंदाज शब्दांच्या संख्येवरून लावणे सोपे होते.
निर्यात पाठवा, रचना कायम ठेवा
तुमची सिस्टम जशी डेटा तयार करते तसाच अपलोड करा, लक्ष्य भाषा निवडा आणि प्रत्येक रेकॉर्डमध्ये समान संख्येने कॉलम असलेली आणि कीज अजूनही जोडता येण्याजोगी ग्रिड मिळवा.
आमचे भागीदार
संबंधित भाषांतर सेवा
फाइल स्वरूप
PDF साधने
