AI-driven · 120+ Språk

Översätt PDF till sanskrit

Översätt en PDF till sanskrit, Indiens klassiska språk, återgivet i Devanagari med dess staplade sammansatta bokstäver och med din sidlayout som den var. Filer upp till 1 GB.

Max filstorlek 1 GB Behåller originalformatering
Registrera dig gratis

Ladda upp eller släpp dokument för översättning

Max filstorlek 1 GB

.PDF .DOCX .PPTX .XLSX .TXT .JPG .PNG .IDML .EPUB .HTML
Afrikaans (Afrikaans)
Shqip (Albanian)
አማርኛ (Amhariska)
العربية (Arabic)
Հայերեն (Armeniska)
Azərbaycan dili (Azerbajdzjanska)
Euskara (Baskiska)
Беларуская (Belarusiska)
বাংলা (Bengali)
Bosanski (Bosnian)
Български (Bulgarian)
မြန်မာဘာသာ (Burmesiska)
Català (Katalanska)
Cebuano (Cebuano)
Chichewa (Chichewa)
中文 简体 (Kinesiska förenklad)
中文 繁體 (Kinesiska traditionell)
Corsu (Korsikanska)
Hrvatski (Croatian)
Čeština (Czech)
Dansk (Danish)
Nederlands (Dutch)
English (English)
Esperanto (Esperanto)
Eesti (Estonian)
Suomi (Finnish)
Français (French)
Frysk (Frisiska)
Galego (Galiciska)
ქართული (Georgiska)
Deutsch (German)
Ελληνικά (Greek)
ગુજરાતી (Gujarati)
Kreyòl Ayisyen (Haitiska)
Hausa (Hausa)
ʻŌlelo Hawaiʻi (Hawaiiska)
עברית (Hebrew)
हिंदी (Hindi)
Hmoob (Hmong)
Magyar (Hungarian)
Íslenska (Isländska)
Igbo (Igbo)
Bahasa Indonesia (Indonesiska)
Gaeilge (Iriska)
Italiano (Italian)
日本語 (Japanese)
Basa Jawa (Javanese)
ಕನ್ನಡ (Kannada)
Қазақ тілі (Kazakiska)
ខ្មែរ (Khmer)
Ikinyarwanda (Rwandiska)
한국어 (Korean)
Kurdî (Kurdish)
Кыргызча (Kirgiziska)
ລາວ (Laotiska)
Latina (Latin)
Latviešu (Lettiska)
Lietuvių (Litauiska)
Lëtzebuergesch (Luxemburgiska)
Македонски (Makedonska)
Malagasy (Malagassiska)
Bahasa Melayu (Malay)
മലയാളം (Malayalam)
Malti (Maltesiska)
Te Reo Māori (Maori)
मराठी (Marathi)
Монгол хэл (Mongoliska)
नेपाली (Nepalesiska)
Norsk (Norwegian)
ଓଡ଼ିଆ (Odia)
فارسی (Persian)
Polski (Polish)
Português (Portugisiska)
ਪੰਜਾਬੀ (Punjabi)
Română (Romanian)
Русский (Russian)
Gagana Samoa (Samoanska)
Gàidhlig (Skotska)
Српски (Serbian)
Sesotho (Sotho)
Shona (Shona)
سنڌي (Sindhi)
සිංහල (Sinhalesiska)
Slovenčina (Slovakian)
Slovenščina (Slovenian)
Soomaali (Somaliska)
Español (Spanish)
Basa Sunda (Sundanesiska)
Kiswahili (Swahili)
Svenska (Swedish)
Tagalog (Tagalog)
Tadzjikiska (Tajik)
தமிழ் (Tamil)
Tatariska (Tatar)
తెలుగు (Telugu)
Thai (Thai)
Türkçe (Turkish)
Turkmeniska (Turkmen)
Українська (Ukrainian)
اردو (Urdu)
Uiguriska (Uyghur)
Uzbekiska (Uzbek)
Tiếng Việt (Vietnamese)
Kymriska (Welsh)
Xhosa (Xhosa)
Jiddisch (Yiddish)
Yoruba (Yoruba)
Zulu (Zulu)
Afrikaans (Afrikaans)
Shqip (Albanian)
አማርኛ (Amhariska)
العربية (Arabic)
Հայերեն (Armeniska)
Azərbaycan dili (Azerbajdzjanska)
Euskara (Baskiska)
Беларуская (Belarusiska)
বাংলা (Bengali)
Bosanski (Bosnian)
Български (Bulgarian)
မြန်မာဘာသာ (Burmesiska)
Català (Katalanska)
Cebuano (Cebuano)
Chichewa (Chichewa)
中文 简体 (Kinesiska förenklad)
中文 繁體 (Kinesiska traditionell)
Corsu (Korsikanska)
Hrvatski (Croatian)
Čeština (Czech)
Dansk (Danish)
Nederlands (Dutch)
English (English)
Esperanto (Esperanto)
Eesti (Estonian)
Suomi (Finnish)
Français (French)
Frysk (Frisiska)
Galego (Galiciska)
ქართული (Georgiska)
Deutsch (German)
Ελληνικά (Greek)
ગુજરાતી (Gujarati)
Kreyòl Ayisyen (Haitiska)
Hausa (Hausa)
ʻŌlelo Hawaiʻi (Hawaiiska)
עברית (Hebrew)
हिंदी (Hindi)
Hmoob (Hmong)
Magyar (Hungarian)
Íslenska (Isländska)
Igbo (Igbo)
Bahasa Indonesia (Indonesiska)
Gaeilge (Iriska)
Italiano (Italian)
日本語 (Japanese)
Basa Jawa (Javanese)
ಕನ್ನಡ (Kannada)
Қазақ тілі (Kazakiska)
ខ្មែរ (Khmer)
Ikinyarwanda (Rwandiska)
한국어 (Korean)
Kurdî (Kurdish)
Кыргызча (Kirgiziska)
ລາວ (Laotiska)
Latina (Latin)
Latviešu (Lettiska)
Lietuvių (Litauiska)
Lëtzebuergesch (Luxemburgiska)
Македонски (Makedonska)
Malagasy (Malagassiska)
Bahasa Melayu (Malay)
മലയാളം (Malayalam)
Malti (Maltesiska)
Te Reo Māori (Maori)
मराठी (Marathi)
Монгол хэл (Mongoliska)
नेपाली (Nepalesiska)
Norsk (Norwegian)
ଓଡ଼ିଆ (Odia)
فارسی (Persian)
Polski (Polish)
Português (Portugisiska)
ਪੰਜਾਬੀ (Punjabi)
Română (Romanian)
Русский (Russian)
Gagana Samoa (Samoanska)
Gàidhlig (Skotska)
Српски (Serbian)
Sesotho (Sotho)
Shona (Shona)
سنڌي (Sindhi)
සිංහල (Sinhalesiska)
Slovenčina (Slovakian)
Slovenščina (Slovenian)
Soomaali (Somaliska)
Español (Spanish)
Basa Sunda (Sundanesiska)
Kiswahili (Swahili)
Svenska (Swedish)
Tagalog (Tagalog)
Tadzjikiska (Tajik)
தமிழ் (Tamil)
Tatariska (Tatar)
తెలుగు (Telugu)
Thai (Thai)
Türkçe (Turkish)
Turkmeniska (Turkmen)
Українська (Ukrainian)
اردو (Urdu)
Uiguriska (Uyghur)
Uzbekiska (Uzbek)
Tiếng Việt (Vietnamese)
Kymriska (Welsh)
Xhosa (Xhosa)
Jiddisch (Yiddish)
Yoruba (Yoruba)
Zulu (Zulu)
ARABISKA PORTUGISISKA Ryska ITALISKA KOREANSKA HOLLÄNDSKA POLSKA TURKISKA SVENSKA ENGELSKA SPANSKA FRANSKA TYSKA KINESISKA JAPANSKA HINDI BENGALISKA VIETNAMESISKA THAI GREKISKA HEBREISKA ARABISKA PORTUGISISKA Ryska ITALISKA KOREANSKA HOLLÄNDSKA POLSKA TURKISKA SVENSKA ENGELSKA SPANSKA FRANSKA TYSKA KINESISKA JAPANSKA HINDI BENGALISKA VIETNAMESISKA THAI GREKISKA HEBREISKA

Ett språk som aldrig hade ett eget skriftspråk

Sanskrit har skrivits ner i väl över tvåtusen år, och under den tiden har det dokumenterats i vilket alfabet regionen råkade använda. Manuskript överlever i Grantha i Tamil-landet, i Sharada i Kashmir, i bengaliska, Odia, Telugu, Kannada och Malayalam-bokstäver, i Newar-skrift i Katmandudalen och i tibetanska över Himalaya. Devanagari blev standarden först under den moderna perioden, till stor del för att det var vad tryckpressarna standardiserade på, och det förblir det skriftspråk som nästan alla nuvarande utgåvor använder. Så en sanskrittext är inte bunden till ett alfabet på samma sätt som ett modernt nationellt språk är, och en forskare som arbetar med manuskript kan behöva samma passage i mer än en.

Automatisk översättning av sanskrit är genuint svårare än översättning av ett modernt språk, och det är värt att säga det rakt ut. Den parallella text som finns tillgänglig för träning är en bråkdel av vad som finns för hindi eller spanska, den överlevande korpusen är mestadels poesi, filosofi och tekniska avhandlingar snarare än vardaglig prosa, och språkets egna vanor arbetar mot segmentering. Ett maskinutkast av en sanskritpassage är ett forskningshjälpmedel, inte en färdig översättning, och allt som ska citeras, publiceras eller reciteras bör passera genom någon som läser språket.

Den andra riktningen är enklare och mycket vanligare i praktiken. Att återge en engelsk text till sanskrit är vad de flesta förfrågningar faktiskt handlar om: ett motto, en inskription, en titelsida, en uppsättning versrubriker, ceremoniella formuleringar. För dessa är de frågor som är viktiga typografiska och ortografiska snarare än tolkningsmässiga, och det är dem som den här sidan täcker.

Fyra funktioner som bryter automatisk hantering

  1. Konsonantstackar tre och fyra djupa. Devanagari smälter samman intilliggande konsonanter till en enda ligatur, och sanskrit producerar kluster som moderna indiska språk helt enkelt inte har: tre konsonanter staplade vertikalt, ibland fyra, dragna som en sammanlänkande form. Typsnitt byggda för hindi bär de vanliga paren och faller tillbaka till en separerad form med en synlig linje för resten. Det är läsbart men det är inte korrekt typografi, och i en tryckt utgåva ser det fel ut för alla som läser språket.
  2. Ord som smälter samman vid sina gränser. Sanskrit tillämpar ljudförändringar där ett ord möter nästa, och i den klassiska skrivna traditionen skrivs det resulterande flödet ofta utan mellanrum alls. Att bestämma var ett ord slutar är därför ett verkligt analytiskt problem snarare än en fråga om att dela på blanksteg, och det är det enskilt största hindret för både textigenkänning och maskinöversättning av språket.
  3. Sammansättningar lika långa som en engelsk bisats. Sanskrit bygger sammansatta substantiv genom att kedja ihop stammar, och en enda sammansättning kan sträcka sig över dussintals stavelser och kräva en hel bisats för att översättas till engelska. På en sida är en av dessa en obrytbar enhet som ingen radbrytningsalgoritm kan dela säkert, eftersom att bryta den på fel ställe ändrar vilka stammar som hör ihop.
  4. Accentmärken som lever utanför huvudblocket. Veda-recitationsmärken sitter i sin egen separata del av Unicode, borta från de vanliga Devanagari-tecknen, och de flesta typsnitt täcker dem inte. De går rutinmässigt förlorade vid konvertering, vilket tyst tar bort den information en recitatör behöver från en text som annars ser komplett ut.

Prissättning för sanskritöversättning

Börja med en kort passage på prov och se hur Devanagari ställs in innan du går vidare.

7-dagars provperiod

MEST POPULÄRA
2,00 USD idag

sedan 14,99 USD/månad efter provperiodens slut

  • 7-dagars full tillgång provperiod
  • Provperiodens gräns: 10 sidor eller 3 000 ord
  • 0,005 $/ord AI-översättning
  • 120+ språk
  • PDF, DOCX, XLSX, PPTX, IDML, TXT, JPG, PNG, CSV, JSON
  • Teamåtkomst och anpassade ordlistor
  • E-postsupport

Månadsvis

POPULAR
14,99 USD/månad

Ordinarie pris 29,99 USD, nu 50 % rabatt

  • 100 sidor eller 30 000 ord per månad
  • 0,005 $/ord AI-översättning
  • 120+ språk
  • Obegränsad fillagring
  • PDF, DOCX, XLSX, PPTX, IDML, TXT, JPG, PNG, CSV, JSON
  • Teamåtkomst och anpassade ordlistor
  • Prioriterad e-postsupport
🎉 Bästa värde: spara 44,88 USD/år

Årlig

SPARA 25%
135 USD/år

~11,25 USD/månad, spara 25 % jämfört med månadspris

  • 100 sidor eller 30 000 ord per månad
  • 0,005 $/ord AI-översättning
  • 120+ språk
  • Obegränsad fillagring
  • PDF, DOCX, XLSX, PPTX, IDML, TXT, JPG, PNG, CSV, JSON
  • Teamåtkomst och anpassade ordlistor
  • Prioriterad e-postsupport
Steg som krävs

Genomföra en sanskritöversättning

01

Skapa ett konto

Registrera dig med en e-postadress för att öppna instrumentpanelen.

02

Ladda upp dokumentet

Släpp PDF-filen eller bläddra efter den. Filer upp till 1 GB hanteras på betalplanerna, vilket täcker en komplett utgåva eller en skannad manuskriptkatalog.

03

Ställ in sanskrit som mål

Välj först källspråket för din fil. Om källan i sig är en romaniserad sanskrittranskription snarare än engelska, är det ett annat jobb och måste anges.

04

Zooma in på ligaturerna

Öppna den färdiga PDF-filen med hög förstoring. Korrekt staplade ligaturer innebär att formningen fungerade; separerade bokstäver med linjer mellan dem, eller tomma rutor, innebär att typsnittet inte kunde hantera det.

Om du arbetar med latinska bokstäver, välj ett schema och ange vilket

En stor del av sanskrit cirkulerar i romaniserad form, och det finns mer än ett sätt att göra det på. Schemana är inte utbytbara, och en fil som blandar två av dem är korrupt på ett sätt som är svårt att upptäcka och irriterande att reparera. Bestäm vilket din dokumentation använder innan du översätter något, och anteckna valet någonstans i filen.

Diakritiska scheman

Standarden som används i akademisk publicering markerar långa vokaler med en streck och retroflexa konsonanter med en punkt under. Den är entydig och läsbar, och den kräver ett typsnitt med fullständig Latin Extended Additional-täckning. Dess nära släkting, den internationella standarden för transkribering av indiska skriftspråk, skiljer sig i en handfull tecken, vilket är exakt tillräckligt för att orsaka problem om du antar att de är desamma.

Enkla ASCII-scheman

Flera konventioner kodar samma distinktioner med endast vanliga tangenttecken, vissa genom att kapitalisera bokstäver, andra genom att dubblera dem eller lägga till skiljetecken. De existerar eftersom de överlever e-post, filnamn och gamla system intakta. De är också ömsesidigt inkompatibla, och samma sträng betyder olika saker under olika scheman.

Populära stavningar

Yoga och devotional publicering tappar vanligtvis bort markeringarna helt och hållet och skriver ord ungefär som en engelsktalande skulle säga dem. Det är bra för en allmän läsekrets och oanvändbart för allt som behöver vara reversibelt, eftersom informationen som skiljer flera olika ljud har kastats bort.

Vad folk faktiskt översätter

Sanskrit är inte ett administrativt språk. Ingen har ett sanskritfödelsebevis. De förfrågningar som kommer in faller inom ett smalt och ganska förutsägbart set, och att veta vilket du befinner dig i talar om hur mycket mänsklig granskning jobbet behöver:

  • Ritual- och liturgiskt material: recitationshäften, ceremonier, hymnsamlingar och tempelpublikationer som måste vara typografiskt exakta eftersom de kommer att läsas högt
  • Yoga- och meditationslärarutbildningsmanualer, där klassiska verser förekommer tillsammans med romaniserad transkription och en engelsk glosa på samma sida
  • Ayurvediska och traditionella medicinska texter, formler och kommentarlitteratur
  • Filosofiska och litterära verk och den moderna forskningen om dem, inklusive kritiska utgåvor med apparat på mer än ett skript
  • Handskriftskataloger och arkivbeskrivningar från digitaliseringsprojekt
  • Skol- och universitetskursmaterial, kursplaner och examensprov från institutioner som undervisar i det
  • Inskriptioner, epigrafiska transkriptioner och museietiketter
  • Institutionella motto, ceremoniella texter, inbjudningar och titelsidor, där en kort passage måste vara exakt rätt

Inget av detta är certifieringsfall på samma sätt som ett immigrationsdokument, men flera är värre att få fel. En felöversatt ceremoniordning eller en trasig konjunktion i en tryckt utgåva är offentligt synlig och permanent, så granskningssteget här är viktigt även om ingen myndighet kräver det.

Frågor om sanskritöversättning

Hur exakt är maskinöversättning av klassisk sanskrit?

Mindre exakt än för något modernt språk, och det är bäst att veta det från början. Det finns mycket mindre parallelltext att lära sig av, den överlevande korpusen är mestadels vers och tekniska avhandlingar snarare än vanlig prosa, och språket slår samman ord vid deras gränser så att även att hitta var ett ord slutar är ett problem. Behandla utdata som ett läshjälpmedel som snabbar upp arbetet för någon som kan språket, inte som en färdig översättning.

Vilket skript kommer utdata att använda?

Devanagari, vilket är vad nästan all modern sanskritpublicering använder. Historiskt sett skrevs språket i vilket skript en region använde, från Grantha och Sharada till Bengali, Telugu, Malayalam och Tibetanska, och manuskript finns kvar i alla av dem. Om ditt projekt behöver ett av dessa, är det specialisttypografiskt arbete snarare än något som ett allmänt översättningsverktyg täcker.

Varför ser vissa conjunct-bokstäver separerade ut istället för staplade?

Eftersom typsnittet som används inte innehåller den specifika ligaturen. Sanskrit producerar konsonantstaplar tre och ibland fyra djupa som moderna indiska språk aldrig genererar, och ett typsnitt byggt för hindi täcker de vanliga kombinationerna och faller tillbaka till att skriva resten som separata bokstäver sammanfogade med en liten streck. Det är läsbart, men i en tryckt utgåva ser det fel ut, så kontrollera en tät passage med hög förstoring.

Kommer vediska accentmärken att överleva?

Ofta inte, och detta är värt att kontrollera specifikt. Recitationsmärkena är kodade i ett separat område av Unicode från vanlig Devanagari och de flesta typsnitt har inga glyfer för dem, så en konvertering kan tappa dem samtidigt som resten av texten ser perfekt ut. För allt material avsett att reciteras, jämför utdata mot källan rad för rad snarare än att anta att märkena kom igenom.

Kan jag få sanskrit i romersk translitteration istället för Devanagari?

Flera romaniseringssystem existerar och de är inte utbytbara. Den akademiska standarden använder streck över långa vokaler och punkter under retroflexa konsonanter; den internationella translittereringsstandarden skiljer sig från den i några få tecken; och det finns scheman för vanliga tangentbord som kodar samma distinktioner med versaler eller dubbla bokstäver. Bestäm vilket ditt projekt använder och ange det, eftersom ett dokument som blandar två scheman är korrupt på ett sätt som är mödosamt att åtgärda.

Kan den läsa ett skannat palmblad eller ett gammalt tryckt manuskript?

Tryckta utgåvor från förra seklet, rent skannade, är det realistiska fallet. Manuskript är det inte: skrivandet flyter utan ordmellanrum, bokstavsformerna varierar beroende på region och skrivare, och det fysiska underlaget är ofta skadat. Manuskriptarbete kräver specialverktyg och en forskare. Ladda upp tryckt material med hög upplösning och förvänta dig att behöva korrigera resultatet.

Jag behöver ett kort sanskritmotto eller en inskription. Är detta lämpligt?

Det är en rimlig utgångspunkt och en dålig slutpunkt. Korta ceremoniella texter är de som folk uppmärksammar, de är ofta permanent snidade, tryckta eller broderade, och små fel i kasusändelser eller sammansättningsbildning är synliga för alla som läser språket. Generera ett utkast, och låt sedan en sanskritforskare bekräfta det innan något åskådas i sten eller tryck.

Vilka är gränserna och kostnaden?

Filer upp till 1 GB eller 5 000 sidor på månads- och årsplanerna. Månadsplanen kostar 14,99 USD och täcker 100 sidor eller 30 000 ord, årsplanen kostar 135 USD per år, cirka 11,25 USD per månad, och AI-översättning kostar 0,005 USD per ord. 7-dagars provperioden för 2 USD täcker 10 sidor eller 3 000 ord, vilket är det vettiga sättet att kontrollera hur devanagari-typsnitten i ditt dokument ser ut.

Översätt ett dokument till sanskrit

Ladda upp din PDF och ladda ner en sanskritversion på Devanagari med originalsidstrukturen, bilder och tabeller bevarade. Filer upp till 1 GB, med en kort provperiod för att kontrollera hur skriptet sätts.

Våra partners

Accenture
Bloomberg
Citrix
P&G
SAP