AI-drevet · 120+ sprog

Oversæt PDF til sanskrit

Oversæt en PDF til sanskrit, det klassiske sprog i Indien, gengivet i Devanagari med dets stablede sammensatte bogstaver og med dit sidelayout bevaret, som det var. Filer op til 1 GB.

Maks. filstørrelse 1 GB Bevarer original formatering
Tilmeld dig gratis

Upload eller træk dokumentet hertil for oversættelse

Maks. filstørrelse 1 GB

.PDF .DOCX .PPTX .XLSX .TXT .JPG .PNG .IDML .EPUB .HTML
Afrikaans (Afrikaans)
Shqip (Albanian)
አማርኛ (Amharisk)
العربية (Arabic)
Հայերեն (Armensk)
Azərbaycan dili (Aserbajdsjansk)
Euskara (Baskisk)
Беларуская (Hviderussisk)
বাংলা (Bengali)
Bosanski (Bosnian)
Български (Bulgarian)
မြန်မာဘာသာ (Burmesisk)
Català (Catalansk)
Cebuano (Cebuano)
Chichewa (Chichewa)
中文 简体 (Kinesisk forenklet)
中文 繁體 (Kinesisk traditionel)
Corsu (Korsikansk)
Hrvatski (Croatian)
Čeština (Czech)
Dansk (Danish)
Nederlands (Dutch)
English (English)
Esperanto (Esperanto)
Eesti (Estonian)
Suomi (Finnish)
Français (French)
Frisisk (Frysk)
Galicisk (Galego)
Georgisk (ქართული)
Deutsch (German)
Ελληνικά (Greek)
ગુજરાતી (Gujarati)
Haitiansk (Kreyòl Ayisyen)
Hausa (Hausa)
Hawaiiansk (ʻŌlelo Hawaiʻi)
עברית (Hebrew)
Hindi (हिंदी)
Hmong (Hmoob)
Magyar (Hungarian)
Islandsk (Íslenska)
Igbo (Igbo)
Indonesisk (Bahasa Indonesia)
Irsk (Gaeilge)
Italiano (Italian)
日本語 (Japanese)
Basa Jawa (Javanese)
Kannada (ಕನ್ನಡ)
Kasakhisk (Қазақ тілі)
Khmer (ខ្មែរ)
Kinyarwanda (Ikinyarwanda)
한국어 (Korean)
Kurdî (Kurdish)
Kirgisisk (Кыргызча)
Laotisk (ລາວ)
Latin (Latina)
Lettisk (Latviešu)
Litauisk (Lietuvių)
Luxembourgsk (Lëtzebuergesch)
Makedonsk (Македонски)
Malagasy (Malagasy)
Bahasa Melayu (Malay)
Malayalam (മലയാളം)
Maltesisk (Malti)
Maori (Te Reo Māori)
मराठी (Marathi)
Mongolsk (Монгол хэл)
Nepalesisk (नेपाली)
Norsk (Norwegian)
Odia (ଓଡ଼ିଆ)
فارسی (Persian)
Polski (Polish)
Portugisisk (Português)
ਪੰਜਾਬੀ (Punjabi)
Română (Romanian)
Русский (Russian)
Samoansk (Gagana Samoa)
Skotsk (Gàidhlig)
Српски (Serbian)
Sesotho (Sesotho)
Shona (Shona)
Sindhi (سنڌي)
Singalesisk (සිංහල)
Slovenčina (Slovakian)
Slovenščina (Slovenian)
Somali (Soomaali)
Español (Spanish)
Sundanesisk (Basa Sunda)
Kiswahili (Swahili)
Svenska (Swedish)
Tagalog (Tagalog)
Tadsjikisk (Tajik)
தமிழ் (Tamil)
Tatarisk (Tatar)
తెలుగు (Telugu)
Thai (Thai)
Türkçe (Turkish)
Turkmensk (Turkmen)
Українська (Ukrainian)
اردو (Urdu)
Uighur (Uyghur)
Usbekisk (Uzbek)
Tiếng Việt (Vietnamese)
Walisisk (Welsh)
Xhosa (Xhosa)
Jiddisch (Yiddish)
Yoruba (Yoruba)
Zulu (Zulu)
Afrikaans (Afrikaans)
Shqip (Albanian)
አማርኛ (Amharisk)
العربية (Arabic)
Հայերեն (Armensk)
Azərbaycan dili (Aserbajdsjansk)
Euskara (Baskisk)
Беларуская (Hviderussisk)
বাংলা (Bengali)
Bosanski (Bosnian)
Български (Bulgarian)
မြန်မာဘာသာ (Burmesisk)
Català (Catalansk)
Cebuano (Cebuano)
Chichewa (Chichewa)
中文 简体 (Kinesisk forenklet)
中文 繁體 (Kinesisk traditionel)
Corsu (Korsikansk)
Hrvatski (Croatian)
Čeština (Czech)
Dansk (Danish)
Nederlands (Dutch)
English (English)
Esperanto (Esperanto)
Eesti (Estonian)
Suomi (Finnish)
Français (French)
Frisisk (Frysk)
Galicisk (Galego)
Georgisk (ქართული)
Deutsch (German)
Ελληνικά (Greek)
ગુજરાતી (Gujarati)
Haitiansk (Kreyòl Ayisyen)
Hausa (Hausa)
Hawaiiansk (ʻŌlelo Hawaiʻi)
עברית (Hebrew)
Hindi (हिंदी)
Hmong (Hmoob)
Magyar (Hungarian)
Islandsk (Íslenska)
Igbo (Igbo)
Indonesisk (Bahasa Indonesia)
Irsk (Gaeilge)
Italiano (Italian)
日本語 (Japanese)
Basa Jawa (Javanese)
Kannada (ಕನ್ನಡ)
Kasakhisk (Қазақ тілі)
Khmer (ខ្មែរ)
Kinyarwanda (Ikinyarwanda)
한국어 (Korean)
Kurdî (Kurdish)
Kirgisisk (Кыргызча)
Laotisk (ລາວ)
Latin (Latina)
Lettisk (Latviešu)
Litauisk (Lietuvių)
Luxembourgsk (Lëtzebuergesch)
Makedonsk (Македонски)
Malagasy (Malagasy)
Bahasa Melayu (Malay)
Malayalam (മലയാളം)
Maltesisk (Malti)
Maori (Te Reo Māori)
मराठी (Marathi)
Mongolsk (Монгол хэл)
Nepalesisk (नेपाली)
Norsk (Norwegian)
Odia (ଓଡ଼ିଆ)
فارسی (Persian)
Polski (Polish)
Portugisisk (Português)
ਪੰਜਾਬੀ (Punjabi)
Română (Romanian)
Русский (Russian)
Samoansk (Gagana Samoa)
Skotsk (Gàidhlig)
Српски (Serbian)
Sesotho (Sesotho)
Shona (Shona)
Sindhi (سنڌي)
Singalesisk (සිංහල)
Slovenčina (Slovakian)
Slovenščina (Slovenian)
Somali (Soomaali)
Español (Spanish)
Sundanesisk (Basa Sunda)
Kiswahili (Swahili)
Svenska (Swedish)
Tagalog (Tagalog)
Tadsjikisk (Tajik)
தமிழ் (Tamil)
Tatarisk (Tatar)
తెలుగు (Telugu)
Thai (Thai)
Türkçe (Turkish)
Turkmensk (Turkmen)
Українська (Ukrainian)
اردو (Urdu)
Uighur (Uyghur)
Usbekisk (Uzbek)
Tiếng Việt (Vietnamese)
Walisisk (Welsh)
Xhosa (Xhosa)
Jiddisch (Yiddish)
Yoruba (Yoruba)
Zulu (Zulu)
ARABISK PORTUGISISK RUSISK ITALIENSK KOREANSK HOLLANDSK POLSK TYRKISK SVENSK ENGELSK SPANSK FRANSK TYSK KINESISK JAPANSK HINDI BENGALI VIETNAMESISK THAI GRÆSK HEBRAISK ARABISK PORTUGISISK RUSISK ITALIENSK KOREANSK HOLLANDSK POLSK TYRKISK SVENSK ENGELSK SPANSK FRANSK TYSK KINESISK JAPANSK HINDI BENGALI VIETNAMESISK THAI GRÆSK HEBRAISK

Et sprog, der aldrig havde sit eget skriftsprog

Sanskrit er blevet skrevet ned i godt over to tusind år, og i den tid er det blevet registreret i det alfabet, som regionen tilfældigvis brugte. Manuskripter overlever i Grantha i Tamil-landet, i Sharada i Kashmir, i bengalske, Odia, Telugu, Kannada og Malayalam bogstaver, i Newar-skrift i Kathmandu-dalen og i tibetansk på tværs af Himalaya. Devanagari blev standarden først i den moderne periode, primært fordi det er det, trykpresserne standardiserede på, og det forbliver det skriftsprog, næsten alle nuværende udgaver bruger. Så en sanskrit-tekst er ikke bundet til ét alfabet, som et moderne nationalsprog er, og en forsker, der arbejder med manuskripter, kan have brug for den samme passage i mere end én.

Automatiseret oversættelse af sanskrit er virkelig sværere end oversættelse af et moderne sprog, og det er værd at sige det ligeud. De parallelle tekster, der er tilgængelige til træning, er en brøkdel af, hvad der findes for hindi eller spansk, det overlevende korpus er mest poesi, filosofi og tekniske afhandlinger snarere end hverdags prosa, og sprogets egne vaner arbejder imod segmentering. Et maskinudkast af en sanskrit-passage er en forskningshjælp, ikke en færdig oversættelse, og alt, der skal citeres, udgives eller reciteres, bør passere gennem en person, der læser sproget.

Den anden retning er lettere og meget mere almindelig i praksis. At gengive en engelsk tekst på sanskrit er, hvad de fleste anmodninger faktisk handler om: et motto, en inskription, en titel side, et sæt versoverskrifter, ceremoniel ordlyd. For disse er de spørgsmål, der betyder noget, typografiske og ortografiske snarere end fortolkende, og det er dem, denne side dækker.

Fire funktioner, der bryder automatiseret håndtering

  1. Konsonantstakke tre og fire dybe. Devanagari smelter tilstødende konsonanter sammen til en enkelt ligature, og sanskrit producerer klynger, som moderne indiske sprog simpelthen ikke har: tre konsonanter stablet lodret, nogle gange fire, tegnet som én sammenlåsende form. Skrifttyper bygget til hindi bærer de almindelige par og falder tilbage til en adskilt form med et synligt streg for resten. Det er læseligt, men det er ikke korrekt typografi, og i en trykt udgave ser det forkert ud for enhver, der læser sproget.
  2. Ord, der smelter sammen ved deres grænser. Sanskrit anvender lydændringer, hvor et ord møder det næste, og i den klassiske skriftlige tradition udskrives den resulterende strøm ofte uden mellemrum overhovedet. At bestemme, hvor et ord stopper, er derfor et reelt analytisk problem snarere end et spørgsmål om at opdele på mellemrum, og det er den største forhindring for både tekstgenkendelse og maskinoversættelse af sproget.
  3. Sammensætninger på længden af en engelsk klausul. Sanskrit bygger sammensatte navneord ved at kæde stammer sammen, og et enkelt sammensat ord kan løbe til dusinvis af stavelser og kræve en hel underordnet klausul for at gengive på engelsk. På en side er en af disse et udeleligt token, som ingen linjebrudsalgoritme kan opdele sikkert, fordi opdeling på det forkerte sted ændrer, hvilke stammer der hører sammen.
  4. Accentmærker, der lever uden for hovedblokken. Veda-recitationsmærker sidder i deres egen separate del af Unicode, væk fra de almindelige Devanagari-tegn, og de fleste skrifttyper dækker dem ikke. De går rutinemæssigt tabt i konvertering, hvilket lydløst fjerner den information, en reciter har brug for, fra en tekst, der ellers ser komplet ud.

Priser for oversættelse af sanskrit

Start med en kort passage på prøven og se, hvordan Devanagari sættes, før du går videre.

7-dages prøveperiode

MEST POPULÆRE
2,00 USD i dag

derefter 14,99 USD/måned efter prøveperioden udløber

  • 7-dages fuld adgang prøveperiode
  • Prøvebegrænsning: 10 sider eller 3.000 ord
  • 0,005 $/ord AI-oversættelse
  • 120+ sprog
  • PDF, DOCX, XLSX, PPTX, IDML, TXT, JPG, PNG, CSV, JSON
  • Teamadgang & brugerdefinerede ordlister
  • E-mail support

Månedligt

POPULAR
14,99 USD/måned

Normalpris 29,99 USD, nu 50% rabat

  • 100 sider eller 30.000 ord pr. måned
  • 0,005 $/ord AI-oversættelse
  • 120+ sprog
  • Ubegrænset fillagring
  • PDF, DOCX, XLSX, PPTX, IDML, TXT, JPG, PNG, CSV, JSON
  • Teamadgang & brugerdefinerede ordlister
  • Prioriteret e-mailsupport
🎉 Bedste værdi: spar 44,88 USD/år

Årligt

SPAR 25%
135 USD/år

~11,25 USD/måned, spar 25% ift. månedligt

  • 100 sider eller 30.000 ord pr. måned
  • 0,005 $/ord AI-oversættelse
  • 120+ sprog
  • Ubegrænset fillagring
  • PDF, DOCX, XLSX, PPTX, IDML, TXT, JPG, PNG, CSV, JSON
  • Teamadgang & brugerdefinerede ordlister
  • Prioriteret e-mailsupport
Nødvendige trin

Kørsel af en sanskrit-oversættelse

01

Opret en konto

Tilmeld dig med en e-mailadresse for at åbne dashboardet.

02

Upload dokumentet

Slip PDF'en ind eller søg efter den. Filer op til 1 GB håndteres på betalte planer, hvilket dækker en komplet udgave eller en scannet manuskriptkatalog.

03

Indstil sanskrit som mål

Vælg først kildesproget for din fil. Hvis kilden i sig selv er en romaniseret sanskrit-transskription snarere end engelsk, er det et andet job og skal siges.

04

Zoom ind på sammensætningerne

Åbn den færdige PDF ved høj forstørrelse. Korrekt stablede ligaturer betyder, at formgivningen virkede; adskilte bogstaver med streger imellem, eller tomme bokse, betyder, at skrifttypen ikke kunne klare det.

Hvis du arbejder med latinske bogstaver, skal du vælge et skema og sige hvilket

En stor mængde sanskrit cirkulerer i romaniseret form, og der er mere end én måde at gøre det på. Skemaerne er ikke udskiftelige, og en fil, der blander to af dem, er korrupt på en måde, der er svær at opdage og irriterende at reparere. Beslut, hvilket din dokument bruger, før du oversætter noget, og gem valget et sted i filen.

Diakritiske skemaer

Standarden brugt i akademisk udgivelse markerer lange vokaler med en streg og retrofleks konsonanter med en prik under. Den er utvetydig og læselig, og den kræver en skrifttype med fuld Latin Extended Additional dækning. Dens nære slægtning, den internationale standard for transskribering af indiske skriftsprog, adskiller sig i en håndfuld tegn, hvilket er præcis nok til at forårsage problemer, hvis du antager, at de er de samme.

Almindelige ASCII-skemaer

Flere konventioner koder de samme forskelle ved kun at bruge almindelige tastaturtegn, nogle ved at kapitalisere bogstaver, andre ved at fordoble dem eller tilføje tegnsætning. De eksisterer, fordi de overlever e-mail, filnavne og gamle systemer intakte. De er også gensidigt uforenelige, og den samme streng betyder forskellige ting under forskellige skemaer.

Populære stavemåder

Yoga og hengiven udgivelse dropper normalt mærkerne helt og skriver ordene omtrent, som en engelsktalende ville sige dem. Det er fint for en almen læser og ubrugeligt for alt, der skal kunne vendes tilbage, fordi informationen, der adskiller flere forskellige lyde, er blevet smidt væk.

Hvad folk rent faktisk oversætter

Sanskrit er ikke et administrativt sprog. Ingen har en sanskrit-fødselsattest. De anmodninger, der kommer ind, falder inden for et snævert og ret forudsigeligt sæt, og at vide, hvilken du er i, fortæller dig, hvor meget menneskelig gennemgang jobbet kræver:

  • Rituelt og liturgisk materiale: recitationhæfter, ceremoniel ordninger, hymnesamlinger og tempelpublikationer, der skal være typografisk nøjagtige, fordi de vil blive læst højt
  • Yoga- og meditationslæreruddannelseshåndbøger, hvor klassiske vers optræder sammen med romaniseret transskription og en engelsk forklaring på samme side
  • Ayurvediske og traditionelle medicinske tekster, formularer og kommentarlitteratur
  • Filosofiske og litterære værker og den moderne forskning om dem, herunder kritiske udgaver med apparat på mere end ét skriftsprog
  • Manuskriptkataloger og arkivbeskrivelser fra digitaliseringsprojekter
  • Skole- og universitetsundervisningsmateriale, pensum og eksamensopgaver fra institutioner, der underviser i det
  • Indskrifter, epigrafiske transskriptioner og museumsopskrifter
  • Institutionelle mottoer, ceremonielle tekster, invitationer og titelsider, hvor en kort passage skal være helt korrekt

Ingen af disse er certificeringssager på samme måde som et immigrationsdokument, men flere er værre at få forkerte. En fejloversat ceremoniel orden eller en brudt forbindelse i en trykt udgave er offentligt synlig og permanent, så gennemgangstrinnet her er vigtigt, selvom ingen myndighed kræver det.

Spørgsmål om oversættelse af sanskrit

Hvor præcis er maskinoversættelse af klassisk sanskrit?

Mindre præcis end for ethvert moderne sprog, og det er bedst at vide det på forhånd. Der er langt mindre parallelt tekstmateriale at lære af, det overlevende korpus er mestendels vers og tekniske afhandlinger snarere end almindelig prosa, og sproget smelter ord sammen ved deres grænser, så selv at finde ud af, hvor et ord slutter, er et problem. Betragt outputtet som en læsehjælp, der fremskynder arbejdet for en, der kender sproget, ikke som en færdig oversættelse.

Hvilken skrift vil outputtet bruge?

Devanagari, som er det, stort set al moderne sanskrit-udgivelse bruger. Historisk set blev sproget skrevet i den skrift, en region brugte, fra Grantha og Sharada til Bengali, Telugu, Malayalam og Tibetansk, og manuskripter overlever i dem alle. Hvis dit projekt kræver en af disse, er det specialist-typografisk arbejde snarere end noget, et generelt oversættelsesværktøj dækker.

Hvorfor ser nogle sammensatte bogstaver adskilte ud i stedet for stablede?

Fordi den anvendte skrifttype ikke indeholder den pågældende ligature. Sanskrit producerer konsonantstakke tre og nogle gange fire dybe, som moderne indiske sprog aldrig genererer, og en skrifttype bygget til hindi dækker de almindelige kombinationer og falder tilbage til at skrive resten som separate bogstaver forbundet med en lille streg. Det er læseligt, men i en trykt udgave ser det forkert ud, så tjek en tæt passage med høj forstørrelse.

Vil vediske accentmærker overleve?

Ofte ikke, og det er værd at tjekke specifikt. Recitationsmærkerne er kodet i et separat område af Unicode fra almindelig Devanagari, og de fleste skrifttyper har ingen glyffer til dem, så en konvertering kan droppe dem, mens resten af teksten ser perfekt ud. For alt materiale, der er beregnet til at blive reciteret, skal du sammenligne outputtet med kilden linje for linje snarere end at antage, at mærkerne kom igennem.

Kan jeg få sanskrit i romersk translitteration i stedet for Devanagari?

Der findes flere romaniseringssystemer, og de er ikke udskiftelige. Den akademiske standard bruger streger over lange vokaler og prikker under retrofleks konsonanter; den internationale translitterationsstandard adskiller sig fra den i få tegn; og der findes skemaer med almindeligt tastatur, der koder de samme distinktioner med store bogstaver eller fordoblede bogstaver. Beslut dig for, hvilken din projekt bruger, og angiv det, for et dokument, der blander to skemaer, er korrupt på en måde, der er kedelig at rette.

Kan den læse et scannet palmeblad eller et gammelt trykt manuskript?

Trykte udgaver fra det sidste århundrede, rent scannet, er det realistiske scenarie. Manuskripter er det ikke: skriften løber uden ordmellemrum, bogstavformerne varierer efter region og skriver, og det fysiske underlag er ofte beskadiget. Manuskriptarbejde kræver specialværktøjer og en forsker. Upload trykt materiale i høj opløsning og forvent at skulle rette resultatet.

Jeg har brug for et kort sanskrit-motto eller en inskription. Er dette egnet?

Det er et rimeligt udgangspunkt og et dårligt slutpunkt. Korte ceremonielle tekster er dem, folk bemærker, de bliver ofte permanent indgraveret, trykt eller broderet, og små fejl i kasusendelser eller sammensætningsdannelse er synlige for enhver, der læser sproget. Generer et udkast, og få derefter en sanskritforsker til at bekræfte det, før noget bliver hugget i sten eller sat i trykken.

Hvad er grænserne og omkostningerne?

Filer op til 1 GB eller 5.000 sider på Månedlige og Årlige planer. Månedlige plan er 14,99 USD, der dækker 100 sider eller 30.000 ord, Årlige plan er 135 USD om året, ca. 11,25 USD om måneden, og AI-oversættelse koster 0,005 USD pr. ord. Den 2 USD 7-dages prøveperiode dækker 10 sider eller 3.000 ord, hvilket er den fornuftige måde at tjekke, hvordan devanagari-typerne i dit dokument ser ud.

Oversæt et dokument til sanskrit

Upload din PDF og download en sanskritversion på devanagari med den oprindelige sidestruktur, billeder og tabeller bevaret. Filer op til 1 GB, med en kort prøveperiode til at tjekke, hvordan skriften sættes.

Vores Partnere

Accenture
Bloomberg
Citrix
P&G
SAP