KI-drevet · 120+ språk

Oversett PDF til sanskrit

Oversett en PDF til sanskrit, det klassiske språket i India, gjengitt i devanagari med sine stablede sammensatte bokstaver og med sidemarginen din slik den var. Filer opptil 1 GB.

Maks filstørrelse 1 GB Beholder original formatering
Registrer deg gratis

Last opp eller dra dokument for å oversette

Maks filstørrelse 1 GB

.PDF .DOCX .PPTX .XLSX .TXT .JPG .PNG .IDML .EPUB .HTML
Afrikaans (Afrikaans)
Shqip (Albanian)
አማርኛ (Amharisk)
العربية (Arabic)
Հայերեն (Armensk)
Azərbaycan dili (Aserbajdsjansk)
Euskara (Baskisk)
Беларуская (Hviterussisk)
বাংলা (Bengali)
Bosanski (Bosnian)
Български (Bulgarian)
မြန်မာဘာသာ (Burmesisk)
Català (Katalansk)
Cebuano (Cebuano)
Chichewa (Chichewa)
中文 简体 (Kinesisk forenklet)
中文 繁體 (Kinesisk tradisjonell)
Corsu (Korsikansk)
Hrvatski (Croatian)
Čeština (Czech)
Dansk (Danish)
Nederlands (Dutch)
English (English)
Esperanto (Esperanto)
Eesti (Estonian)
Suomi (Finnish)
Français (French)
Frisisk (Frysk)
Galicisk (Galego)
Georgisk (ქართული)
Deutsch (German)
Ελληνικά (Greek)
ગુજરાતી (Gujarati)
Haitisk (Kreyòl Ayisyen)
Hausa (Hausa)
Hawaiisk (ʻŌlelo Hawaiʻi)
עברית (Hebrew)
Hindi (हिंदी)
Hmong (Hmoob)
Magyar (Hungarian)
Islandsk (Íslenska)
Igbo (Igbo)
Indonesisk (Bahasa Indonesia)
Irsk (Gaeilge)
Italiano (Italian)
日本語 (Japanese)
Basa Jawa (Javanese)
Kannada (ಕನ್ನಡ)
Kasakhisk (Қазақ тілі)
Khmer (ខ្មែរ)
Kinyarwanda (Ikinyarwanda)
한국어 (Korean)
Kurdî (Kurdish)
Kirgisisk (Кыргызча)
Laotisk (ລາວ)
Latin (Latina)
Latvisk (Latviešu)
Litauisk (Lietuvių)
Luxemburgsk (Lëtzebuergesch)
Makedonsk (Македонски)
Gassisk (Malagasy)
Bahasa Melayu (Malay)
Malayalam (മലയാളം)
Maltesisk (Malti)
Maori (Te Reo Māori)
मराठी (Marathi)
Mongolsk (Монгол хэл)
Nepalsk (नेपाली)
Norsk (Norwegian)
Odia (ଓଡ଼ିଆ)
فارسی (Persian)
Polski (Polish)
Portugisisk (Português)
ਪੰਜਾਬੀ (Punjabi)
Română (Romanian)
Русский (Russian)
Samoansk (Gagana Samoa)
Skotsk (Gàidhlig)
Српски (Serbian)
Sesotho (Sesotho)
Shona (Shona)
Sindhi (سنڌي)
Singalesisk (සිංහල)
Slovenčina (Slovakian)
Slovenščina (Slovenian)
Somali (Soomaali)
Español (Spanish)
Sundanesisk (Basa Sunda)
Kiswahili (Swahili)
Svenska (Swedish)
Tagalog (Tagalog)
Tojik (Tajik)
தமிழ் (Tamil)
Tatar (Tatar)
తెలుగు (Telugu)
Thai (Thai)
Türkçe (Turkish)
Türkmençe (Turkmen)
Українська (Ukrainian)
اردو (Urdu)
Uyghur (Uyghur)
Usbekisk (Usbekisk)
Tiếng Việt (Vietnamese)
Walisisk (Walisisk)
Xhosa (Xhosa)
Jiddisk (Jiddisk)
Yoruba (Yoruba)
Zulu (Zulu)
Afrikaans (Afrikaans)
Shqip (Albanian)
አማርኛ (Amharisk)
العربية (Arabic)
Հայերեն (Armensk)
Azərbaycan dili (Aserbajdsjansk)
Euskara (Baskisk)
Беларуская (Hviterussisk)
বাংলা (Bengali)
Bosanski (Bosnian)
Български (Bulgarian)
မြန်မာဘာသာ (Burmesisk)
Català (Katalansk)
Cebuano (Cebuano)
Chichewa (Chichewa)
中文 简体 (Kinesisk forenklet)
中文 繁體 (Kinesisk tradisjonell)
Corsu (Korsikansk)
Hrvatski (Croatian)
Čeština (Czech)
Dansk (Danish)
Nederlands (Dutch)
English (English)
Esperanto (Esperanto)
Eesti (Estonian)
Suomi (Finnish)
Français (French)
Frisisk (Frysk)
Galicisk (Galego)
Georgisk (ქართული)
Deutsch (German)
Ελληνικά (Greek)
ગુજરાતી (Gujarati)
Haitisk (Kreyòl Ayisyen)
Hausa (Hausa)
Hawaiisk (ʻŌlelo Hawaiʻi)
עברית (Hebrew)
Hindi (हिंदी)
Hmong (Hmoob)
Magyar (Hungarian)
Islandsk (Íslenska)
Igbo (Igbo)
Indonesisk (Bahasa Indonesia)
Irsk (Gaeilge)
Italiano (Italian)
日本語 (Japanese)
Basa Jawa (Javanese)
Kannada (ಕನ್ನಡ)
Kasakhisk (Қазақ тілі)
Khmer (ខ្មែរ)
Kinyarwanda (Ikinyarwanda)
한국어 (Korean)
Kurdî (Kurdish)
Kirgisisk (Кыргызча)
Laotisk (ລາວ)
Latin (Latina)
Latvisk (Latviešu)
Litauisk (Lietuvių)
Luxemburgsk (Lëtzebuergesch)
Makedonsk (Македонски)
Gassisk (Malagasy)
Bahasa Melayu (Malay)
Malayalam (മലയാളം)
Maltesisk (Malti)
Maori (Te Reo Māori)
मराठी (Marathi)
Mongolsk (Монгол хэл)
Nepalsk (नेपाली)
Norsk (Norwegian)
Odia (ଓଡ଼ିଆ)
فارسی (Persian)
Polski (Polish)
Portugisisk (Português)
ਪੰਜਾਬੀ (Punjabi)
Română (Romanian)
Русский (Russian)
Samoansk (Gagana Samoa)
Skotsk (Gàidhlig)
Српски (Serbian)
Sesotho (Sesotho)
Shona (Shona)
Sindhi (سنڌي)
Singalesisk (සිංහල)
Slovenčina (Slovakian)
Slovenščina (Slovenian)
Somali (Soomaali)
Español (Spanish)
Sundanesisk (Basa Sunda)
Kiswahili (Swahili)
Svenska (Swedish)
Tagalog (Tagalog)
Tojik (Tajik)
தமிழ் (Tamil)
Tatar (Tatar)
తెలుగు (Telugu)
Thai (Thai)
Türkçe (Turkish)
Türkmençe (Turkmen)
Українська (Ukrainian)
اردو (Urdu)
Uyghur (Uyghur)
Usbekisk (Usbekisk)
Tiếng Việt (Vietnamese)
Walisisk (Walisisk)
Xhosa (Xhosa)
Jiddisk (Jiddisk)
Yoruba (Yoruba)
Zulu (Zulu)
ARABISK PORTUGISISK RUSISK ITALISK KOREANSK NEDERLANDSK POLSK TYRKISK SVENSK ENGELSK SPANSK FRANSK TYSK KINESISK JAPANSK HINDI BENGALI VIETNAMESISK THAI GRASK HEBRAISK ARABISK PORTUGISISK RUSISK ITALISK KOREANSK NEDERLANDSK POLSK TYRKISK SVENSK ENGELSK SPANSK FRANSK TYSK KINESISK JAPANSK HINDI BENGALI VIETNAMESISK THAI GRASK HEBRAISK

Et språk som aldri hadde et eget skriftspråk

Sanskrit har blitt skrevet ned i godt over to tusen år, og i løpet av den tiden har det blitt registrert i hvilket som helst alfabet regionen tilfeldigvis brukte. Manuskripter overlever i Grantha i Tamil-landet, i Sharada i Kashmir, i bengalske, Odia, Telugu, Kannada og malayalam-bokstaver, i Newar-skrift i Kathmandu-dalen og i tibetansk over Himalaya. Devanagari ble standarden først i den moderne perioden, i stor grad fordi det var det trykkpressene standardiserte på, og det forblir skriften de fleste nåværende utgaver bruker. Så en sanskrit-tekst er ikke knyttet til ett alfabet slik et moderne nasjonalt språk er, og en forsker som arbeider med manuskripter kan trenge den samme passasjen i mer enn én.

Automatisert oversettelse av sanskrit er genuint vanskeligere enn oversettelse av et moderne språk, og det er verdt å si det rett ut. Den parallelle teksten som er tilgjengelig for trening er en brøkdel av det som eksisterer for hindi eller spansk, det overlevende korpuset er mest poesi, filosofi og tekniske avhandlinger heller enn hverdagslig prosa, og språkets egne vaner virker mot segmentering. Et maskinutkast av en sanskrit-passasje er et forskningshjelpemiddel, ikke en ferdig oversettelse, og alt som skal siteres, publiseres eller resiteres bør gå gjennom noen som leser språket.

Den andre retningen er enklere og mye vanligere i praksis. Å gjengi en engelsk tekst til sanskrit er hva de fleste forespørsler faktisk handler om: et motto, en inskripsjon, en tittel side, et sett med versoverskrifter, seremoniell ordlyd. For disse er spørsmålene som betyr noe typografiske og ortografiske heller enn tolkende, og det er de som denne siden dekker.

Fire funksjoner som bryter automatisert håndtering

  1. Konsonantstabler tre og fire dype. Devanagari smelter sammen tilstøtende konsonanter til en enkelt ligature, og sanskrit produserer klynger som moderne indiske språk rett og slett ikke har: tre konsonanter stablet vertikalt, noen ganger fire, tegnet som én sammenlåsende form. Fonter bygget for hindi bærer de vanlige parene og faller tilbake til en separert form med en synlig strek for resten. Det er lesbart, men det er ikke korrekt typografi, og i en trykt utgave ser det feil ut for alle som leser språket.
  2. Ord som smelter sammen ved grensene sine. Sanskrit bruker lydendringer der ett ord møter det neste, og i den klassiske skriftlige tradisjonen blir resultatet ofte trykt uten mellomrom i det hele tatt. Å bestemme hvor ett ord slutter er derfor et reelt analytisk problem heller enn et spørsmål om å dele på mellomrom, og det er den største hindringen for både tekstgjenkjenning og maskinoversettelse av språket.
  3. Sammensetninger på lengden av en engelsk klausul. Sanskrit bygger sammensatte substantiver ved å kjede sammen stammer, og en enkelt sammensetning kan strekke seg over dusinvis av stavelser og kreve en full underordnet klausul for å gjengi på engelsk. På en side er en av disse et uknuselig token som ingen linjebrytningsalgoritme kan dele trygt, fordi å bryte den på feil sted endrer hvilke stammer som hører sammen.
  4. Aksentmerker som lever utenfor hovedblokken. Veda-resitasjonsmerker sitter i sin egen separate del av Unicode, borte fra de vanlige devanagari-tegnene, og de fleste fonter dekker dem ikke. De går rutinemessig tapt i konvertering, noe som stille fjerner informasjonen en resiterer trenger fra en tekst som ellers ser komplett ut.

Priser for sanskrit-oversettelse

Start med en kort passasje på prøveversjonen og se hvordan devanagari settes før du går videre.

7-dagers prøveperiode

MEST POPULÆRE
2,00 $ i dag

deretter 14,99 $/måned etter prøveperioden er over

  • 7-dagers full tilgang prøveperiode
  • Prøveperiodebegrensning: 10 sider eller 3 000 ord
  • 0,005 USD/ord AI-oversettelse
  • 120+ språk
  • PDF, DOCX, XLSX, PPTX, IDML, TXT, JPG, PNG, CSV, JSON
  • Teamtilgang og egendefinerte ordlister
  • E-poststøtte

Månedlig

POPULAR
14,99 $/måned

Ordinær pris 29,99 $, nå 50 % rabatt

  • 100 sider eller 30 000 ord per måned
  • 0,005 USD/ord AI-oversettelse
  • 120+ språk
  • Ubegrenset fillagring
  • PDF, DOCX, XLSX, PPTX, IDML, TXT, JPG, PNG, CSV, JSON
  • Teamtilgang og egendefinerte ordlister
  • Prioritert e-poststøtte
🎉 Beste verdi: spar 44,88 $/år

Årlig

SPAR 25 %
135 $/år

~11,25 $/måned, spar 25 % vs månedlig

  • 100 sider eller 30 000 ord per måned
  • 0,005 USD/ord AI-oversettelse
  • 120+ språk
  • Ubegrenset fillagring
  • PDF, DOCX, XLSX, PPTX, IDML, TXT, JPG, PNG, CSV, JSON
  • Teamtilgang og egendefinerte ordlister
  • Prioritert e-poststøtte
Nødvendige trinn

Kjøre en sanskrit-oversettelse

01

Opprett en konto

Registrer deg med en e-postadresse for å åpne dashbordet.

02

Last opp dokumentet

Slipp PDF-en inn eller bla etter den. Filer opptil 1 GB håndteres på betalte planer, som dekker en komplett utgave eller en skannet manuskriptkatalog.

03

Angi sanskrit som målet

Velg kildespråket til filen din først. Hvis kilden i seg selv er en romanisert sanskrit-transliterasjon heller enn engelsk, er det en annen jobb og må sies fra om.

04

Zoom inn på sammensetningene

Åpne den ferdige PDF-en med høy forstørrelse. Riktig stablede ligaturer betyr at formingen fungerte; separerte bokstaver med streker mellom dem, eller tomme bokser, betyr at fonten ikke kunne håndtere det.

Hvis du jobber med latinske bokstaver, velg et skjema og si hvilket

Mye sanskrit sirkulerer i romanisert form, og det er mer enn én måte å gjøre det på. Skjemaene er ikke utskiftbare, og en fil som blander to av dem er korrupt på en måte som er vanskelig å oppdage og irriterende å reparere. Bestem deg for hvilket dokumentet ditt bruker før du oversetter noe, og noter valget et sted i filen.

Diakritiske skjemaer

Standarden som brukes i akademisk publisering markerer lange vokaler med en strek og retrofleks konsonanter med en prikk under. Den er entydig og lesbar, og den trenger en font med full Latin Extended Additional-dekning. Dens nære slektning, den internasjonale standarden for translitterasjon av indiske skrifter, skiller seg ut i en håndfull tegn, noe som er akkurat nok til å forårsake problemer hvis du antar at de er de samme.

Enkle ASCII-skjemaer

Flere konvensjoner koder de samme forskjellene ved å bruke bare vanlige tastaturtegn, noen ved å kapitalisere bokstaver, andre ved å doble dem eller legge til tegnsetting. De eksisterer fordi de overlever e-post, filnavn og gamle systemer intakt. De er også gjensidig inkompatible, og den samme strengen betyr forskjellige ting under forskjellige skjemaer.

Populære stavemåter

Yoga- og devotional-publisering dropper vanligvis merkene helt og skriver ord omtrent slik en engelsktalende ville sagt dem. Det er greit for et generelt publikum og ubrukelig for alt som trenger å være reversibelt, fordi informasjonen som skiller flere forskjellige lyder er kastet bort.

Hva folk faktisk oversetter

Sanskrit er ikke et administrativt språk. Ingen har et sanskrit fødselsattest. Forespørslene som kommer inn faller inn i et smalt og ganske forutsigbart sett, og å vite hvilket du er i forteller deg hvor mye menneskelig gjennomgang jobben trenger:

  • Rituelt og liturgisk materiale: resitasjonshefter, seremoniordener, hymnesamlinger og tempelpublikasjoner som må være typografisk nøyaktige fordi de skal leses høyt
  • Yoga- og meditasjonslærerutdanningsmanualer, der klassiske vers vises sammen med romanisert translitterasjon og en engelsk glosse på samme side
  • Ayurvediske og tradisjonelle medisinske tekster, formularer og kommentarlitteratur
  • Filosofiske og litterære verk og den moderne forskningen om dem, inkludert kritiske utgaver med apparat på mer enn ett skrift
  • Manuskriptkataloger og arkivbeskrivelser fra digitaliseringsprosjekter
  • Skole- og universitetsmateriell, pensum og eksamensoppgaver fra institusjoner som underviser i det
  • Inskripsjoner, epigrafiske transkripsjoner og museumsmerker
  • Institusjonelle mottoer, seremonielle tekster, invitasjoner og tittelblader, der en kort passasje må være nøyaktig riktig

Ingen av disse er sertifiseringssaker på samme måte som et immigrasjonsdokument, men flere er verre å få feil. En feilaktig oversatt seremoniordre eller en ødelagt konjunkt i en trykt utgave er offentlig synlig og permanent, så gjennomgangstrinnet her betyr noe selv om ingen myndighet krever det.

Spørsmål om sanskritoversettelse

Hvor nøyaktig er maskinoversettelse av klassisk sanskrit?

Mindre nøyaktig enn for noe moderne språk, og det er best å vite det på forhånd. Det er langt mindre parallell tekst å lære av, den overlevende korpusen er stort sett vers og tekniske avhandlinger snarere enn vanlig prosa, og språket smelter sammen ord ved grensene deres, slik at selv det å finne hvor ett ord slutter er et problem. Behandle utdata som en lesehjelp som fremskynder arbeidet for noen som kan språket, ikke som en ferdig oversettelse.

Hvilken skrift vil utdata bruke?

Devanagari, som er det praktisk talt all moderne sanskrit-publisering bruker. Historisk sett ble språket skrevet i den skriften en region brukte, fra Grantha og Sharada til bengali, telugu, malayalam og tibetansk, og manuskripter overlever i alle dem. Hvis prosjektet ditt trenger en av disse, er det spesialisert typografisk arbeid snarere enn noe et generelt oversettelsesverktøy dekker.

Hvorfor ser noen sammenføyde bokstaver separerte ut i stedet for stablet?

Fordi fonten som brukes ikke inneholder den spesifikke ligaturen. Sanskrit produserer konsonantstabler tre og noen ganger fire dypt som moderne indiske språk aldri genererer, og en font bygget for hindi dekker de vanlige kombinasjonene og faller tilbake til å skrive resten som separate bokstaver forbundet med en liten strek. Det er lesbart, men i en trykt utgave ser det feil ut, så sjekk en tett passasje med høy forstørrelse.

Vil vediske aksentmerker overleve?

Ofte ikke, og dette er verdt å sjekke spesifikt. Resitasjonsmerkene er kodet i et separat område av Unicode fra vanlig Devanagari, og de fleste fonter har ingen glyfer for dem, så en konvertering kan droppe dem mens resten av teksten ser perfekt ut. For alt materiale som er ment å resiteres, sammenlign utdata mot kilden linje for linje i stedet for å anta at merkene kom med.

Kan jeg få sanskrit i romersk transkripsjon i stedet for Devanagari?

Flere romaniseringssystemer finnes, og de er ikke utskiftbare. Den akademiske standarden bruker streker over lange vokaler og prikker under retroflekse konsonanter; den internasjonale transkripsjonsstandarden skiller seg fra den i noen få tegn; og det finnes rene tastaturskjemaer som koder de samme forskjellene med store bokstaver eller doble bokstaver. Bestem deg for hvilken ditt prosjekt bruker, og oppgi det, for et dokument som blander to skjemaer er korrupt på en måte som er kjedelig å fikse.

Kan den lese et skannet palmeblad eller et gammelt trykt manuskript?

Trykte utgaver fra forrige århundre, pent skannet, er det realistiske tilfellet. Manuskripter er det ikke: skriften flyter uten mellomrom, bokstavformene varierer etter region og skriver, og det fysiske underlaget er ofte skadet. Manuskriptarbeid krever spesialverktøy og en forsker. Last opp trykt materiale i høy oppløsning og forvent å måtte korrigere resultatet.

Jeg trenger et kort sanskrit-motto eller en inskripsjon. Er dette egnet?

Det er et rimelig startpunkt og et dårlig sluttpunkt. Korte seremonielle tekster er de folk legger merke til, de blir ofte permanent hugget, trykt eller brodert, og små feil i kasusendinger eller sammensatte ord er synlige for alle som leser språket. Generer et utkast, og få deretter en sanskrit-forsker til å bekrefte det før noe blir hugget i stein eller trykt.

Hva er grensene og kostnaden?

Filer opptil 1 GB eller 5 000 sider på Månedlige og Årlige planer. Månedlig plan er 14,99 dollar som dekker 100 sider eller 30 000 ord, Årlig plan er 135 dollar i året, omtrent 11,25 dollar i måneden, og AI-oversettelse koster 0,005 dollar per ord. 2 dollar 7-dagers prøveperiode dekker 10 sider eller 3 000 ord, som er den fornuftige måten å sjekke hvordan devanagari-typografien i dokumentet ditt ser ut.

Oversett et dokument til sanskrit

Last opp din PDF og last ned en sanskritversjon i Devanagari med den opprinnelige sidestrukturen, bildene og tabellene beholdt. Filer opptil 1 GB, med en kort prøveperiode for å sjekke hvordan skriften settes.

Våre partnere

Accenture
Bloomberg
Citrix
P&G
SAP