AI-gestuurd · 120+ Talen

PDF vertalen naar Sanskriet

Vertaal een PDF naar het Sanskriet, de klassieke taal van India, weergegeven in Devanagari met zijn gestapelde conjunct letters en met behoud van uw paginalay-out. Bestanden tot 1 GB.

Max. bestandsgrootte 1 GB Behoudt originele opmaak
Meld je gratis aan

Upload of laat document vallen om te vertalen

Max. bestandsgrootte 1 GB

.PDF .DOCX .PPTX .XLSX .TXT .JPG .PNG .IDML .EPUB .HTML
Afrikaans (Afrikaans)
Shqip (Albanian)
አማርኛ (Amhaars)
العربية (Arabic)
Հայերեն (Armeens)
Azərbaycan dili (Azerbeidzjaans)
Euskara (Baskisch)
Беларуская (Belaarussisch)
বাংলা (Bengali)
Bosanski (Bosnian)
Български (Bulgarian)
မြန်မာဘာသာ (Birmaans)
Català (Catalaans)
Cebuano (Cebuano)
Chichewa (Chichewa)
中文 简体 (Chinees Vereenvoudigd)
中文 繁體 (Chinees Traditioneel)
Corsu (Corsicaans)
Hrvatski (Croatian)
Čeština (Czech)
Dansk (Danish)
Nederlands (Dutch)
English (English)
Esperanto (Esperanto)
Eesti (Estonian)
Suomi (Finnish)
Français (French)
Frysk (Fries)
Galego (Galicisch)
ქართული (Georgisch)
Deutsch (German)
Ελληνικά (Greek)
ગુજરાતી (Gujarati)
Kreyòl Ayisyen (Haïtiaans)
Hausa (Hausa)
ʻŌlelo Hawaiʻi (Hawaïaans)
עברית (Hebrew)
हिंदी (Hindi)
Hmoob (Hmong)
Magyar (Hungarian)
Íslenska (IJslands)
Igbo (Igbo)
Bahasa Indonesia (Indonesisch)
Gaeilge (Iers)
Italiano (Italian)
日本語 (Japanese)
Basa Jawa (Javanese)
ಕನ್ನಡ (Kannada)
Қазақ тілі (Kazachs)
ខ្មែរ (Khmer)
Ikinyarwanda (Kinyarwanda)
한국어 (Korean)
Kurdî (Kurdish)
Кыргызча (Kirgizisch)
ລາວ (Laotiaans)
Latina (Latijn)
Latviešu (Lets)
Lietuvių (Litouws)
Lëtzebuergesch (Luxemburgs)
Македонски (Macedonisch)
Malagasy (Malagassisch)
Bahasa Melayu (Malay)
മലയാളം (Malayalam)
Malti (Maltees)
Te Reo Māori (Maori)
मराठी (Marathi)
Монгол хэл (Mongools)
नेपाली (Nepalees)
Norsk (Norwegian)
ଓଡ଼ିଆ (Odia)
فارسی (Persian)
Polski (Polish)
Português (Portugees)
ਪੰਜਾਬੀ (Punjabi)
Română (Romanian)
Русский (Russian)
Gagana Samoa (Samoaans)
Gàidhlig (Schots-Gaelisch)
Српски (Serbian)
Sesotho (Sesotho)
Shona (Shona)
سنڌي (Sindhi)
සිංහල (Sinhalees)
Slovenčina (Slovakian)
Slovenščina (Slovenian)
Soomaali (Somali)
Español (Spanish)
Basa Sunda (Sunda)
Kiswahili (Swahili)
Svenska (Swedish)
Tagalog (Tagalog)
Тоҷикӣ (Tajik)
தமிழ் (Tamil)
Татарча (Tatar)
తెలుగు (Telugu)
ไทย (Thai)
Türkçe (Turkish)
Türkmençe (Turkmen)
Українська (Ukrainian)
اردو (Urdu)
ئۇيغۇرچە (Uyghur)
O'zbekcha (Uzbek)
Tiếng Việt (Vietnamese)
Cymraeg (Welsh)
isiXhosa (Xhosa)
ייִדיש (Yiddish)
Yorùbá (Yoruba)
isiZulu (Zulu)
Afrikaans (Afrikaans)
Shqip (Albanian)
አማርኛ (Amhaars)
العربية (Arabic)
Հայերեն (Armeens)
Azərbaycan dili (Azerbeidzjaans)
Euskara (Baskisch)
Беларуская (Belaarussisch)
বাংলা (Bengali)
Bosanski (Bosnian)
Български (Bulgarian)
မြန်မာဘာသာ (Birmaans)
Català (Catalaans)
Cebuano (Cebuano)
Chichewa (Chichewa)
中文 简体 (Chinees Vereenvoudigd)
中文 繁體 (Chinees Traditioneel)
Corsu (Corsicaans)
Hrvatski (Croatian)
Čeština (Czech)
Dansk (Danish)
Nederlands (Dutch)
English (English)
Esperanto (Esperanto)
Eesti (Estonian)
Suomi (Finnish)
Français (French)
Frysk (Fries)
Galego (Galicisch)
ქართული (Georgisch)
Deutsch (German)
Ελληνικά (Greek)
ગુજરાતી (Gujarati)
Kreyòl Ayisyen (Haïtiaans)
Hausa (Hausa)
ʻŌlelo Hawaiʻi (Hawaïaans)
עברית (Hebrew)
हिंदी (Hindi)
Hmoob (Hmong)
Magyar (Hungarian)
Íslenska (IJslands)
Igbo (Igbo)
Bahasa Indonesia (Indonesisch)
Gaeilge (Iers)
Italiano (Italian)
日本語 (Japanese)
Basa Jawa (Javanese)
ಕನ್ನಡ (Kannada)
Қазақ тілі (Kazachs)
ខ្មែរ (Khmer)
Ikinyarwanda (Kinyarwanda)
한국어 (Korean)
Kurdî (Kurdish)
Кыргызча (Kirgizisch)
ລາວ (Laotiaans)
Latina (Latijn)
Latviešu (Lets)
Lietuvių (Litouws)
Lëtzebuergesch (Luxemburgs)
Македонски (Macedonisch)
Malagasy (Malagassisch)
Bahasa Melayu (Malay)
മലയാളം (Malayalam)
Malti (Maltees)
Te Reo Māori (Maori)
मराठी (Marathi)
Монгол хэл (Mongools)
नेपाली (Nepalees)
Norsk (Norwegian)
ଓଡ଼ିଆ (Odia)
فارسی (Persian)
Polski (Polish)
Português (Portugees)
ਪੰਜਾਬੀ (Punjabi)
Română (Romanian)
Русский (Russian)
Gagana Samoa (Samoaans)
Gàidhlig (Schots-Gaelisch)
Српски (Serbian)
Sesotho (Sesotho)
Shona (Shona)
سنڌي (Sindhi)
සිංහල (Sinhalees)
Slovenčina (Slovakian)
Slovenščina (Slovenian)
Soomaali (Somali)
Español (Spanish)
Basa Sunda (Sunda)
Kiswahili (Swahili)
Svenska (Swedish)
Tagalog (Tagalog)
Тоҷикӣ (Tajik)
தமிழ் (Tamil)
Татарча (Tatar)
తెలుగు (Telugu)
ไทย (Thai)
Türkçe (Turkish)
Türkmençe (Turkmen)
Українська (Ukrainian)
اردو (Urdu)
ئۇيغۇرچە (Uyghur)
O'zbekcha (Uzbek)
Tiếng Việt (Vietnamese)
Cymraeg (Welsh)
isiXhosa (Xhosa)
ייִדיש (Yiddish)
Yorùbá (Yoruba)
isiZulu (Zulu)
ARABISCH PORTUGESE RUSSISCH ITALIAANS KOREAANS NEDERLANDS POOLS TURKS ZWEEDS ENGELS SPAANS FRANS DUITS CHINEES JAPANS HINDI BENGALI VIETNAMEES THAI GRIEKS HEBREEUWS ARABISCH PORTUGESE RUSSISCH ITALIAANS KOREAANS NEDERLANDS POOLS TURKS ZWEEDS ENGELS SPAANS FRANS DUITS CHINEES JAPANS HINDI BENGALI VIETNAMEES THAI GRIEKS HEBREEUWS

Een taal die nooit een eigen schrift had

Sanskriet wordt al meer dan tweeduizend jaar op schrift gesteld, en in die tijd is het vastgelegd in welk alfabet de regio dan ook gebruikte. Manuscripten zijn bewaard gebleven in Grantha in het Tamil-land, in Sharada in Kasjmir, in Bengaalse, Odia, Telugu, Kannada en Malayalam letters, in het Newar-schrift in de Kathmandu-vallei en in het Tibetaans in de Himalaya. Devanagari werd pas de standaard in de moderne periode, grotendeels omdat dat is wat drukpersen standaardiseerden, en het blijft het schrift dat bijna elke huidige editie gebruikt. Een Sanskriet-tekst is dus niet gebonden aan één alfabet zoals een moderne nationale taal dat is, en een geleerde die met manuscripten werkt, heeft mogelijk dezelfde passage in meer dan één nodig.

Geautomatiseerde vertaling van Sanskriet is echt moeilijker dan vertaling van een moderne taal, en het is de moeite waard om dat ronduit te zeggen. De parallelle tekst die beschikbaar is om op te trainen is een fractie van wat er bestaat voor Hindi of Spaans, de overgebleven corpus is grotendeels poëzie, filosofie en technische verhandelingen in plaats van alledaagse proza, en de eigen gewoonten van de taal werken tegen segmentatie. Een machine-opzet van een Sanskriet-passage is een hulpmiddel voor onderzoek, geen voltooide vertaling, en alles wat wordt geciteerd, gepubliceerd of voorgedragen, moet door iemand gaan die de taal leest.

De andere richting is gemakkelijker en in de praktijk veel gebruikelijker. Een Engelse tekst in het Sanskriet weergeven is waar de meeste verzoeken eigenlijk over gaan: een motto, een inscriptie, een titelpagina, een reeks verskopjes, ceremoniële bewoordingen. Voor die, de vragen die ertoe doen zijn typografisch en orthografisch in plaats van interpretatief, en het zijn diegene die deze pagina behandelt.

Vier kenmerken die geautomatiseerde verwerking verstoren

  1. Drie en vier diepe medeklinker-stapels. Devanagari voegt aangrenzende medeklinkers samen tot één enkele ligature, en Sanskriet produceert clusters die moderne Indiase talen simpelweg niet hebben: drie medeklinkers verticaal gestapeld, soms vier, getekend als één in elkaar grijpende vorm. Lettertypen gebouwd voor Hindi dragen de gebruikelijke paren en vallen terug op een gescheiden vorm met een zichtbare lijn voor de rest. Dat is leesbaar, maar het is geen correcte typografie, en in een gedrukte editie ziet het er verkeerd uit voor iedereen die de taal leest.
  2. Woorden die aan hun grenzen samensmelten. Sanskriet past klankveranderingen toe waar het ene woord het volgende ontmoet, en in de klassieke geschreven traditie wordt het resulterende geheel vaak zonder spaties afgedrukt. Beslissen waar een woord eindigt is daarom een echt analytisch probleem in plaats van een kwestie van splitsen op witruimte, en het is het grootste obstakel voor zowel tekstherkenning als machinale vertaling van de taal.
  3. Samenstellingen zo lang als een Engelse zin. Sanskriet bouwt samengestelde zelfstandige naamwoorden door stammen aan elkaar te rijgen, en een enkele samenstelling kan tientallen lettergrepen lang zijn en een volledige bijzin vereisen om in het Engels te vertalen. Op een pagina is een van deze een onbreekbaar token dat geen enkele regelbreekalgoritme veilig kan splitsen, omdat het op de verkeerde plaats breken verandert welke stammen bij elkaar horen.
  4. Accenttekens die buiten het hoofdblok leven. Vedische recitatietekens bevinden zich in hun eigen aparte deel van Unicode, weg van de gewone Devanagari-tekens, en de meeste lettertypen dekken ze niet. Ze gaan routinematig verloren bij conversie, wat de informatie die een voordrager nodig heeft uit een tekst die verder compleet lijkt, stilzwijgend verwijdert.

Prijzen voor Sanskriet-vertaling

Begin met een korte passage in de proefversie en kijk hoe de Devanagari wordt gezet voordat u verder gaat.

7-Dagen Proefperiode

MEEST POPULAIR
€2,00 vandaag

daarna €14,99/maand na afloop proefperiode

  • 7-dagen volledige toegang proefperiode
  • Proeflimiet: 10 pagina's of 3.000 woorden
  • €0,005/woord AI-vertaling
  • 120+ talen
  • PDF, DOCX, XLSX, PPTX, IDML, TXT, JPG, PNG, CSV, JSON
  • Teamtoegang & aangepaste woordenlijsten
  • E-mailondersteuning

Maandelijks

POPULAR
€14,99/maand

Reguliere prijs €29,99, nu 50% korting

  • 100 pagina's of 30.000 woorden per maand
  • €0,005/woord AI-vertaling
  • 120+ talen
  • Onbeperkte bestandsopslag
  • PDF, DOCX, XLSX, PPTX, IDML, TXT, JPG, PNG, CSV, JSON
  • Teamtoegang & aangepaste woordenlijsten
  • Prioriteit e-mailondersteuning
🎉 Beste prijs: bespaar €44,88/jaar

Jaarlijks

BESPAAR 25%
€135/jaar

~$11,25/maand, bespaar 25% t.o.v. maandelijks

  • 100 pagina's of 30.000 woorden per maand
  • €0,005/woord AI-vertaling
  • 120+ talen
  • Onbeperkte bestandsopslag
  • PDF, DOCX, XLSX, PPTX, IDML, TXT, JPG, PNG, CSV, JSON
  • Teamtoegang & aangepaste woordenlijsten
  • Prioriteit e-mailondersteuning
Benodigde stappen

Een Sanskriet-vertaling uitvoeren

01

Maak een account aan

Meld u aan met een e-mailadres om het dashboard te openen.

02

Upload het document

Sleep de PDF erin of blader ernaar. Bestanden tot 1 GB worden afgehandeld in de betaalde abonnementen, wat een complete editie of een gescande manuscriptcatalogus dekt.

03

Stel Sanskriet in als doel

Kies eerst de brontaal van uw bestand. Als de bron zelf een geromaniseerde Sanskriet-transliteratie is in plaats van Engels, is dat een andere taak en moet dat worden vermeld.

04

Zoom in op de conjuncten

Open de voltooide PDF op hoge vergroting. Goed gestapelde ligaturen betekenen dat de vormgeving werkte; gescheiden letters met lijnen ertussen, of lege vakjes, betekenen dat het lettertype niet kon omgaan.

Als u in Latijnse letters werkt, kies een schema en zeg welk

Veel Sanskriet circuleert in geromaniseerde vorm, en er is meer dan één manier om dit te doen. De schema's zijn niet uitwisselbaar, en een bestand dat er twee mengt, is beschadigd op een manier die moeilijk te ontdekken en vervelend te repareren is. Bepaal welk schema uw document gebruikt voordat u iets vertaalt, en noteer de keuze ergens in het bestand.

Diakritische schema's

De standaard die in academische publicaties wordt gebruikt, markeert lange klinkers met een streep en retroflexe medeklinkers met een punt eronder. Het is ondubbelzinnig en leesbaar, en het vereist een lettertype met volledige Latin Extended Additional-dekking. De nauwe verwant, de internationale standaard voor het translitereren van Indic-scripts, verschilt in een handvol tekens, wat precies genoeg is om problemen te veroorzaken als u aanneemt dat ze hetzelfde zijn.

Eenvoudige ASCII-schema's

Verschillende conventies coderen dezelfde onderscheidingen met alleen gewone toetsenbordtekens, sommige door letters te kapitaliseren, andere door ze te verdubbelen of interpunctie toe te voegen. Ze bestaan omdat ze e-mail, bestandsnamen en oude systemen intact overleven. Ze zijn ook onderling incompatibel, en dezelfde tekenreeks betekent verschillende dingen onder verschillende schema's.

Populaire spellingen

Yoga- en devotionele publicaties laten de tekens helemaal weg en schrijven woorden ongeveer zoals een Engelstalige spreker ze zou uitspreken. Het is prima voor een algemeen publiek en nutteloos voor alles wat omkeerbaar moet zijn, omdat de informatie die verschillende klanken onderscheidt, is weggegooid.

Wat mensen daadwerkelijk vertalen

Sanskriet is geen administratieve taal. Niemand heeft een Sanskriet-geboorteakte. De verzoeken die binnenkomen vallen in een smalle en vrij voorspelbare set, en weten in welke u zich bevindt, vertelt u hoeveel menselijke beoordeling de taak nodig heeft:

  • Ritueel en liturgisch materiaal: voordrachtboekjes, ceremonie-ordes, hymne-collecties en tempelpublicaties die typografisch exact moeten zijn omdat ze hardop worden voorgelezen
  • Yoga- en meditatie-lerarenopleidingshandleidingen, waar klassieke verzen naast geromaniseerde transliteratie en een Engelse gloss op dezelfde pagina verschijnen
  • Ayurvedische en traditionele medische teksten, formulieren en commentaarliteratuur
  • Filosofische en literaire werken en de moderne wetenschap erover, inclusief kritische edities met apparaten in meer dan één schrift
  • Catalogi van manuscripten en beschrijvingen van archieven uit digitaliseringsprojecten
  • School- en universitair cursusmateriaal, syllabi en examenpapieren van instellingen die het onderwijzen
  • Inscripties, epigrafische transcripties en museumetiketten
  • Institutionele motto's, ceremoniële teksten, uitnodigingen en titelpagina's, waarbij een korte passage precies goed moet zijn

Geen van deze zijn certificeringsgevallen op de manier waarop een immigratiedocument dat is, maar verschillende zijn erger om fout te krijgen. Een verkeerd vertaalde ceremonie-orde of een gebroken conjunct in een gedrukte editie is publiekelijk zichtbaar en permanent, dus de beoordelingsstap hier is belangrijk, ook al eist geen enkele autoriteit dit.

Vragen over Sanskrietvertalingen

Hoe nauwkeurig is machinale vertaling van klassiek Sanskriet?

Minder nauwkeurig dan voor elke moderne taal, en het is beter om dat van tevoren te weten. Er is veel minder parallelle tekst om van te leren, het overgebleven corpus is grotendeels vers en technisch verhandeling in plaats van gewone proza, en de taal voegt woorden samen aan hun grenzen, zodat zelfs het vinden van waar een woord eindigt een probleem is. Behandel de uitvoer als een leesondersteuning die het werk versnelt voor iemand die de taal kent, niet als een voltooide vertaling.

Welk schrift zal de uitvoer gebruiken?

Devanagari, wat vrijwel alle moderne Sanskriet-publicaties gebruiken. Historisch gezien werd de taal geschreven in welk schrift een regio ook gebruikte, van Grantha en Sharada tot Bengaals, Telugu, Malayalam en Tibetaans, en manuscripten overleven in al deze schriften. Als uw project een van die vereist, is dat specialistisch zetselwerk in plaats van iets dat een algemene vertaaltool dekt.

Waarom lijken sommige conjuncte letters gescheiden in plaats van gestapeld?

Omdat het gebruikte lettertype die specifieke ligaturen niet bevat. Sanskriet produceert medeklinker-stapels van drie en soms vier diepte die moderne Indiase talen nooit genereren, en een lettertype gebouwd voor Hindi dekt de gebruikelijke combinaties en valt terug op het schrijven van de rest als afzonderlijke letters verbonden door een kleine streep. Het is leesbaar, maar in een gedrukte editie ziet het er verkeerd uit, dus controleer een dichte passage op hoge vergroting.

Zullen Vedische accenttekens behouden blijven?

Vaak niet, en dit is specifiek de moeite waard om te controleren. De recitatietekens zijn gecodeerd in een apart gebied van Unicode van gewoon Devanagari en de meeste lettertypen hebben er geen glyphs voor, dus een conversie kan ze laten vallen terwijl de rest van de tekst er perfect uitziet. Vergelijk voor elk materiaal dat bedoeld is om gereciteerd te worden, de uitvoer met de bron regel voor regel in plaats van aan te nemen dat de tekens zijn meegekomen.

Kan ik Sanskriet krijgen in geromaniseerde transliteratie in plaats van Devanagari?

Er bestaan verschillende romanisatiesystemen die niet onderling uitwisselbaar zijn. De academische standaard gebruikt streepjes boven lange klinkers en puntjes onder retroflexe medeklinkers; de internationale transliteratiestandaard wijkt hiervan af in een paar tekens; en er zijn toetsenbordvriendelijke schema's die dezelfde onderscheidingen coderen met hoofdletters of dubbele letters. Bepaal welk systeem uw project gebruikt en vermeld dit, want een document waarin twee schema's worden gemengd, is op een vervelende manier gecorrumpeerd om te herstellen.

Kan het een gescand palmblad of een oud gedrukt manuscript lezen?

Gedrukte edities van de vorige eeuw, schoon gescand, zijn het realistische scenario. Manuscripten niet: het schrift loopt zonder woordspatiëring, de lettervormen variëren per regio en scribent, en het fysieke materiaal is vaak beschadigd. Manuscriptwerk vereist specialistische tools en een geleerde. Upload gedrukt materiaal met hoge resolutie en verwacht het resultaat te moeten corrigeren.

Ik heb een korte Sanskriet-motto of een inscriptie nodig. Is dit geschikt?

Het is een redelijk beginpunt en een slecht eindpunt. Korte ceremoniële teksten zijn de teksten die mensen opmerken, ze worden vaak permanent gegraveerd, gedrukt of geborduurd, en kleine fouten in naamvallen of samengestelde vormen zijn zichtbaar voor iedereen die de taal leest. Genereer een concept, laat het dan door een Sanskrietgeleerde bevestigen voordat iets in steen of druk wordt gezet.

Wat zijn de limieten en de kosten?

Bestanden tot 1 GB of 5.000 pagina's in de maandelijkse en jaarlijkse abonnementen. Het maandelijkse abonnement kost $14,99 voor 100 pagina's of 30.000 woorden, het jaarlijkse abonnement kost $135 per jaar, ongeveer $11,25 per maand, en AI-vertaling kost $0,005 per woord. De proefperiode van $2 voor 7 dagen dekt 10 pagina's of 3.000 woorden, wat de verstandige manier is om te controleren hoe de Devanagari-typesets in uw document eruitzien.

Vertaal een document naar het Sanskriet

Upload uw PDF en download een Sanskrietversie in Devanagari met behoud van de oorspronkelijke paginastructuur, afbeeldingen en tabellen. Bestanden tot 1 GB, met een korte proefperiode om te controleren hoe het schrift wordt weergegeven.

Onze Partners

Accenture
Bloomberg
Citrix
P&G
SAP