Oparte na SI · 120+ języków

Przetłumacz PDF na sanskryt

Przetłumacz PDF na sanskryt, klasyczny język Indii, renderowany w Devanagari z jego stosami liter sprzężonych i z zachowaniem układu strony. Pliki do 1 GB.

Maks. rozmiar pliku 1 GB Zachowuje oryginalne formatowanie
Zarejestruj się za darmo

Prześlij lub upuść dokument do tłumaczenia

Maks. rozmiar pliku 1 GB

.PDF .DOCX .PPTX .XLSX .TXT .JPG .PNG .IDML .EPUB .HTML
Afrikaans (Afrikaans)
Shqip (Albanian)
አማርኛ (Amharic)
العربية (Arabic)
Հայերեն (Armenian)
azerski (Azerbejdżan)
Euskara (Basque)
Беларуская (Belarusian)
বাংলা (Bengali)
Bosanski (Bosnian)
Български (Bulgarian)
မြန်မာဘာသာ (Burmese)
Català (Catalan)
Cebuano (Cebuano)
Chichewa (Chichewa)
中文 简体 (Chiński uproszczony)
中文 繁體 (Chiński tradycyjny)
Corsu (Korsykański)
Hrvatski (Croatian)
Čeština (Czech)
Dansk (Danish)
Nederlands (Dutch)
English (English)
Esperanto (Esperanto)
Eesti (Estonian)
Suomi (Finnish)
Français (French)
Frysk (Fryzyjski)
Galego (Galicyjski)
ქართული (Gruziński)
Deutsch (German)
Ελληνικά (Greek)
ગુજરાતી (Gujarati)
Kreyòl Ayisyen (Haitański)
Hausa (Hausa)
ʻŌlelo Hawaiʻi (Hawajski)
עברית (Hebrew)
हिंदी (Hindi)
Hmoob (Hmong)
Magyar (Hungarian)
Íslenska (Islandzki)
Igbo (Igbo)
Bahasa Indonesia (Indonezyjski)
Gaeilge (Irlandzki)
Italiano (Italian)
日本語 (Japanese)
Basa Jawa (Javanese)
ಕನ್ನಡ (Kannada)
Қазақ тілі (Kazachski)
ខ្មែរ (Khmer)
Ikinyarwanda (Kinyarwanda)
한국어 (Korean)
Kurdî (Kurdish)
Кыргызча (Kirgiski)
ລາວ (Laotański)
Latina (Łacina)
Latviešu (Łotewski)
Lietuvių (Litewski)
Lëtzebuergesch (Luksemburski)
Македонски (Macedoński)
Malagasy (Malagaszy)
Bahasa Melayu (Malay)
മലയാളം (Malajalam)
Malti (Maltański)
Te Reo Māori (Maoryski)
मराठी (Marathi)
Монгол хэл (Mongolski)
नेपाली (Nepalski)
Norsk (Norwegian)
ଓଡ଼ିଆ (Odia)
فارسی (Persian)
Polski (Polish)
Português (Portugalski)
ਪੰਜਾਬੀ (Punjabi)
Română (Romanian)
Русский (Russian)
Gagana Samoa (Samoa)
Gàidhlig (Szkocki)
Српски (Serbian)
Sesotho (Sotho)
Shona (Shona)
سنڌي (Sindhi)
සිංහල (Syngaleski)
Slovenčina (Slovakian)
Slovenščina (Slovenian)
Soomaali (Somalijski)
Español (Spanish)
Basa Sunda (Sundajski)
Kiswahili (Suahili)
Svenska (Swedish)
Tagalog (Tagalog)
Tadżycki (Tadżycki)
தமிழ் (Tamil)
Tatarski (Tatarski)
తెలుగు (Telugu)
Tajski (Tajski)
Türkçe (Turkish)
Turkmeński (Turkmeński)
Українська (Ukrainian)
اردو (Urdu)
Ujgurski (Ujgurski)
Uzbecki (Uzbecki)
Tiếng Việt (Vietnamese)
Walijski (Walijski)
Xhosa (Xhosa)
Jidysz (Jidysz)
Joruba (Joruba)
Zulu (Zulu)
Afrikaans (Afrikaans)
Shqip (Albanian)
አማርኛ (Amharic)
العربية (Arabic)
Հայերեն (Armenian)
azerski (Azerbejdżan)
Euskara (Basque)
Беларуская (Belarusian)
বাংলা (Bengali)
Bosanski (Bosnian)
Български (Bulgarian)
မြန်မာဘာသာ (Burmese)
Català (Catalan)
Cebuano (Cebuano)
Chichewa (Chichewa)
中文 简体 (Chiński uproszczony)
中文 繁體 (Chiński tradycyjny)
Corsu (Korsykański)
Hrvatski (Croatian)
Čeština (Czech)
Dansk (Danish)
Nederlands (Dutch)
English (English)
Esperanto (Esperanto)
Eesti (Estonian)
Suomi (Finnish)
Français (French)
Frysk (Fryzyjski)
Galego (Galicyjski)
ქართული (Gruziński)
Deutsch (German)
Ελληνικά (Greek)
ગુજરાતી (Gujarati)
Kreyòl Ayisyen (Haitański)
Hausa (Hausa)
ʻŌlelo Hawaiʻi (Hawajski)
עברית (Hebrew)
हिंदी (Hindi)
Hmoob (Hmong)
Magyar (Hungarian)
Íslenska (Islandzki)
Igbo (Igbo)
Bahasa Indonesia (Indonezyjski)
Gaeilge (Irlandzki)
Italiano (Italian)
日本語 (Japanese)
Basa Jawa (Javanese)
ಕನ್ನಡ (Kannada)
Қазақ тілі (Kazachski)
ខ្មែរ (Khmer)
Ikinyarwanda (Kinyarwanda)
한국어 (Korean)
Kurdî (Kurdish)
Кыргызча (Kirgiski)
ລາວ (Laotański)
Latina (Łacina)
Latviešu (Łotewski)
Lietuvių (Litewski)
Lëtzebuergesch (Luksemburski)
Македонски (Macedoński)
Malagasy (Malagaszy)
Bahasa Melayu (Malay)
മലയാളം (Malajalam)
Malti (Maltański)
Te Reo Māori (Maoryski)
मराठी (Marathi)
Монгол хэл (Mongolski)
नेपाली (Nepalski)
Norsk (Norwegian)
ଓଡ଼ିଆ (Odia)
فارسی (Persian)
Polski (Polish)
Português (Portugalski)
ਪੰਜਾਬੀ (Punjabi)
Română (Romanian)
Русский (Russian)
Gagana Samoa (Samoa)
Gàidhlig (Szkocki)
Српски (Serbian)
Sesotho (Sotho)
Shona (Shona)
سنڌي (Sindhi)
සිංහල (Syngaleski)
Slovenčina (Slovakian)
Slovenščina (Slovenian)
Soomaali (Somalijski)
Español (Spanish)
Basa Sunda (Sundajski)
Kiswahili (Suahili)
Svenska (Swedish)
Tagalog (Tagalog)
Tadżycki (Tadżycki)
தமிழ் (Tamil)
Tatarski (Tatarski)
తెలుగు (Telugu)
Tajski (Tajski)
Türkçe (Turkish)
Turkmeński (Turkmeński)
Українська (Ukrainian)
اردو (Urdu)
Ujgurski (Ujgurski)
Uzbecki (Uzbecki)
Tiếng Việt (Vietnamese)
Walijski (Walijski)
Xhosa (Xhosa)
Jidysz (Jidysz)
Joruba (Joruba)
Zulu (Zulu)
ARABSKI PORTUGALSKI ROSYJSKI WŁOSKI KOREAŃSKI HOLENDERSKI POLSKI TURECKI SZWEDZKI ANGIELSKI HISZPAŃSKI FRANCUSKI NIEMIECKI CHIŃSKI JAPOŃSKI HINDI BENGALSKI WIETNAMSKI TAJSKI GRECKI HEBRAJSKI ARABSKI PORTUGALSKI ROSYJSKI WŁOSKI KOREAŃSKI HOLENDERSKI POLSKI TURECKI SZWEDZKI ANGIELSKI HISZPAŃSKI FRANCUSKI NIEMIECKI CHIŃSKI JAPOŃSKI HINDI BENGALSKI WIETNAMSKI TAJSKI GRECKI HEBRAJSKI

Język, który nigdy nie miał własnego pisma

Sanskryt jest zapisywany od ponad dwóch tysięcy lat, a w tym czasie był zapisywany w dowolnym alfabecie, którego region używał. Zachowały się manuskrypty w Grantha w kraju Tamilów, w Sharada w Kaszmirze, w alfabetach bengalskim, odia, telugu, kannada i malajalam, w piśmie Newari w dolinie Katmandu i w tybetańskim w Himalajach. Devanagari stało się domyślnym dopiero w epoce nowożytnej, głównie dlatego, że to prasy drukarskie je znormalizowały, i pozostaje pismem, którego używa prawie każde obecne wydanie. Tak więc tekst sanskrycki nie jest związany z jednym alfabetem tak, jak współczesny język narodowy, a uczony pracujący z manuskryptami może potrzebować tego samego fragmentu w więcej niż jednym.

Automatyczne tłumaczenie sanskrytu jest rzeczywiście trudniejsze niż tłumaczenie współczesnego języka, i warto to jasno powiedzieć. Dostępny tekst równoległy do trenowania stanowi ułamek tego, co istnieje dla hindi czy hiszpańskiego, zachowany korpus to głównie poezja, filozofia i traktaty techniczne, a nie codzienna proza, a własne nawyki języka działają przeciwko segmentacji. Maszynowy szkic fragmentu sanskryckiego jest pomocą badawczą, a nie ukończonym tłumaczeniem, a wszystko, co ma być cytowane, publikowane lub recytowane, powinno przejść przez kogoś, kto zna ten język.

Druga możliwość jest łatwiejsza i znacznie częstsza w praktyce. Renderowanie tekstu angielskiego na sanskryt jest tym, o co chodzi w większości próśb: motto, inskrypcja, strona tytułowa, zestaw nagłówków wersetów, słowa ceremonialne. W ich przypadku pytania, które mają znaczenie, są typograficzne i ortograficzne, a nie interpretacyjne, i to właśnie te pytania obejmuje ta strona.

Cztery cechy, które zakłócają automatyczne przetwarzanie

  1. Stosy spółgłosek o głębokości trzech i czterech. Devanagari łączy sąsiednie spółgłoski w jedną ligaturę, a sanskryt tworzy grupy, których współczesne języki indyjskie po prostu nie mają: trzy spółgłoski ułożone pionowo, czasem cztery, narysowane jako jeden zazębiający się kształt. Czcionki stworzone dla hindi przenoszą popularne pary i wracają do oddzielnej formy z widoczną kreską dla reszty. Jest to czytelne, ale nie jest to poprawne typograficznie, a w wydaniu drukowanym wygląda źle dla każdego, kto zna ten język.
  2. Słowa, które łączą się na swoich granicach. Sanskryt stosuje zmiany dźwiękowe, gdy jedno słowo spotyka się z następnym, a w klasycznej tradycji pisanej wynikowy ciąg jest często drukowany bez spacji. Decydowanie, gdzie kończy się jedno słowo, jest zatem rzeczywistym problemem analitycznym, a nie kwestią dzielenia według białych znaków, i jest to największa przeszkoda zarówno dla rozpoznawania tekstu, jak i dla tłumaczenia maszynowego tego języka.
  3. Złożenia o długości klauzuli angielskiej. Sanskryt tworzy złożone rzeczowniki, łącząc rdzenie, a pojedynczy złożony wyraz może mieć kilkadziesiąt sylab i wymagać pełnej klauzuli podrzędnej do przetłumaczenia na angielski. Na stronie jeden z nich jest niepodzielnym tokenem, którego żaden algorytm łamania linii nie może bezpiecznie podzielić, ponieważ podział w niewłaściwym miejscu zmienia, które rdzenie należą do siebie.
  4. Znaki akcentu, które żyją poza głównym blokiem. Znaki recytacji wedyjskiej znajdują się w oddzielnej części Unicode, z dala od zwykłych znaków Devanagari, a większość czcionek ich nie obejmuje. Są one rutynowo tracone podczas konwersji, która po cichu usuwa informacje potrzebne recytatorowi z tekstu, który w przeciwnym razie wygląda na kompletny.

Cennik tłumaczenia sanskrytu

Zacznij od krótkiego fragmentu na próbę i zobacz, jak ustawia się Devanagari, zanim przejdziesz dalej.

7-dniowy okres próbny

NAJCZĘŚCIEJ WYBIERANE
2,00 USD dzisiaj

następnie 14,99 USD/miesiąc po zakończeniu okresu próbnego

  • 7-dniowy pełny dostęp próbny
  • Limit próbny: 10 stron lub 3000 słów
  • Tłumaczenie AI za 0,005 $/słowo
  • 120+ języków
  • PDF, DOCX, XLSX, PPTX, IDML, TXT, JPG, PNG, CSV, JSON
  • Dostęp zespołowy i niestandardowe glosariusze
  • Wsparcie e-mail

Miesięczny

POPULAR
14,99 USD/miesiąc

Regularna cena 29,99 USD, teraz 50% taniej

  • 100 stron lub 30 000 słów miesięcznie
  • Tłumaczenie AI za 0,005 $/słowo
  • 120+ języków
  • Nieograniczone przechowywanie plików
  • PDF, DOCX, XLSX, PPTX, IDML, TXT, JPG, PNG, CSV, JSON
  • Dostęp zespołowy i niestandardowe glosariusze
  • Priorytetowe wsparcie e-mail
🎉 Najlepsza oferta: oszczędność 44,88 USD rocznie

Roczny

OSZCZĘDNOŚĆ 25%
135 USD/rok

około 11,25 USD/miesiąc, oszczędność 25% w porównaniu do miesięcznego

  • 100 stron lub 30 000 słów miesięcznie
  • Tłumaczenie AI za 0,005 $/słowo
  • 120+ języków
  • Nieograniczone przechowywanie plików
  • PDF, DOCX, XLSX, PPTX, IDML, TXT, JPG, PNG, CSV, JSON
  • Dostęp zespołowy i niestandardowe glosariusze
  • Priorytetowe wsparcie e-mail
Wymagane kroki

Uruchamianie tłumaczenia sanskrytu

01

Utwórz konto

Zarejestruj się podając adres e-mail, aby otworzyć pulpit nawigacyjny.

02

Prześlij dokument

Upuść PDF lub wyszukaj go. Pliki do 1 GB są obsługiwane w płatnych planach, które obejmują kompletne wydanie lub zeskanowany katalog manuskryptów.

03

Ustaw sanskryt jako cel

Najpierw wybierz język źródłowy swojego pliku. Jeśli źródłem jest sama transkrypcja sanskrytu na alfabet łaciński, a nie angielski, jest to inne zadanie i należy o tym wspomnieć.

04

Powiększ sprzężenia

Otwórz ukończony PDF przy dużym powiększeniu. Prawidłowo ułożone ligatury oznaczają, że kształtowanie zadziałało; oddzielone litery z kreskami między nimi lub puste pola oznaczają, że czcionka nie poradziła sobie.

Jeśli pracujesz w alfabecie łacińskim, wybierz schemat i powiedz, który

Duża część sanskrytu krąży w formie zromanizowanej i istnieje więcej niż jeden sposób jej zapisu. Schematy nie są wymienne, a plik, który miesza dwa z nich, jest uszkodzony w sposób trudny do wykrycia i uciążliwy do naprawy. Zdecyduj, którego schematu używa Twój dokument, zanim przetłumaczysz cokolwiek, i zapisz wybór gdzieś w pliku.

Schematy znaków diakrytycznych

Standard używany w publikacjach akademickich oznacza długie samogłoski kreską, a spółgłoski retrofleksyjne kropką pod spodem. Jest jednoznaczny i czytelny, i wymaga czcionki z pełnym rozszerzeniem Latin Extended Additional. Jego bliski krewny, międzynarodowy standard transkrypcji pism indyjskich, różni się kilkoma znakami, co wystarcza, aby spowodować problemy, jeśli założysz, że są takie same.

Proste schematy ASCII

Kilka konwencji koduje te same rozróżnienia, używając tylko zwykłych znaków klawiatury, niektóre przez wielkie litery, inne przez podwajanie ich lub dodawanie interpunkcji. Istnieją, ponieważ przetrwają e-maile, nazwy plików i stare systemy w nienaruszonym stanie. Są również wzajemnie niekompatybilne, a ten sam ciąg znaków oznacza różne rzeczy w różnych schematach.

Popularne pisownie

Publikacje o jodze i dewocyjne zazwyczaj pomijają znaki i piszą słowa w przybliżeniu tak, jak powiedziałby je anglojęzyczny użytkownik. Jest to dobre dla ogólnej publiczności i bezużyteczne dla wszystkiego, co wymaga odwracalności, ponieważ informacje rozróżniające kilka różnych dźwięków zostały wyrzucone.

Co ludzie faktycznie tłumaczą

Sanskryt nie jest językiem administracyjnym. Nikt nie ma aktu urodzenia w sanskrycie. Przesyłane prośby należą do wąskiego i dość przewidywalnego zestawu, a wiedza, w którym z nich się znajdujesz, mówi Ci, ile ludzkiej weryfikacji potrzebuje zadanie:

  • Materiały rytualne i liturgiczne: broszury do recytacji, porządki ceremonii, zbiory hymnów i publikacje świątynne, które muszą być typograficznie dokładne, ponieważ będą czytane na głos
  • Podręczniki do szkolenia nauczycieli jogi i medytacji, gdzie klasyczne wersety pojawiają się obok transkrypcji na alfabet łaciński i angielskiego glosariusza na tej samej stronie
  • Teksty ajurwedyjskie i tradycyjnej medycyny, farmakopee i literaturę komentującą
  • Dzieła filozoficzne i literackie oraz współczesne badania naukowe na ich temat, w tym wydania krytyczne z aparatem krytycznym w więcej niż jednym piśmie
  • Katalogi rękopisów i opisy archiwalne z projektów digitalizacji
  • Materiały szkolne i uniwersyteckie, sylabusy i arkusze egzaminacyjne z instytucji, które tego nauczają
  • Napisy, transkrypcje epigraficzne i etykiety muzealne
  • Motto instytucji, teksty ceremonialne, zaproszenia i strony tytułowe, gdzie krótki fragment musi być idealny

Żadne z tych zleceń nie jest przypadkiem certyfikacyjnym w taki sposób, jak dokument imigracyjny, ale kilka z nich jest gorszych do błędnego przetłumaczenia. Błędnie przetłumaczony porządek ceremonii lub zepsute połączenie spółgłoskowe w wydaniu drukowanym jest widoczne publicznie i trwałe, więc etap recenzji ma tu znaczenie, nawet jeśli żadna władza tego nie wymaga.

Pytania dotyczące tłumaczenia na sanskryt

Jak dokładne jest tłumaczenie maszynowe klasycznego sanskrytu?

Mniej dokładne niż w jakimkolwiek współczesnym języku, i lepiej wiedzieć to z góry. Jest znacznie mniej równoległego tekstu do nauki, ocalały korpus to głównie wiersze i traktaty techniczne, a nie zwykła proza, a język łączy słowa na ich granicach, tak że nawet znalezienie miejsca, gdzie kończy się jedno słowo, jest problemem. Traktuj wynik jako pomoc w czytaniu, która przyspiesza pracę dla kogoś, kto zna język, a nie jako gotowe tłumaczenie.

Którego skryptu użyje wynik?

Devanagari, które jest tym, co używa praktycznie całe współczesne wydawnictwo sanskryckie. Historycznie język był pisany w dowolnym skrypcie używanym w danym regionie, od Grantha i Sharada po bengalski, telugu, malajalam i tybetański, a manuskrypty przetrwały we wszystkich z nich. Jeśli Twój projekt wymaga jednego z nich, jest to specjalistyczna praca typograficzna, a nie coś, co obejmuje ogólne narzędzie do tłumaczenia.

Dlaczego niektóre połączone litery wyglądają na oddzielone zamiast nałożone?

Ponieważ używana czcionka nie zawiera tej konkretnej ligatury. Sanskryt tworzy stosy spółgłosek o głębokości trzech, a czasem czterech, których współczesne języki indyjskie nigdy nie generują, a czcionka zbudowana dla hindi obejmuje powszechne kombinacje i zapisuje resztę jako oddzielne litery połączone małą kreską. Jest to czytelne, ale w drukowanym wydaniu wygląda źle, więc sprawdź gęsty fragment przy dużym powiększeniu.

Czy znaki akcentu wedyjskiego przetrwają?

Często nie, i warto to sprawdzić. Znaki recytacji są kodowane w oddzielnym obszarze Unicode od zwykłego Devanagari, a większość czcionek nie ma dla nich glifów, więc konwersja może je pominąć, pozostawiając resztę tekstu wyglądającą idealnie. W przypadku jakichkolwiek materiałów przeznaczonych do recytacji, porównaj wynik z oryginałem linia po linii, zamiast zakładać, że znaki zostały przeniesione.

Czy mogę otrzymać sanskryt w transkrypcji rzymskiej zamiast Devanagari?

Istnieje kilka systemów transkrypcji, które nie są wymienne. Standard akademicki używa kresek nad długimi samogłoskami i kropek pod spółgłoskami retrofleksyjnymi; międzynarodowy standard transliteracji różni się od niego kilkoma znakami; istnieją też schematy z prostą klawiaturą, które kodują te same rozróżnienia za pomocą wielkich liter lub podwojonych liter. Zdecyduj, którego używa Twój projekt i określ to, ponieważ dokument mieszający dwa schematy jest uszkodzony w sposób żmudny do naprawienia.

Czy potrafi odczytać zeskanowany liść palmowy lub stary rękopis?

Drukowane wydania z ubiegłego wieku, czysto zeskanowane, to realistyczny przypadek. Rękopisy nie: pismo biegnie bez odstępów między słowami, kształty liter różnią się w zależności od regionu i skryby, a fizyczne podłoże jest często uszkodzone. Praca z rękopisami wymaga specjalistycznych narzędzi i uczonego. Prześlij materiały drukowane w wysokiej rozdzielczości i spodziewaj się poprawiania wyniku.

Potrzebuję krótkiego sanskryckiego motta lub inskrypcji. Czy to się nadaje?

To rozsądny punkt wyjścia i zły punkt końcowy. Krótkie teksty ceremonialne są tymi, na które ludzie zwracają uwagę, są często trwale wyryte, wydrukowane lub wyhaftowane, a drobne błędy w końcówkach przypadków lub tworzeniu złożeń są widoczne dla każdego, kto czyta ten język. Wygeneruj szkic, a następnie poproś uczonego sanskrytologa o jego potwierdzenie, zanim cokolwiek zostanie wyryte w kamieniu lub wydrukowane.

Jakie są limity i koszt?

Pliki do 1 GB lub 5000 stron w planach Miesięcznym i Rocznym. Plan Miesięczny kosztuje 14,99 USD i obejmuje 100 stron lub 30 000 słów, plan Roczny kosztuje 135 USD rocznie, czyli około 11,25 USD miesięcznie, a tłumaczenie AI kosztuje 0,005 USD za słowo. 7-dniowy okres próbny za 2 USD obejmuje 10 stron lub 3000 słów, co jest rozsądnym sposobem na sprawdzenie, jak wyglądają typograficzne znaki Devanagari w Twoim dokumencie.

Przetłumacz dokument na sanskryt

Prześlij swój PDF i pobierz wersję w sanskrycie w piśmie Dewanagari z zachowaniem oryginalnej struktury strony, obrazów i tabel. Pliki do 1 GB, z krótkim okresem próbnym do sprawdzenia, jak ustawia się pismo.

Nasi partnerzy

Accenture
Bloomberg
Citrix
P&G
SAP