翻譯 PDF 至 Maithili
為比哈爾邦和尼泊爾特萊地區的讀者翻譯馬ithili語,使用天城文書寫,保留該語言內建的敬語動詞形式,並保留原始頁面佈局。檔案高達 1 GB。
上傳或拖放文件進行翻譯
最大檔案大小 1 GB
動詞記錄了您正在與誰交談,即使他們不在句子中
大多數語言會根據主語來約定動詞。馬ithili語也是如此,然後在此基礎上做一些不尋常的事情:動詞還編碼了對話者的身份。向年輕親戚和村莊長老描述一個事件,動詞形式會改變,即使事件、主語和賓語相同,並且聽者從未被提及。語言學家對這個系統寫了很多文章,對於任何製作文件的人來說,結果都很簡單。沒有中性的動詞形式可用。每個句子都涉及一種關係。
這使得語域的選擇成為翻譯決策,而不是風格決策。公共告示、法律傳票、學校通知和給家庭成員的信件是針對不同類型的讀者發出的,每種都選擇不同的結尾集。在一個文件中混合不同級別的輸出,讀起來就像作者不斷改變他們對談話對象的想法。英語在這方面沒有給翻譯者任何東西可以依據,因為源文本不包含任何此類標記,必須根據文件的用途來推斷級別。
馬ithili語在米ithila地區使用,即印度北部比哈爾邦和尼泊爾東部特萊地區。2011年印度人口普查記錄了約一千三百五十萬使用者,尼泊爾還有數百萬使用者,在那裡它是除尼泊爾語之外使用最廣泛的語言之一。它於2003年被列入印度憲法第八附表,這使其與該地區鄰近的語言區分開來,尼泊爾的省級安排已賦予其在馬德hes省的官方地位。
現在使用天城文,檔案中使用 Tirhuta 文
今天所有以馬ithili語出版的內容都使用天城文排版,這也是翻譯的輸出。過去並非總是如此。該地區自己的文字,稱為 Tirhuta 或 Mithilakshar,屬於與孟加拉語和阿薩姆語文字相同的家族,看起來與天城文完全不同。它保留在手稿、儀式用途、傳統記錄保存和一個溫和的復興運動中,並且有越來越多的數位化材料以其書寫。
Tirhuta 文帶來了大多數文字沒有的技術問題。它的字符位於 Unicode 範圍 U+11480 開始,這超出了舊軟體所建構的範圍。每個字符在 UTF-8 中需要四個字節,在 UTF-16 中需要一對代碼單元,因此任何仍然假設一個字符是一個雙字節單元的程式都會將單詞截斷,錯誤計算長度,並在截斷字段時損壞文本。字體覆蓋率也很低。如果您正在處理數位化的 Tirhuta 文材料,預計會遇到與翻譯無關,但與字符如何存儲有關的工具問題。
實際上,這意味著工作流程會分開。現代天城文的馬ithili語可以直接翻譯。Tirhuta 文手稿需要先轉錄成天城文,由閱讀該文字的人完成,然後文本就成為普通的翻譯工作。試圖繞過這一步驟會產生基於模型幾乎沒有見過的字符的自信輸出。
馬ithili語 PDF 翻譯定價
先翻譯單頁,以檢查記錄和梵文的渲染效果。
Free
註冊無需信用卡
- $0.005/字 AI 翻譯
- 掃描檔和圖片 PDF 每頁 $1
- 120+ 種語言
- 檔案上限 20 MB 和 20 頁
- DOCX、PDF、XLSX、PPTX、IDML、TXT、JPG、PNG 和 CSV
- 僅 24 小時檔案儲存
- PDF 編輯器和 PDF 轉 DOCX 轉換器
- 隨時取消
- 不包含:電子郵件支援
- 不包含:團隊存取權
- 不包含:無限免費 PDF 預覽
- 不包含:詞彙表
Storage
或每年 $149
- $0.005/字 AI 翻譯
- 掃描檔和圖片 PDF 每頁 $1
- 120+ 種語言
- 檔案上限 100 MB 和 100 頁
- DOCX、PDF、XLSX、PPTX、IDML、TXT、JPG、PNG 和 CSV
- 無限檔案儲存
- PDF 編輯器和 PDF 轉 DOCX 轉換器
- 電子郵件支援
- 隨時取消
- 不包含:團隊存取權
- 不包含:無限免費 PDF 預覽
- 不包含:詞彙表
Pro
或每年 $499
- 每字 $0.004 的 AI 翻譯
- 掃描檔和圖片 PDF 每頁 $0.80
- 120+ 種語言
- 檔案上限 1,000 MB 和 5,000 頁
- DOCX、PDF、XLSX、PPTX、IDML、TXT、JPG、PNG 和 CSV
- 無限檔案儲存
- PDF 編輯器和 PDF 轉 DOCX 轉換器
- 電子郵件支援
- 團隊存取權,最多 5 位成員
- 無限免費 PDF 預覽
- 詞彙表
- 隨時取消
企業方案
$149.99/月,依要求提供。AI 翻譯每字 $0.003(每頁 $0.60),檔案上限 1,000 MB 和 5,000 頁,無限檔案儲存空間和最多 15 位成員的團隊存取權。
大多數地區沒有的書面記錄傳統
米ithila 維護著家系登記簿 panji,由專業記錄員保管,他們追溯多代人的家族譜系。這些登記簿是為了確定允許的婚姻而編纂的,並已保存了數個世紀,主要以 Tirhuta 文書寫。對於家譜學家來說,這是一個異常深入和連續的來源,對於翻譯者來說,這是一份高度縮寫的技術寫作體,其中單個條目可以用幾個詞編碼婚姻、譜系和起源地。
文學記錄同樣古老。Vidyapati 在十四和十五世紀寫的歌曲至今仍在傳唱,他的語言是東印度許多後來的宗教詩歌的基礎。除了書面傳統之外,還有米ithila繪畫,其文件、展覽說明和藝術家聲明在馬ithili語、印地語和英語之間不斷轉換。這也是該語言許多文化翻譯工作實際發生的領域。
邊界兩側的翻譯內容
比哈爾邦的行政管理使用印地語和英語,尼泊爾的行政管理使用尼泊爾語,因此米ithila地區的證書和法院文件通常以這些語言之一的形式出現,而不是馬ithili語。以馬ithili語出現的是為社區準備的文字,以及大量的文學和檔案材料。典型的工作包括:
- 馬ithili語作為學校和大學科目的教科書和考試材料,這在印度和尼泊爾兩側都存在
- 為出版或研究目的而準備的文學作品、詩集、戲劇和民歌彙編
- 米提拉繪畫的展覽目錄、藝術家聲明和文件,在邁提利語、印地語和英語之間轉換
- 馬德胡巴尼、達爾班加、薩哈爾薩等地區和尼泊爾特萊地區的公共資訊和發展計畫材料
- 以該語言製作的廣播劇本、社區報紙和當地新聞稿
- 家譜記錄和家庭文件,包括 panji 摘錄,通常需要音譯後才能翻譯
- 關於該地區的學術研究,其中邁提利語的原始引文需要翻譯成英語
如果您正在準備來自比哈爾邦或尼泊爾的移民或學術文件,這些文件本身幾乎肯定是用印地語、英語或尼泊爾語寫的,並且在提交時需要認證翻譯。特別是對於學校記錄,請參閱成績單翻譯。
分四個步驟翻譯成邁提利語
建立免費帳戶
註冊並輸入您的電子郵件,即可存取線上翻譯儀表板。
上傳您的 PDF 文件
拖放您的檔案或瀏覽選擇。Pro 和 Enterprise 方案支援高達 1,000 MB 的檔案。
選擇邁提利語,而非印地語
兩者都使用天城文,並且詞彙共享,因此自動偵測系統經常會選擇印地語。明確選擇邁提利語才能在輸出中保留敬語動詞形式。
翻譯並檢查動詞結尾
下載完成的 PDF,並請母語人士檢查稱謂級別是否從頭到尾保持一致。這是一份可用翻譯的明確標誌。
關於翻譯邁提利語的問題
所謂的敬語一致性,大家都在談論這種語言,到底是什麼意思?
Maithili語的動詞不僅承載著句子的主語資訊,還承載著對話者的資訊。對一個孩子和一個受尊敬的長者談論同一件事,動詞的結尾會有所不同,即使聽話者在句子中沒有被提及。很少有語言會這樣做。對於文件工作來說,這意味著你無法寫出一個中性的句子:你選擇的形式告訴讀者你如何看待他們,因此必須有意識地選擇等級,然後保持一致。
Maithili語只是帶有地區口音的印地語嗎?
不是。它是一門獨立的語言,擁有自己的文學,可追溯到十四世紀的Vidyapati,擁有自己的歷史文字和語法機制,包括對話者一致性,這是印地語所沒有的。它於2003年被添加到印度憲法的第八附表。兩者共享Devanagari文字和大量詞彙,這正是為什麼自動偵測引擎傾向於產生印地語並稱之為Maithili語的原因。
您能翻譯Tirhuta文字的文件嗎?
不能直接翻譯,任何聲稱可以的工具都應視為不可靠。Tirhuta,也稱為Mithilakshar,是該地區的歷史文字,與Bengali語和Assamese語的文字有關,而不是與Devanagari語有關。其中數位化的文本相對較少,字體支援有限,其字元位於較舊軟體處理不當的Unicode範圍內。可行的辦法是由閱讀該文字的人將其轉錄成Devanagari語,然後再進行普通翻譯。
為什麼即使字體正確,軟體也會損壞我的Tirhuta文字?
因為字元在Unicode中的位置。Tirhuta區塊從U+11480開始,高於較舊程式編寫來處理的範圍,因此每個字元在UTF-8中佔用四個位元組,在UTF-16中佔用兩個程式碼單元。假設字元是單個雙位元組單位的軟體,在截斷欄位時會將字元一分為二,報告錯誤的字串長度並在儲存時損壞文字。這比PDF閱讀器更容易影響資料庫和內容系統。
官方用途需要哪些Maithili語文件?
很少,因為在比哈爾邦的官方事務以印地語和英語進行,在尼泊爾則以尼泊爾語進行。來自米提拉地區的證書、土地記錄、法院命令和公民身份文件將使用其中一種語言,因此您為簽證或大學申請所需的文件翻譯並非來自Maithili語。對Maithili語翻譯的要求通常是為了觸及讀者或閱讀文化和檔案資料。
我可以翻譯Maithili語詩歌和歌詞嗎?
您可以獲得它們的大致含義,這通常是研究人員或出版商需要了解一個文集內容時的目的。在任何語言中,詩歌都是自動翻譯最薄弱的案例,而Maithili語的虔誠詩歌添加了層次化的意象和源自梵語的詞彙,這對通用模型來說處理起來參差不齊。使用輸出結果來瀏覽大量材料,並為打算出版的任何內容聘請文學翻譯家。
Maithili語文本與英語相比,長度如何?
水平方向大致相似,但Devanagari文字比拉丁文字需要更多的垂直空間,因為母音符號位於線上和線下,並且連接的橫線橫跨頂部。為英語設計的、行距緊湊的表格和表單是標記開始發生碰撞的地方。排版過程會增加行高而不是允許重疊,因此預計翻譯後的表格會比原始表格稍高。
它能讀掃描的Maithili語書籍或雜誌嗎?
乾淨的圖像可以很好地掃描印刷的Devanagari文字,因此現代書籍或雜誌頁面通常可以準確閱讀。有兩件事會影響掃描效果:薄紙會讓背面透出來,這會混淆連接字母的橫線;手寫體在任何印度文字中仍然很難辨識。掃描解析度應高於拉丁文字頁面,並將書本平放在玻璃上。
相關工具
翻譯 PDF 語言
