将 PDF 翻译成 Maithili
为比哈尔邦和尼泊尔特莱地区的读者提供迈提利语翻译,使用天城文书写,保留该语言特有的敬语动词形式以及原始页面布局。文件大小最高 1 GB。
上传或拖放文件进行翻译
最大文件大小 1 GB
动词会记录您正在与谁交谈,即使他们不在句子中
大多数语言会根据主语来匹配动词。迈提利语会这样做,然后在此基础上增加一个不寻常的功能:动词还会编码所称呼者的身份。向晚辈和村中长者描述同一事件,动词形式会发生变化,即使事件、主语和宾语都相同,并且听者从未被提及。语言学家对此系统已有很多研究,但对于任何制作文件的人来说,其结果很简单:没有中性动词形式可用。每个句子都决定了一种关系。
这使得语域的选择成为一个翻译决定,而不是风格决定。公共通知、法律传票、学校通知和家庭信件是写给不同类型读者的,每种都选择不同的结尾集。在一个文档中混合使用不同语域的输出,会让人觉得作者一直在改变他们谈话的对象。英语在这方面没有给翻译者任何参考,因为源文本不包含任何此类标记,语域必须根据文档的用途来推断。
迈提利语在米提拉地区使用,即印度北部比哈尔邦和尼泊尔边境的东部特莱地区。2011 年印度人口普查记录了约一千三百五十万使用者,尼泊尔还有数百万使用者,在那里它是除尼泊尔语之外使用最广泛的语言之一。它于 2003 年被列入印度宪法第八附表,这使其与该地区邻近的语言区分开来,尼泊尔的省级安排也赋予了它在马德斯省的官方地位。
现在是天城文,档案中使用 Tirhuta 文
今天出版的所有迈提利语材料都使用天城文排版,翻译也是如此。过去并非如此。该地区自己的文字,称为 Tirhuta 或 Mithilakshar,属于孟加拉语和阿萨姆语文字的同一语系,与天城文完全不同。它保留在手稿、仪式用途、传统记录保存和一项温和的复兴运动中,并且有越来越多的数字化材料使用它。
Tirhuta 文带来了一个大多数文字没有的技术问题。它的字符位于 Unicode 范围 U+11480 开始,高于旧软件构建的范围。每个字符在 UTF-8 中需要四个字节,在 UTF-16 中需要一对代码单元,因此任何仍假定一个字符是一个双字节单元的程序都会将单词截断,错误计算长度,并在截断字段时损坏文本。字体覆盖率也很低。如果您正在处理数字化的 Tirhuta 材料,请期望遇到与翻译无关但与字符存储方式有关的工具问题。
实际上,这意味着工作流程会分开。现代天城文的迈提利语可以直接翻译。Tirhuta 文手稿需要先由懂该文字的人转写成天城文,然后文本就成为普通的翻译工作。试图绕过这一步会产生基于模型几乎未见过的字符的自信输出。
迈提利语 PDF 翻译定价
先翻译一页:这足以检查登记册和梵文的渲染效果。
Free
注册无需信用卡
- 0.005 美元/词 AI 翻译
- 扫描件和图片 PDF 每页 $1
- 120+ 种语言
- 文件大小最高 20 MB,页数最高 20 页
- DOCX、PDF、XLSX、PPTX、IDML、TXT、JPG、PNG 和 CSV
- 仅 24 小时文件存储
- PDF 编辑器和 PDF 转 DOCX 转换器
- 随时取消
- 不包含:邮件支持
- 不包含:团队访问权限
- 不包含:无限免费 PDF 预览
- 不包含:术语表
Storage
或每年 $149
- 0.005 美元/词 AI 翻译
- 扫描件和图片 PDF 每页 $1
- 120+ 种语言
- 文件大小最高 100 MB,页数最高 100 页
- DOCX、PDF、XLSX、PPTX、IDML、TXT、JPG、PNG 和 CSV
- 无限文件存储
- PDF 编辑器和 PDF 转 DOCX 转换器
- 邮件支持
- 随时取消
- 不包含:团队访问权限
- 不包含:无限免费 PDF 预览
- 不包含:术语表
Pro
或每年 $499
- 每字 $0.004 AI 翻译
- 扫描件和图片 PDF 每页 $0.80
- 120+ 种语言
- 文件大小最高 1,000 MB,页数最高 5,000 页
- DOCX、PDF、XLSX、PPTX、IDML、TXT、JPG、PNG 和 CSV
- 无限文件存储
- PDF 编辑器和 PDF 转 DOCX 转换器
- 邮件支持
- 最多 5 名成员的团队访问权限
- 无限免费 PDF 预览
- 术语表
- 随时取消
企业
$149.99/月,按需提供。AI 翻译每字 $0.003(每页 $0.60),文件大小最高 1,000 MB,页数最高 5,000 页,无限文件存储,最多 15 名成员的团队访问权限。
大多数地区没有的书面记录传统
米提拉保留着家谱记录,称为 panji,由专门的记录员保管,他们追溯多代人的家族谱系。这些记录是为了确定允许的婚姻而编纂的,并已保存了几个世纪,大部分使用 Tirhuta 文书写。对于家谱学家来说,这是一个异常深入和连续的来源,对于翻译者来说,这是一份高度缩写的技术写作,其中一个条目可以用几个词编码婚姻、血统和起源地。
文学记录同样悠久。14 世纪和 15 世纪的诗人 Vidyapati 用迈提利语创作的歌曲至今仍在传唱,他的语言是印度东部许多后来的宗教诗歌的基础。除了书面传统,还有米提拉绘画,其文档、展览说明和艺术家声明在迈提利语、印地语和英语之间不断切换。这正是该语言许多文化翻译工作实际发生的地方。
边境两侧的翻译内容
比哈尔邦的行政管理使用印地语和英语,尼泊尔的行政管理使用尼泊尔语,因此来自米提拉地区的证书和法院文件通常以这些语言之一出现,而不是迈提利语。以迈提利语出现的主要是面向社区的书写材料,以及大量的文学和档案材料。典型的工作包括:
- 作为学校和大学科目的迈提利语教材和考试材料,在印度和尼泊尔两边都有
- 文学作品、诗歌集、戏剧和民间歌曲汇编,供出版或学习
- 米提拉绘画的展览目录、艺术家声明和文件,在迈蒂利语、印地语和英语之间切换
- 马德胡巴尼、达尔班加、萨哈尔萨等地区和尼泊尔特莱地区的公共信息和发展项目材料
- 以该语言制作的广播剧本、社区报纸和当地新闻稿
- 家谱记录和家庭文件,包括 panji 摘录,通常需要在翻译前进行音译
- 关于该地区学术研究,其中迈蒂利语的源引用需要翻译成英语
如果您正在准备来自比哈尔邦或尼泊尔的移民或学术文件,这些文件本身几乎肯定是用印地语、英语或尼泊尔语编写的,并且需要认证翻译才能提交。特别是学校记录,请参阅成绩单翻译。
分四步翻译成迈蒂利语
创建免费帐户
使用您的电子邮件注册以访问在线翻译仪表板。
上传您的 PDF 文件
拖放您的文件或浏览选择文件。Pro和Enterprise套餐支持高达1,000 MB的文件。
选择迈蒂利语,而不是印地语
两者都使用天城文,并且共享词汇,因此设置为自动检测的系统通常会选择印地语。明确选择迈蒂利语才能在输出中保留敬语动词形式。
翻译并检查动词结尾
下载完成的PDF,并请母语者检查称谓级别是否从头到尾保持一致。这方面的一致性是可用的翻译的最清晰标志。
关于迈蒂利语翻译的问题
每个人都提到的关于这种语言的尊称一致性是什么意思?
迈蒂利语动词携带关于被称呼者以及句子主语的信息。对孩子和受尊敬的长者谈论同一件事,动词的结尾会有所不同,即使听者在句子中没有被提及。很少有语言这样做。对于文档工作来说,这意味着您无法写出中性句子:您选择的形式告诉读者您如何看待他们,因此必须有意识地选择级别,然后保持一致。
迈蒂利语只是带有地区口音的印地语吗?
不是。它是一门独立的语言,拥有可以追溯到十四世纪Vidyapati的文学作品,拥有自己的历史文字和语法机制,包括印地语所没有的称呼一致性。它于2003年被添加到印度宪法的第八附表中。两者共享梵文书写和大量词汇,这正是为什么自动检测引擎倾向于生成印地语并称之为迈蒂利语的原因。
您能翻译用Tirhuta脚本书写的文档吗?
不能直接翻译,任何声称可以的工具都应视为不可靠。Tirhuta,也称为Mithilakshar,是该地区的历史文字,与孟加拉语和阿萨姆语的文字有关,而不是与梵文有关。用它数字化的文本相对较少,字体支持有限,并且其字符位于旧软件处理不当的Unicode范围内。可行的途径是由阅读该脚本的人将其音译成梵文,然后进行普通翻译。
为什么即使字体正确,软件也会损坏我的Tirhuta文本?
因为字符在Unicode中的位置。Tirhuta块从U+11480开始,高于旧程序编写处理的范围,因此每个字符在UTF-8中占四个字节,在UTF-16中占两个代码单元。假设字符是单个双字节单元的软件会在截断字段时将字符一分为二,报告错误的字符串长度并在保存时损坏文本。这比PDF阅读器更常影响数据库和内容系统。
官方用途需要哪些迈蒂利语文档?
很少。因为比哈尔邦的官方事务以印地语和英语进行,尼泊尔则以尼泊尔语进行。来自米提拉地区的证书、土地记录、法院命令和公民身份文件将是这些语言之一,因此您为签证或大学申请所需的翻译根本不是来自迈蒂利语。迈蒂利语翻译的请求通常是为了触达读者或阅读文化和档案材料。
我可以翻译迈蒂利语诗歌和歌词吗?
您可以获得它们的大致含义,这通常是研究人员或出版商需要了解一个合集包含什么时。任何语言的诗歌都是自动翻译最薄弱的领域,而迈蒂利语的宗教诗歌增加了层次化的意象和来自梵语的词汇,这些对于通用模型来说处理起来参差不齐。使用输出导航材料,并为任何计划出版的内容聘请文学翻译。
迈蒂利语文本的长度与英语相比如何?
水平方向大致相似,但由于元音符号位于线上方和下方,并且连接的横线贯穿顶部,因此梵文书写比拉丁字母需要更多的垂直空间。为英语设计的、行距紧凑的表格和表单会导致标记开始重叠。布局过程会增加行高而不是允许重叠,因此翻译后的表单会比原始表单稍高一些。
它能读取扫描的迈蒂利语书籍或杂志吗?
当图像清晰时,印刷的梵文扫描效果很好,所以现代书籍或杂志页面通常可以准确读取。两件事会影响扫描效果:薄纸会透出背面,这会混淆连接字母的横线;手写体在任何印度文字中仍然很难识别。扫描分辨率应高于拉丁字母页面的分辨率,并将书本平放在玻璃上。
相关工具
按语言翻译 PDF
