拆分 PDF:免费在线 PDF 分割器
从长文档中提取页面范围,将文件分成适合上传限制的部分,或逐章分离报告,然后仅翻译重要的页面。
上传或拖放文件进行翻译
最大文件大小 1 GB
- 扫描件和照片的OCR功能
- 108种语言
- 保留原始布局
拆分有不同的含义,所以请先说明您想要哪种
人们带着三种截然不同的想法来到拆分器。它们会产生不同数量的文件和不同的输出,选择错误的原因是必须重新进行拆分。
提取页面范围
您需要第12页到第18页,仅此而已。一个输出文件,其余文档将被丢弃。这就是大多数人所说的需要剪切PDF时的情况,也是从长扫描件中提取一份合同条款或一份证书的背后工作。
将文件分成几部分
整个文档都会被保留,分成固定长度的部分,或者每页一个文件。没有任何东西被丢弃。当文件需要清除附件限制时,或者当扫描的书籍需要变成单独的页面以供归档时,这就是您想要的。
按章节分割
接缝遵循文档自身的书签大纲,而不是页码计数,因此每个章节、附录或部分都会成为自己的文件。它需要源文件包含一个真实的大纲;没有大纲,您就只能回到页码计数。

提取是复制页面,而不是剪切它们
从PDF中提取一个范围会创建一个全新的文档,并将选定的页面复制到其中。您的原始文件永远不会被修改,因此尝试一个范围、查看结果并尝试另一个范围没有任何风险。
每个复制的页面都会带来自己的资源:它使用的字体、放置在其上的图像、其注释和其尺寸框。这就是为什么提取的页面看起来与长文件中的完全一样,也是为什么从图文并茂的报告中提取的三页内容的大小不是三百页原始文件大小的百分之一。资源是按页面计算的,而不是平均分配的。
一个后果会让人措手不及。如果源文档是作为图像扫描的,那么提取的内容也是扫描的图像。拆分不会将文本图片变成文本,因此提取出来的页面在任何内容都可以搜索或翻译之前,仍然需要光学字符识别。

碎片无法再触及的内容
页面指向自身外部的任何内容都可能被拆分。第一部分中一个指向现在位于第三部分的章节的点击式目录,将无处可去,因为目标页面已不在同一个文件中。链接仍然存在并且仍然可以点击,这就是为什么很容易忽略它。
书签大纲也面临同样的问题。它是一个文档级别的对象,因此每个输出文件都需要一个修剪过的副本,其中只列出了实际包含的页面的条目。指向不再存在的页面的条目将导致书签面板大部分无用。
然后有一类软件无法修复的引用:写入正文的交叉引用。法律文书充满了这些。"如第14.3条所述"和"请参阅第212页的附录"是普通文本,一旦第14.3条位于不同的文件中,读者就必须去找到它。当拆分后的文档将由其他人阅读时,例如在文件名或封面页上说明每个部分来自原始文件的哪个部分。
已签名和可填写的文档需要再次查看
PDF中的数字签名会验证其应用到的文件中的字节范围。拆分会生成带有新字节的新文件,因此签名不会随提取的页面一起传输,输出的将是未签名的文档。这是正确的行为,而不是缺陷,因为能够承受被分割的签名将毫无意义。当需要已签名的原始文件时,请保留它,并将提取件与其一起发送,而不是代替它。
填写的表单也值得检查。您看到的框是页面上的注释,而表单本身在文档级别注册,因此从已填写的表单中取出的页面可能会带有框,但其背后的所有内容都会丢失。在打开输出并确认答案存在后再依赖它。首先展平表单,将填写的值转换为普通页面内容,可以完全消除这个问题。
编辑是相反的陷阱,而且更严重。删除包含敏感材料的页面确实会删除这些页面,但用黑色矩形覆盖而不是真正删除的文本仍然存在于随后的每个页面下方。拆分器不是编辑工具。

拆分以仅翻译您需要的内容
翻译按体积收费,因此处理长文档最经济的方法通常是发送更少的内容。一本三百页的技术手册,如果读者只需要安装章节,那么一旦将章节单独提取出来,工作量就是三十页,而不是三百页。
同样的技巧可以使文档保持在套餐限制内。DocTranslator 在 Free 套餐中将每次上传限制为 20 页,在 Basic 套餐中限制为 300 页,仅在 Pro 和 Business 套餐中提供 5,000 页。提取实际需要翻译的页面,可以让大型源文档符合这些数字,这也是在承诺长文件之前,从 0.99 美元起测试质量样本的实用方法。
翻译完成后,您可以使用合并PDF功能将各部分重新组合起来,这对于报告来说是一种常见的往返流程,尤其是在不同版本之间只有部分内容发生变化时。

检查接缝处,而非中间部分
打开输出文件时,请查看每个部分的第一页和最后一页,而不是快速浏览整个文件。越界错误就存在于边界处:如果将范围输入为12到18,但阅读器将封面显示为第一页,那么您将在两端各少一页。跨页的表格或图形是另一件需要注意的事情,因为它现在一半在一个文件里,一半在另一个文件里。
如何在线分割PDF
确定您正在执行的三种操作中的哪一种
保留一个范围并丢弃其余部分、将整个文件拆分成多个部分,或沿着章节大纲进行分割。它们会产生不同数量的文件,因此先选择可以节省第二次尝试。
注意实际页码
根据阅读器显示的页码进行操作,而不是页面上打印的页码。封面页或罗马数字的序言会导致两者不一致,这是“差一”错误产生的根源。
上传源文件
创建一个免费账户,然后拖放PDF文件或浏览选择它。原始文件永远不会被修改,因此您可以尝试一个范围,查看输出结果并进行调整。
打开各部分并检查边界
查看每个输出文件的第一页和最后一页,确认没有在表格中间被截断,然后将您实际需要的片段翻译成120多种语言中的任何一种。
分割PDF问题
拆分会更改或删除我的原始文件吗?
不会。提取会创建一个新文档并将选定的页面复制到其中,使源文件保持不变。您可以尝试一个范围,查看结果,然后尝试另一个范围,而不会对原始文件造成任何风险。
如何避免页面范围的“差一”错误?
使用 PDF 阅读器显示的页码,而不是纸上打印的页码。封面页和罗马数字前言会导致两者不一致,因此看起来正确的打印页码范围可能会开始时偏离一两页。检查输出的第一页和最后一页可以立即发现问题。
我可以将文件拆分,使每个章节成为自己的文档吗?
当源文件带有真实的目录大纲时,这可以实现,因为大纲条目标记了每个章节的开始位置,这些是自然的分割点。没有大纲的文件(包括大多数扫描件)会让工具无从下手,因此您需要回退到自己选择的页面范围。
当我拆分已签名的 PDF 时,数字签名会怎样?
它不会被保留。签名会验证其应用到的文件中的特定字节范围,而拆分会生成包含新字节的新文件,因此提取的页面将不带签名。保留带签名的原始文件,并将提取件与其一起提供,而不是替换它。
链接和书签在每个部分中还会起作用吗?
任何指向其自身文件之外的内容都将无法正常工作。第一部分中的目录条目指向现在位于第三部分的部分将没有可到达的目的地,尽管链接仍然可以点击,这很容易被忽略。散文中的交叉引用,例如对条款 14.3 的提及,是纯文本,需要人工才能遵循。
我的 PDF 是扫描件。拆分后的页面可以搜索吗?
它们本身不能。如果源页面是文本图像,那么提取的页面也是图像,因为拆分是复制页面而不是读取它们。对输出运行光学字符识别,或将提取件上传到 DocTranslator,它会在翻译扫描页面和图像中的文本之前读取它们。
拆分是删除机密页面的好方法吗?
删除整页确实会移除它们,所以这部分是可行的。它不能处理被黑色方框覆盖而不是真正删除的敏感文本,因为该文本仍然存在于随后的每个页面文件中。请使用适当的 redaction 工具来完成这项工作。
拆分如何帮助降低翻译成本?
在 Free 套餐中,每个文档按长度计费,每字 0.005 美元,扫描件每页 1 美元,最低收费 0.99 美元,因此页数越少,账单越少。在订阅套餐中,它会消耗每月包含的页数中的一部分。每个文档的页数限制在 Free 套餐中为 20 页,Basic 套餐为 300 页,Pro 和 Business 套餐为 5,000 页。发送相关章节而非整个手册可将大型文档保持在这些限制内,并且还可以对样本进行廉价的质量测试。
将您的PDF缩减到您需要的页面
提取一个范围,将长文件拆分成可以清除上传限制的部分,并仅翻译重要的页面,而不是为整个文档付费。

