分离文档批次
在每一页首页查找重复的标题,然后查看单独的页面组。
查找短语。预览各部分。拆分您的文档。
匹配的页面标记边界。所有页面都保留在输出中。
解压 ZIP 文件以打开各个 PDF。
选择一个包含可选文本的 PDF,或尝试示例批次。
输入短语,选择搜索位置,然后点击“查找拆分点”。查看页面范围。
点击“开始”并下载包含编号部分的 ZIP 文件。
“按文本拆分 PDF”功能可在包含您所选短语的页面处拆分可选择文本的 PDF。使用此功能可将发票、报告或信件批次整理成单独的 PDF 部分,无需上传。
在每一页首页查找重复的标题,然后查看单独的页面组。
在顶部四分之一处搜索发票标题,以避免在正文内部提及处拆分。
使用唯一的章节标记,并选择它属于前一部分还是后一部分。
使用重复出现的标题或标记来分隔文档部分。
搜索会匹配一行文本中的字面单词或短语。默认情况下,它会忽略字母大小写,并规范化空格和 Unicode 表示形式。当大小写很重要时,请开启“匹配大小写”。不使用正则表达式和 OCR。
支持可选择的阿拉伯语和拉丁文本。损坏的字符映射、轮廓化文本或跨行拆分的短语可能无法匹配。请检查高亮显示的行和生成的各个部分。
搜索整页、仅页眉或仅页脚。
“页眉”搜索每页的顶部四分之一;“页脚”搜索底部四分之一。这些选择有助于避免正文中重复出现的单词导致不必要的拆分。
只有“查找拆分点”或“开始”会扫描整个文档。打开 PDF 时会显示预览,而不会启动全文档搜索。
保留封面页及其后续内容,或保留结束标记及其前置内容。
“之前”会在每个匹配页面处开始一个新部分。“之后”会在该处结束一个部分。单页上的重复匹配只会创建一个边界。
第一个标记之前和最后一个标记之后的页面会被保留。相邻的匹配页面可能会产生单页部分。不会创建空的 PDF。
点击编号部分以预览其第一页。
侧边栏显示所有原始页面。匹配的行会在活动预览中高亮显示,部分列表会显示精确的页码范围。更改短语或搜索区域并再次运行搜索。
“开始”会创建一个包含编号 PDF 的 ZIP 文件。如果没有页面匹配,ZIP 将包含一个包含所有页面的 PDF。“返回”将回到您的设置。
在不栅格化文本和矢量图形的情况下拆分页面。
页面尺寸和可见页面内容会被复制到单独的 PDF 中。这不是一个修订工具,数字签名在拆分后将不再有效。
不保证文档级书签、交互式表单和跨越部分边界的链接在拆分后的文件中能正常工作。请在您的 PDF 阅读器中检查重要文档。
打开一个最大 100 MB 且最多 750 页的 PDF。复杂文档可能会受到额外的输出、内存和处理限制。
处理过程在您的设备上进行,无需上传文档。请在关闭页面前下载结果;请单独保存原始文件。
在开始前了解预期效果。
隐私处理可以。输入关键字,选择搜索区域,然后点击“查找拆分点”。查看各部分,然后点击“开始”下载 ZIP 文件。
只有具有可搜索文本层的页面才能匹配。纯图像扫描件需要先进行 OCR。完全纯图像的文件会产生说明,而不是误导性的拆分。
它们会保持在拆分边界之间的原始顺序。不会丢弃任何页面。
可以。选择“之后”。当标记应作为下一部分的开始时,请使用“之前”。
可以,当 PDF 包含正确编码的可选阿拉伯语文本时。变音符号必须与输入的短语匹配。跨越不同行的文本可能无法匹配。
ZIP 文件包含一个包含所有原始页面的 PDF。尝试更短的短语或不同的搜索区域,并查看匹配的行。
不会。搜索和导出在您的浏览器中运行。打开一个最大 100 MB 和 750 页的 PDF。
快速视频教程
如何根据特定文本拆分 PDF
使用重复的标题作为部分边界。
英语旁白
观看视频