打开 PDF 转文本,选择页面并选择下载格式。我们的四页示例生成一个包含提取页面文本的 UTF-8 TXT 文件。
01
加载包含可用文本的 PDF
选择原始 PDF。检查其文本是否可以在查看器中被选中。仅由像素组成的扫描页面需要 PDF OCR 才能提供有用的文本。
02
设置页面和打包方式
将 页面留空以处理整个文档,或输入范围以处理子集。预览中显示的页面并非导出范围。
选择 一个文本文件以获取合并后的 TXT(如示例所示),或选择 独立文件以获取包含页面级文本文件和合并文件的 ZIP 包。
03
提取并检查文本
选择 开始并下载。该示例生成 3,940 字节,其中四个页面部分由分页符分隔。
在文本编辑器中打开 TXT 并检查列、标题和表格。提取过程可能会保留不寻常的 PDF 间距;在将文本粘贴到目标位置之前请先进行清理。
常见问题
为什么我的扫描件结果为空?
该页面可能仅包含图像。请使用 PDF OCR 来识别其中的文字;此工具仅提取现有的文本层。
哪个工具更适合处理标题和注释?
当标题标记和段落比纯 TXT 更实用时,请尝试 PDF 转 Markdown。同时也要检查其推断出的结构。
轮到你了
打开 PDF 转文本 用您的文档试一试
检查结果,然后保存您需要的版本。

