工具150

实用的 PDF 指南

如何将 PDF 转换为可编辑文本

从基于文本的 PDF 中提取文字。

将现有的 PDF 文本提取为一个 TXT 文件或多个独立页面文件。选择页面并在重复使用文本前检查阅读顺序。

跟随指南操作
真实工具示例
转换前四页源 PDF 的第一页。
  • 4 个 PDF 页面
转换后实际合并后的 TXT 下载文件的第一页摘录。
  • 1 个 TXT 文件 · 3,940 字节
  • 显示第一页摘录
PDF 设计将变为纯文本。仅显示第一页;下载的 TXT 文件包含所有四个选定页面。
Advertisements
快速视频教程 如何将 PDF 转换为可编辑文本 从基于文本的 PDF 中提取文字。 英语旁白 观看视频

如何将 PDF 转换为可编辑文本

Advertisements

打开 PDF 转文本,选择页面并选择下载格式。我们的四页示例生成一个包含提取页面文本的 UTF-8 TXT 文件。

01

加载包含可用文本的 PDF

选择原始 PDF。检查其文本是否可以在查看器中被选中。仅由像素组成的扫描页面需要 PDF OCR 才能提供有用的文本。

02

设置页面和打包方式

将 页面留空以处理整个文档,或输入范围以处理子集。预览中显示的页面并非导出范围。

选择 一个文本文件以获取合并后的 TXT(如示例所示),或选择 独立文件以获取包含页面级文本文件和合并文件的 ZIP 包。

03

提取并检查文本

选择 开始并下载。该示例生成 3,940 字节,其中四个页面部分由分页符分隔。

在文本编辑器中打开 TXT 并检查列、标题和表格。提取过程可能会保留不寻常的 PDF 间距;在将文本粘贴到目标位置之前请先进行清理。

一些有用的细节

常见问题

为什么我的扫描件结果为空?

该页面可能仅包含图像。请使用 PDF OCR 来识别其中的文字;此工具仅提取现有的文本层。

哪个工具更适合处理标题和注释?

当标题标记和段落比纯 TXT 更实用时,请尝试 PDF 转 Markdown。同时也要检查其推断出的结构。

轮到你了

用您的文档试一试

检查结果,然后保存您需要的版本。

打开 PDF 转文本

图片详情

Advertisements

語38

English العربية Français Italiano Deutsch Español Português Nederlands Русский Türkçe 日本語 中文 हिन्दी Bahasa Indonesia Bahasa Melayu 한국어 Tiếng Việt ไทย Polski Svenska Українська Norsk বাংলা Ελληνικά فارسی اردو Čeština Dansk Magyar Română Suomi Български Filipino ქართული Slovenčina Azərbaycanca עברית Slovenščina