打开 从 PDF 中提取电话号码,无需逐行复制即可从一个 PDF 中收集数值。该对比使用了真实的示例文件以及从工具下载的 CSV。三页的示例从 3 次出现中生成了 2 个唯一的国际电话号码。
打开您的 PDF
上传一个 PDF,或选择 尝试示例以跟随此示例。PDF 预览和页面缩略图将会显示。您的原始文件保持不变,提取过程在您的浏览器中运行。
基于文本的目录、报告、研究论文或宣传册是一个有用的起点。仅包含图像的扫描件在识别打印文本前需要进行 OCR。
选择有用的选项
在手机上,打开 设置。在桌面上,使用预览旁边的设置面板。
电话号码地区默认为 仅限国际号码 (+)。对于示例,请保持不变。当您的文档包含不带国家代码的国内号码时,请选择一个国家。保持 删除重复项处于启用状态。
提取并检查匹配项
选择 提取。处理完成后,结果选项卡会显示数值、出现次数和源页面。选择一个圆形的页码以在 PDF 预览中检查其位置,然后返回结果页面。
该示例在第 1 页和第 2 页找到了 +1 (202) 555-0123,在第 1 页找到了 +44 20 7946 0958。同一号码的等效格式按其国际形式和分机号进行分组。源页面按钮让您可以检查匹配项是否确实为联系电话。
使用 筛选结果来缩小列表范围。复制和下载操作包含所有匹配行,即使结果表格跨越了多个屏幕行。
下载 CSV 或 TXT
选择 下载 CSV,然后在就绪屏幕上使用主 下载按钮。CSV 包含类型、值、计数和页码列。TXT 和 全部复制包含每行一个值。
可能被解释为电子表格公式的 CSV 值会以撇号开头进行保护。例如,国际电话号码以加号开头。如果您需要没有电子表格保护的纯列表,请使用 TXT。
常见问题
为什么没有找到本地号码?
在“电话号码地区”中选择其国家,然后再次选择“提取”。仅限国际模式要求以加号开头。如果号码在不寻常的布局中被拆分或没有可选文本,请更正源文件或先使用 OCR。
我应该如何处理扫描的 PDF?
先运行 PDF OCR,然后将识别后的副本加载到此工具中。请仔细检查 OCR 输出:错误的字符可能会更改地址或标识符。
提取限制是什么?
使用一个不超过 50 MiB 和 750 页的 PDF。提取总数限制为 20,000 个匹配项,每页 2,000 个,处理时间预算为 90 秒。文本和注释限制也适用。如果限制或不可读页面中断了扫描,工具会显示部分结果通知,并将导出文件名标记为部分。
我的 PDF 链接会自动打开吗?
不会。提取过程在浏览器中读取文件,不会访问提取出的目标地址。页面按钮用于在 PDF 预览内导航。
保留数值及其上下文
提取重点列表,检查源页面,并下载适合您下一步操作的格式。

