收集电话详情
从PDF目录中收集号码及其来源页面。
无需逐个复制即可收集电话号码。
| 类型 | 值 | 计数 | 页码 |
|---|
复制和下载包含所有匹配行,涵盖所有结果页面。CSV 包含计数和 PDF 页码;TXT 仅包含值。
在结果中选择页码以检查其来源。高亮显示表示大致位置。
您的列表已准备就绪。下载它,或返回以查看并更改格式。
加载包含可选择文本的文档,或尝试示例。
选择“提取”。查看值、计数和源页面;筛选或排序列表。
复制值,或下载包含页面引用的 CSV 或简单的 TXT 列表。
在一个PDF中查找识别出的电话号码,对相同号码的重复格式进行分组,并保留页面引用。复制列表或将其导出为CSV或TXT。
从PDF目录中收集号码及其来源页面。
选择手册或成员列表中使用的国家/地区。
选择地区后,合并等效的国际和国内格式。
以 +国家代码 开头的号码开始,或选择本地联系人所属的国家/地区。
默认仅识别国际号码。选择一个国家/地区,即可使用该国的编号规则来解析国内格式。识别出的分机号将被保留,等效格式将按标准化的国际号码加分机号进行分组。
匹配过程会检查特定国家的号码格式。阿拉伯-印度数字和波斯数字会被标准化以进行匹配。显示的值将保持可读的识别形式;此功能并非可用性查询或反向查找服务。
检查计数、跳转至 PDF 页面并筛选结果列表。
每个结果都会记录其在 PDF 中的物理页面位置,这可能与打印的页码不同。选择一个页面标签即可打开预览并查看大致的高亮显示。
“移除重复项”默认开启。计数会合并相同数值的识别重复项;关闭此选项可查看单独出现的次数。按字母顺序排序可更改列表顺序。筛选功能同时适用于复制、下载以及可见行。
选择 CSV 以获取计数和页码,或选择 TXT 以每行一个值的方式导出。
CSV 包含类型、值、计数和页码列。UTF-8 编码支持阿拉伯语和其他脚本。可能被解释为电子表格公式的值会加上撇号前缀,以便更安全地导入。
TXT 和“复制全部”仅包含值,每行一个。即使屏幕上的表格跨越多个结果页面,所有符合过滤条件的行都会被包含在内。不会创建新的 PDF,源 PDF 也保持不变。
在浏览器中处理一个 PDF,并设有明确的限制和部分结果通知。
加载单个最大 50 MiB 和 500 页的 PDF。提取过程会检查每页最多 250,000 个字符和 2,000 个匹配项,总体最多 1,000 万个字符和 20,000 个匹配项,以及每页 2,000 个注释。90 秒的提取预算限制了长时间的运行。非常复杂的文档在拆分为较小的文件时效果更好。
当达到限制或页面无法完全读取时,结果会显示通知,且受限或失败的运行会在文件名中导出 partial 标识。没有可选文本的页面会被单独计算。请对纯图像扫描件使用 PDF OCR,然后再返回提取识别出的文本。
PDF 内容在此浏览器中进行本地处理。上传的文档不会发送到提取服务器。PDF 内发现的链接、电子邮件地址和电话号码绝不会被自动联系。
打开一个最大 50 MB 且最多 750 页的 PDF。复杂文档可能会受到额外的输出、内存和处理限制。
处理过程在您的设备上进行,无需上传文档。请在关闭页面前下载结果;请单独保存原始文件。
在开始前了解预期效果。
在您的设备上处理在 PDF 中查找识别出的电话号码,对相同号码的重复格式进行分组,并保留页码引用。复制列表或将其导出为 CSV 或 TXT。号码格式验证无法确认线路是否存在或可接通。请为国内号码选择地区。短代码、OCR 错误和歧义数字文本可能会被遗漏。
仅读取可选择的文本和识别出的链接目标。纯图像页面需要先进行 PDF OCR。运行 OCR,下载可搜索的 PDF,然后返回此提取器。
“移除重复项”功能会合并识别出的等效值。“计数”显示检测到的出现次数,“页面”列出物理 PDF 页面位置。禁用此选项可保持各项独立。同一页面上的打印目标和匹配的可点击链接不会被重复计算。
CSV 包含类型、值、出现次数和页面引用。TXT 和“全部复制”仅提供值,每行一个。所有匹配当前筛选器的行都会被包含,而不仅仅是当前可见的表格页面。
不会。PDF 解析、匹配和导出均在此浏览器中运行。原始 PDF 保持不变。提取出的任何链接、电子邮件或电话号码都不会被自动联系。
单个 PDF 最大 50 MiB 和 500 页。提取限制为每页 250,000 个文本字符和 2,000 个匹配项,总计 1,000 万个字符和 20,000 个匹配项,以及每页 2,000 个注释。如果因限制或页面无法读取导致结果不完整,系统会显示提示。
快速视频教程
如何从 PDF 中提取电话号码
建立一个带有源页面的可查看电话列表。
英语旁白
观看视频