電話の詳細を収集
PDFディレクトリから、ソースページと共に番号を収集します。
一つずつコピーすることなく電話番号を収集します。
| タイプ | 値 | 件数 | ページ |
|---|
コピーおよびダウンロードには、すべての結果ページにわたる一致する行がすべて含まれます。CSVには件数とPDFページ番号が含まれ、TXTには値のみが含まれます。
結果でページ番号を選択してソースを確認してください。ハイライトはおおよその位置を示しています。
リストの準備ができました。ダウンロードするか、戻って確認し、形式を変更してください。
テキスト選択可能なドキュメントを読み込むか、サンプルをお試しください。
「抽出」を選択します。値、件数、ソースページを確認し、リストをフィルタリングまたは並べ替えます。
値をコピーするか、ページ参照付きのCSV、またはシンプルなTXTリストをダウンロードします。
PDF内の認識された電話番号を検索し、同じ番号の繰り返し形式をグループ化して、ページ参照を保持します。リストをコピーするか、CSVまたはTXTとしてエクスポートします。
PDFディレクトリから、ソースページと共に番号を収集します。
パンフレットや会員名簿で使用されている国を選択します。
地域を選択した後、同等の国際形式と国内形式を結合します。
+国番号から始まる番号を使用するか、ローカルの連絡先で使用されている国を選択します。
デフォルトでは国際番号のみが対象です。国を選択すると、その国の番号規則を使用して国内形式も解釈されます。認識された内線番号は保持され、同等の形式は正規化された国際番号と内線番号でグループ化されます。
照合では国別の番号形式を確認します。アラビア・インド数字およびペルシャ数字は照合のために正規化されます。表示される値は読み取り可能な認識形式を維持します。これは有効性確認や逆引きサービスではありません。
件数の確認、PDFページへのジャンプ、結果リストのフィルタリングを行います。
各結果にはPDF内の物理的なページ位置が記録されます(印刷されたページ番号とは異なる場合があります)。ページチップを選択すると、概算のハイライト付きでプレビューが開きます。
「重複を削除」は有効状態で開始されます。件数は同じ値の認識された繰り返しを統合します。オフにすると個別の出現箇所が表示されます。「アルファベット順」でリストの順序を変更できます。フィルタリングは、表示されている行だけでなく、コピーやダウンロードにも適用されます。
件数とページ数にはCSVを、1行に1つの値にはTXTを選択します。
CSVには「タイプ」、「値」、「件数」、「ページ」の列が含まれます。UTF-8エンコーディングにより、アラビア語やその他のスクリプトをサポートします。スプレッドシートの数式として解釈される可能性のある値には、安全にインポートできるようアポストロフィが接頭辞として付加されます。
TXTとコピーには値のみが1行に1つ含まれます。画面上のテーブルが複数の結果ページにまたがっている場合でも、フィルタに一致するすべての行が含まれます。新しいPDFは作成されず、ソースPDFも変更されません。
明確な制限と部分的な結果の通知により、ブラウザ内で1つのPDFを処理します。
最大50 MiB、500ページまでのPDFを読み込めます。抽出は1ページあたり最大250,000文字と2,000件の照合、全体で1,000万文字と20,000件の照合、および1ページあたり2,000件の注釈を確認します。90秒の抽出予算が長時間の実行を制限します。非常に複雑なドキュメントは、小さなファイルに分割するとより適切に動作する場合があります。
制限に達した場合やページを完全に読み取れない場合、結果に通知が表示され、制限付きまたは失敗した実行はファイル名に「partial」を付けてエクスポートされます。選択可能なテキストがないページは個別にカウントされます。画像のみのスキャンにはPDF OCRを使用し、認識されたテキストを抽出してください。
PDFコンテンツはこのブラウザ内でローカルに処理されます。アップロードされたドキュメントが抽出サーバーに送信されることはありません。PDF内で見つかったリンク、メールアドレス、電話番号に自動的に連絡することはありません。
最大50 MB、750ページまでのPDFを1つ開けます。複雑なドキュメントでは、出力、メモリ、処理の制限が適用される場合があります。
処理はドキュメントをアップロードすることなく、お使いのデバイス上で行われます。ページを閉じる前に結果をダウンロードしてください。元のファイルは別途保管してください。
開始する前に、何が起こるかを確認してください。
このデバイスで処理PDF内の認識された電話番号を検索し、同じ番号の繰り返し形式をグループ化し、ページ参照を保持します。リストをコピーするか、CSVまたはTXTとしてエクスポートします。番号形式の検証では、回線が存在するか、到達可能であるかを確認することはできません。国内番号の場合は地域を選択してください。短縮番号、OCRエラー、曖昧な数値テキストは見逃される可能性があります。
選択可能なテキストと認識されたリンクターゲットのみが読み取られます。画像のみのページには、まずPDF OCRが必要です。OCRを実行し、検索可能なPDFをダウンロードしてから、この抽出ツールに戻ってください。
「重複を削除」は、認識された同等の値を結合します。「カウント」は検出された出現回数を示し、「ページ」は物理的なPDFのページ位置を一覧表示します。このオプションを無効にすると、出現箇所を個別に保持します。同じページ上の印刷されたターゲットと一致するクリック可能なリンクは、二重カウントされません。
CSVには、タイプ、値、出現回数、ページ参照が含まれます。TXTおよび「すべてコピー」は、1行に1つずつ値のみを提供します。表示されているテーブルページだけでなく、現在のフィルターに一致するすべての行が含まれます。
いいえ。PDFの解析、照合、エクスポートはすべてこのブラウザ内で実行されます。元のPDFは変更されません。抽出されたリンク、メールアドレス、電話番号に自動的に連絡することはありません。
1つのPDFにつき最大50 MiB、500ページまでです。抽出は、1ページあたり最大250,000文字および2,000件の一致、全体で最大1,000万文字および20,000件の一致、1ページあたり2,000件の注釈に制限されています。制限や読み取り不可能なページにより結果が部分的になる場合は、その旨が通知されます。
クイックビデオチュートリアル
PDFから電話番号を抽出する方法
ソースページを添付した、確認可能な電話リストを作成します。
英語ナレーション
動画を見る