출처 링크 수집
보고서 및 연구 문서에서 참조 목록을 작성하세요.
PDF에서 유용한 링크를 추출하세요.
| 유형 | 값 | 개수 | 페이지 |
|---|
복사 및 다운로드에는 모든 결과 페이지에 걸쳐 일치하는 모든 행이 포함됩니다. CSV에는 개수와 PDF 페이지 번호가 포함되며, TXT에는 값만 포함됩니다.
결과에서 페이지 번호를 선택하여 출처를 확인하세요. 강조 표시된 부분은 대략적인 위치를 나타냅니다.
목록이 준비되었습니다. 다운로드하거나 돌아가서 검토하고 형식을 변경하세요.
텍스트 선택이 가능한 문서를 불러오거나 샘플을 사용해 보세요.
추출을 선택하세요. 값, 개수 및 원본 페이지를 검토하고 목록을 필터링하거나 정렬하세요.
값을 복사하거나, 페이지 참조가 포함된 CSV 또는 간단한 TXT 목록을 다운로드하세요.
PDF에서 인쇄된 HTTP/HTTPS 주소, www 주소 및 클릭 가능한 웹 링크 대상을 수집하세요. 페이지 참조를 유지하고 중복 제거된 목록을 CSV 또는 TXT로 다운로드하세요.
보고서 및 연구 문서에서 참조 목록을 작성하세요.
클릭 가능한 리소스 레이블 뒤에 숨겨진 대상을 추출하세요.
다른 곳에서 검토하기 전에 각 링크가 발견된 위치를 기록하세요.
레이블이 “더 보기”라고만 되어 있어도 링크 대상을 포함합니다.
http://, https:// 또는 www.로 시작하는 인쇄된 링크가 인식됩니다. PDF 링크 주석은 일반 텍스트 뒤에 숨겨진 HTTP/HTTPS 대상을 드러낼 수도 있습니다. PDF가 URL을 클릭 가능한 레이블로 표시할 필요는 없습니다.
페이지 내의 동일한 인쇄된 대상과 주석은 중복 계산되지 않습니다. 정규화된 URL 형식이 중복 비교에 사용되며, 처음 인식된 철자가 표시됩니다. 길거나 줄 바꿈된, 또는 손상된 URL은 수동 수정이 필요할 수 있습니다. 추출된 URL은 자동으로 가져오지 않습니다.
개수를 확인하고, PDF 페이지로 이동하며, 결과 목록을 필터링합니다.
각 결과는 PDF 내의 물리적 페이지 위치를 기록하며, 이는 인쇄된 페이지 번호와 다를 수 있습니다. 페이지 칩을 선택하여 대략적인 강조 표시와 함께 미리보기를 엽니다.
중복 제거는 기본적으로 활성화되어 있습니다. 개수는 동일한 값의 인식된 반복을 결합합니다. 별도의 발생 항목을 보려면 이 기능을 끄세요. 알파벳순 정렬은 목록 순서를 변경합니다. 필터링은 화면에 표시된 행뿐만 아니라 복사 및 다운로드에도 적용됩니다.
개수와 페이지를 보려면 CSV를, 줄당 하나의 값을 보려면 TXT를 선택하세요.
CSV에는 유형, 값, 개수 및 페이지 열이 포함됩니다. UTF-8 인코딩은 아랍어 및 기타 스크립트를 지원합니다. 스프레드시트 수식으로 해석될 수 있는 값은 더 안전한 가져오기를 위해 앞에 아포스트로피가 붙습니다.
TXT와 모두 복사는 줄당 하나의 값만 포함합니다. 화면의 표가 여러 결과 페이지에 걸쳐 있더라도 필터와 일치하는 모든 행이 포함됩니다. 새 PDF는 생성되지 않으며 원본 PDF는 변경되지 않습니다.
명시적 제한과 부분 결과 알림을 통해 브라우저에서 하나의 PDF를 처리합니다.
최대 50 MiB 및 500페이지의 PDF 하나를 로드합니다. 추출은 페이지당 최대 250,000자 및 2,000개의 일치 항목, 전체적으로 1,000만 자 및 20,000개의 일치 항목, 페이지당 2,000개의 주석을 확인합니다. 90초의 추출 예산이 긴 작업을 제한합니다. 매우 복잡한 문서는 더 작은 파일로 분할할 때 더 잘 작동할 수 있습니다.
제한에 도달하거나 페이지를 완전히 읽을 수 없는 경우, 결과에 알림이 표시되며 제한되거나 실패한 실행은 파일 이름에 partial이 포함되어 내보내집니다. 선택 가능한 텍스트가 없는 페이지는 별도로 계산됩니다. 이미지 전용 스캔의 경우 PDF OCR을 사용한 다음, 인식된 텍스트를 추출하세요.
PDF 콘텐츠는 이 브라우저에서 로컬로 처리됩니다. 업로드된 문서는 추출 서버로 전송되지 않습니다. PDF 내에서 발견된 링크, 이메일 주소 및 전화번호는 자동으로 연락되지 않습니다.
최대 50 MB 및 750 페이지까지 PDF 하나를 엽니다. 복잡한 문서의 경우 추가적인 출력, 메모리 및 처리 제한이 적용될 수 있습니다.
처리는 문서를 업로드하지 않고 기기에서 수행됩니다. 페이지를 닫기 전에 결과를 다운로드하고 원본은 별도로 보관하세요.
시작하기 전에 무엇을 기대할 수 있는지 확인하세요.
내 기기에서 처리하나의 PDF에서 인쇄된 HTTP/HTTPS 주소, www 주소 및 클릭 가능한 웹 링크 대상을 수집합니다. 페이지 참조를 유지하고 중복 제거된 목록을 CSV 또는 TXT로 다운로드하십시오. 이 도구는 링크의 작동 여부를 확인하지 않습니다. 내부 페이지 대상, JavaScript 작업, mailto 및 기타 웹이 아닌 스키마는 웹 링크로 내보내지지 않습니다.
선택 가능한 텍스트와 인식된 링크 대상만 읽을 수 있습니다. 이미지 전용 페이지는 먼저 PDF OCR을 거쳐야 합니다. OCR을 실행하고 검색 가능한 PDF를 다운로드한 다음, 이 추출기로 돌아오십시오.
중복 제거 기능은 인식된 동일한 값을 결합합니다. 개수는 감지된 발생 횟수를 나타내며, 페이지는 물리적인 PDF 페이지 위치를 나열합니다. 발생 항목을 별도로 유지하려면 이 옵션을 비활성화하십시오. 동일한 페이지에 있는 인쇄된 대상과 일치하는 클릭 가능한 링크는 이중으로 계산되지 않습니다.
CSV에는 유형, 값, 발생 횟수 및 페이지 참조가 포함됩니다. TXT와 모두 복사 기능은 값만 줄당 하나씩 제공합니다. 현재 필터와 일치하는 모든 행이 포함되며, 화면에 보이는 테이블 페이지만 포함되는 것은 아닙니다.
아니요. PDF 파싱, 일치 및 내보내기는 이 브라우저에서 실행됩니다. 원본 PDF는 변경되지 않습니다. 추출된 링크, 이메일 또는 전화번호는 자동으로 연락되지 않습니다.
최대 50 MiB 및 500페이지의 PDF 하나를 처리할 수 있습니다. 추출은 페이지당 최대 250,000개의 텍스트 문자와 2,000개의 일치 항목, 전체적으로 1,000만 개의 문자와 20,000개의 일치 항목, 그리고 페이지당 2,000개의 주석으로 제한됩니다. 제한 사항이나 읽을 수 없는 페이지로 인해 결과가 부분적일 경우 알림이 표시됩니다.
빠른 영상 튜토리얼
PDF에서 링크 및 URL을 추출하는 방법
하나씩 열지 않고 유용한 웹 링크를 보관하세요.
영어 내레이션
영상 보기