PDF에서 링크 추출을(를) 열어 한 줄씩 복사할 필요 없이 PDF에서 값을 수집하세요. 이 비교는 실제 샘플 문서와 도구에서 다운로드한 CSV를 사용합니다. 3페이지 분량의 샘플에서 5개의 발생 건수로부터 4개의 고유한 웹 주소를 생성합니다.
PDF 열기
PDF를 업로드하거나 샘플 사용을(를) 선택하여 이 예제를 따라 해 보세요. PDF 미리보기와 페이지 썸네일이 나타납니다. 원본 파일은 변경되지 않으며 추출은 브라우저 내에서 실행됩니다.
텍스트 기반의 디렉터리, 보고서, 연구 논문 또는 브로슈어는 유용한 시작점입니다. 이미지 전용 스캔 파일은 인쇄된 텍스트를 인식하기 전에 OCR이 필요합니다.
유용한 옵션 선택
휴대폰에서는 설정을(를) 여세요. 데스크톱에서는 미리보기 옆의 설정 패널을 사용하세요.
중복 제거를 활성화하여 반복되는 대상을 그룹화하세요. 페이지 참조가 필요하면 CSV를, 단순 URL 목록이 필요하면 TXT를 선택하세요. 이 예제에서는 기본 CSV 형식과 원본 순서를 사용합니다.
일치 항목 추출 및 확인
추출을(를) 선택하세요. 처리가 완료되면 결과 탭에 값, 발생 횟수 및 원본 페이지가 표시됩니다. 원형 페이지 번호를 선택하여 PDF 미리보기에서 해당 위치를 확인한 다음 결과로 돌아오세요.
샘플에는 https://example.org/events가 두 번 포함되어 있으며 다른 3개의 웹 주소가 있습니다. 또한 표시되는 레이블이 대상과 다른 클릭 가능한 링크도 보여줍니다. 같은 페이지에 있는 인쇄된 URL과 동일한 클릭 가능한 대상은 두 번 계산되지 않습니다.
결과 필터링을(를) 사용하여 목록을 좁히세요. 복사 및 다운로드에는 결과 테이블이 여러 화면에 걸쳐 있더라도 일치하는 모든 행이 포함됩니다.
CSV 또는 TXT 다운로드
CSV 다운로드를 선택한 다음 준비 화면의 메인 다운로드 버튼을 사용하세요. CSV에는 유형, 값, 개수 및 페이지 열이 포함됩니다. TXT와 모두 복사에는 줄당 하나의 값이 포함됩니다.
스프레드시트 수식으로 해석될 수 있는 CSV 값은 앞에 아포스트로피를 붙여 보호됩니다. 예를 들어, 국제 전화번호는 더하기 기호로 시작합니다. 스프레드시트 보호 없이 단순 목록이 필요한 경우 TXT를 사용하세요.
자주 묻는 질문
“더 보기”와 같은 단어 뒤에 있는 링크를 찾을 수 있나요?
네, 해당 단어에 PDF 내에 지원되는 HTTP 또는 HTTPS 링크 주석이 있는 경우 가능합니다. 내보낸 값은 해당 웹 대상입니다. 시각적인 밑줄만으로는 클릭 가능한 링크가 존재한다는 증거가 되지 않습니다.
스캔한 PDF는 어떻게 해야 하나요?
PDF OCR을(를) 먼저 실행한 다음 인식된 사본을 이 도구에 불러오세요. OCR 출력을 주의 깊게 확인하세요. 잘못된 문자는 주소나 식별자를 변경할 수 있습니다.
추출 제한은 어떻게 되나요?
최대 50 MiB 및 750페이지의 PDF 하나를 사용하세요. 추출은 전체 20,000개 일치 항목 및 페이지당 2,000개로 제한되며, 90초의 처리 시간이 주어집니다. 텍스트 및 주석 제한도 적용됩니다. 제한이나 읽을 수 없는 페이지로 인해 스캔이 중단되면 도구는 부분 결과 알림을 표시하고 내보내기 파일 이름을 부분으로 표시합니다.
PDF 링크가 자동으로 열리나요?
아니요. 추출은 브라우저에서 파일을 읽으며 추출된 대상을 방문하지 않습니다. 페이지 버튼은 PDF 미리보기 내에서 탐색합니다.
값과 그 맥락 유지
집중된 목록을 추출하고 원본 페이지를 확인한 다음 다음 단계에 적합한 형식을 다운로드하세요.

