Abra Extrair links de PDF para coletar valores de um PDF sem copiá-los linha por linha. A comparação usa o documento de amostra real e um CSV baixado da ferramenta. A amostra de três páginas produz 4 endereços da web únicos a partir de 5 ocorrências.
Abra seu PDF
Envie um PDF ou selecione Experimentar amostra para seguir este exemplo. A visualização do PDF e as miniaturas das páginas aparecerão. Seu arquivo original permanece inalterado e a extração é executada no seu navegador.
Um diretório, relatório, artigo de pesquisa ou brochura baseado em texto é um ponto de partida útil. Digitalizações apenas de imagem precisam de OCR antes que seu texto impresso possa ser reconhecido.
Escolha as opções úteis
No celular, abra Configurações. No computador, use o painel de configurações ao lado da visualização.
Mantenha Remover duplicatas ativado para agrupar alvos repetidos. Escolha CSV quando precisar de referências de página, ou TXT para uma lista de URLs simples. O exemplo usa o formato CSV padrão e a ordem de origem.
Extraia e verifique as correspondências
Selecione Extrair. Quando o processamento terminar, a guia Resultados mostrará os valores, contagens de ocorrências e páginas de origem. Selecione um número de página circular para inspecionar sua localização na visualização do PDF, depois retorne aos Resultados.
A amostra inclui https://example.org/events duas vezes e outros três endereços da web. Ela também demonstra um link clicável cujo rótulo visível é diferente do seu destino. Uma URL impressa e seu destino clicável idêntico na mesma página não são contados duas vezes.
Use Filtrar resultados para restringir a lista. Copiar e baixar inclui todas as linhas correspondentes, mesmo quando a tabela de resultados abrange várias telas de linhas.
Baixe CSV ou TXT
Selecione Baixar CSV, depois use o botão principal Baixar na tela de pronto. O CSV contém colunas de Tipo, Valor, Contagem e Páginas. TXT e Copiar tudo contêm um valor por linha.
Valores CSV que poderiam ser interpretados como fórmulas de planilha são protegidos com um apóstrofo inicial. Por exemplo, um número de telefone internacional começa com um sinal de mais. Use TXT se precisar de uma lista simples sem proteção de planilha.
Perguntas comuns
Isso pode encontrar um link atrás de palavras como “Leia mais”?
Sim, quando essas palavras possuem uma anotação de link HTTP ou HTTPS suportada no PDF. O valor exportado é seu destino na web. Um sublinhado visual por si só não prova que um link clicável existe.
O que devo fazer com um PDF digitalizado?
Execute PDF OCR primeiro, depois carregue a cópia reconhecida nesta ferramenta. Verifique a saída do OCR cuidadosamente: um caractere incorreto pode alterar um endereço ou identificador.
Quais são os limites de extração?
Use um PDF de até 50 MiB e 750 páginas. A extração é limitada a 20.000 correspondências no total e 2.000 por página, com um orçamento de processamento de 90 segundos. Limites de texto e anotação também se aplicam. Se um limite ou página ilegível interromper a digitalização, a ferramenta mostra um aviso de resultados parciais e marca o nome do arquivo de exportação como parcial.
Meus links de PDF são abertos automaticamente?
Não. A extração lê o arquivo no navegador e não visita os destinos extraídos. Os botões de página navegam dentro da visualização do PDF.
Mantenha os valores e seu contexto
Extraia uma lista focada, verifique as páginas de origem e baixe o formato que melhor se adapta ao seu próximo passo.

