Ferramentas150

Uma tarefa de PDF útil, simplificada

Extrair e-mails de PDF.

Transforme detalhes de contato no seu PDF em uma lista de e-mails limpa.

Advertisements
Seu espaço de trabalho de PDF
No seu dispositivo
ou largue os seus ficheiros aqui
Seu PDF é processado neste navegador. PDF
Advertisements

Como extrair e-mails de PDF

  1. 01

    Escolha um PDF

    Carregue um documento com texto selecionável ou experimente o exemplo.

  2. 02

    Extrair e revisar

    Selecione Extrair. Revise valores, contagens e páginas de origem; filtre ou ordene a lista.

  3. 03

    Copiar ou baixar

    Copie os valores ou baixe o CSV com referências de página ou uma lista TXT simples.

BlogComo extrair endereços de e-mail de um PDFLer o guia

Extrair endereços de e-mail de diretórios e relatórios

Transforme texto de contato selecionável em um PDF em uma lista de e-mails reutilizável. Os endereços reconhecidos incluem texto de e-mail convencional e destinos de link mailto. Revise as contagens e as páginas de origem antes de copiar ou fazer o Baixar.

Os valores reconhecidos tornam-se uma lista com referências à página de origem.
TUTORIAL EM VÍDEO RÁPIDO Como extrair endereços de e-mail de um PDF Transforme detalhes de contato dispersos em uma lista de e-mails organizada. Narração em inglês Assistir ao vídeo

Como extrair endereços de e-mail de um PDF

Quando isso é útil?

Diretórios

Coletar endereços de contato

Transforme um diretório de membros ou eventos em uma lista com referências de página.

Pesquisa

Reunir contatos de autores

Encontre endereços de correspondência em artigos, currículos ou relatórios.

PDFs longos

Evite cópias repetidas

Agrupe endereços repetidos e inspecione com que frequência eles aparecem.

Recursos e controles

Reconheça endereços de e-mail

Colete endereços de texto e links de e-mail.

Formas de e-mail suportadas

O extrator procura por endereços convencionais local-part@domain, incluindo tags de adição e nomes com pontos. Aceita nomes de domínio internacionalizados, mas não nomes de caixa de correio não ASCII, partes locais entre aspas ou endereços deliberadamente ofuscados.

Os endereços são comparados sem diferenciar maiúsculas de minúsculas ao remover duplicatas. Um endereço visível idêntico e um destino mailto na mesma página não são contados duas vezes apenas porque o texto é clicável. Mapas de caracteres PDF corrompidos e endereços quebrados entre linhas podem exigir revisão manual.

Revise os valores com suas páginas de origem

Verifique contagens, pule para uma página do PDF e filtre a lista de resultados.

Revise e organize

Cada resultado registra a posição física da página no PDF, que pode diferir dos números de página impressos. Selecione um chip de página para abrir a visualização com um destaque aproximado.

A remoção de duplicatas começa ativada. As contagens combinam repetições reconhecidas do mesmo valor; desative-a para ver ocorrências separadas. Ordenar alfabeticamente altera a ordem da lista. A filtragem aplica-se à cópia e aos downloads, bem como às linhas visíveis.

Copie valores ou baixe uma lista estruturada

Escolha CSV para contagens e páginas, ou TXT para um valor por linha.

O que cada download contém

O CSV contém colunas de Tipo, Valor, Contagem e Páginas. A codificação UTF-8 suporta árabe e outros scripts. Valores que poderiam ser interpretados como fórmulas de planilha são prefixados com um apóstrofo para uma importação mais segura.

TXT e Copiar tudo contêm apenas valores, um por linha. Todas as linhas que correspondem ao filtro são incluídas, mesmo quando a tabela na tela abrange várias páginas de resultados. Nenhum novo PDF é criado e o PDF de origem permanece inalterado.

Mantenha grandes extrações gerenciáveis

Processe um PDF no seu navegador, com limites explícitos e avisos de resultados parciais.

Arquivos, limites e páginas digitalizadas

Carregue um PDF de até 50 MiB e 500 páginas. A extração verifica até 250.000 caracteres e 2.000 correspondências por página, 10 milhões de caracteres e 20.000 correspondências no total, e 2.000 anotações por página. Um orçamento de extração de 90 segundos limita execuções longas. Documentos muito complexos podem funcionar melhor quando divididos em arquivos menores.

Quando um limite é atingido ou uma página não pode ser totalmente lida, os resultados mostram um aviso e execuções limitadas ou com falha são exportadas com partial no nome do arquivo. Páginas sem texto selecionável são contadas separadamente. Use OCR de PDF para digitalizações apenas de imagem, depois retorne para extrair o texto reconhecido.

O conteúdo do PDF é processado localmente neste navegador. Documentos carregados não são enviados para um servidor de extração. Links, endereços de e-mail e números de telefone encontrados dentro do PDF nunca são contatados automaticamente.

Arquivos suportados e processamento

Entrada
PDF
Saída
CSV / TXT

Abra um PDF de até 50 MB e 750 páginas. Limites adicionais de saída, memória e processamento podem ser aplicados a documentos complexos.

O processamento ocorre no seu dispositivo sem enviar o documento. Baixe o resultado antes de fechar a página; mantenha o original separadamente.

Advertisements
Perguntas frequentes

Algumas respostas úteis

Saiba o que esperar antes de começar.

No seu dispositivo
O que esta ferramenta pode reconhecer?

Transforme texto de contato selecionável em um PDF em uma lista de e-mails reutilizável. Os endereços reconhecidos incluem texto de e-mail convencional e destinos de links mailto. Revise as contagens e as páginas de origem antes de copiar ou baixar. Páginas digitalizadas e endereços ofuscados, como nome [arroba] exemplo [ponto] org, precisam de preparação. Esta ferramenta não verifica a entrega, a propriedade ou o consentimento para contatar ninguém.

Posso extrair dados de PDFs digitalizados?

Apenas texto selecionável e destinos de link reconhecidos são lidos. Páginas que contêm apenas imagens precisam de OCR em PDF primeiro. Execute o OCR, baixe o PDF pesquisável e, em seguida, retorne a este extrator.

Como as duplicatas e contagens são tratadas?

A opção Remover duplicatas combina valores equivalentes reconhecidos. A contagem mostra as ocorrências detectadas e Páginas lista as posições físicas das páginas do PDF. Desative a opção para manter as ocorrências separadas. Um destino impresso e um link clicável correspondente na mesma página não são contados duas vezes.

Qual é a diferença entre CSV e TXT?

O CSV inclui tipo, valor, contagem de ocorrências e referências de página. O TXT e a opção Copiar tudo fornecem apenas os valores, um por linha. Todas as linhas que correspondem ao filtro atual são incluídas, não apenas a página da tabela visível.

O PDF é carregado para extração?

Não. A análise, correspondência e exportação de PDF são executadas neste navegador. O PDF original permanece inalterado. Nenhum link, e-mail ou número de telefone extraído é contatado automaticamente.

Quais são os limites?

Um PDF de até 50 MiB e 500 páginas. A extração é limitada a 250.000 caracteres de texto e 2.000 correspondências por página, 10 milhões de caracteres e 20.000 correspondências no total, e 2.000 anotações por página. Os resultados trazem um aviso se os limites ou páginas ilegíveis os tornarem parciais.

Continuar

O que você gostaria de fazer a seguir?

Escolha uma ferramenta. Seu PDF finalizado vai com você.

PDF

Advertisements

Linguagem38

English العربية Français Italiano Deutsch Español Português Nederlands Русский Türkçe 日本語 中文 हिन्दी Bahasa Indonesia Bahasa Melayu 한국어 Tiếng Việt ไทย Polski Svenska Українська Norsk বাংলা Ελληνικά فارسی اردو Čeština Dansk Magyar Română Suomi Български Filipino ქართული Slovenčina Azərbaycanca עברית Slovenščina