Ouvrez Extraire les e-mails d'un PDF pour collecter des valeurs depuis un PDF sans les copier ligne par ligne. La comparaison utilise le document échantillon réel et un CSV téléchargé depuis l'outil. L'échantillon de trois pages produit 2 adresses e-mail uniques à partir de 4 occurrences.
Ouvrez votre PDF
Téléversez un PDF ou sélectionnez Essayer l'exemple pour suivre ce guide. L'aperçu du PDF et les vignettes des pages s'affichent. Votre fichier original reste inchangé et l'extraction s'exécute dans votre navigateur.
Un répertoire, un rapport, un document de recherche ou une brochure basé sur du texte constitue un point de départ utile. Les scans contenant uniquement des images nécessitent un OCR avant que leur texte imprimé puisse être reconnu.
Choisissez les options utiles
Sur un téléphone, ouvrez Paramètres. Sur ordinateur, utilisez le panneau des paramètres à côté de l'aperçu.
Laissez Supprimer les doublons activé. Activez Trier par ordre alphabétique si vous souhaitez une liste de contacts classée par adresse. Pour cet exemple, conservez l'ordre source par défaut et le format CSV.
Extrayez et vérifiez les correspondances
Sélectionnez Extraire. Une fois le traitement terminé, l'onglet Résultats affiche les valeurs, le nombre d'occurrences et les pages sources. Sélectionnez un numéro de page circulaire pour inspecter son emplacement dans l'aperçu du PDF, puis revenez aux Résultats.
L'échantillon renvoie events@example.org aux pages 1 et 3, et research@example.org aux pages 1 et 2. Chaque adresse apparaît une fois dans la liste dédoublonnée, avec un compteur de 2. Désactivez la suppression des doublons lorsque vous avez besoin de chaque occurrence comme ligne distincte.
Utilisez Filtrer les résultats pour restreindre la liste. La copie et le téléchargement incluent toutes les lignes correspondantes, même lorsque le tableau des résultats s'étend sur plusieurs écrans.
Téléchargez le CSV ou le TXT
Sélectionnez Télécharger le CSV, puis utilisez le bouton principal Télécharger sur l'écran de préparation. Le CSV contient les colonnes Type, Valeur, Occurrences et Pages. Le TXT et Copier tout contiennent une valeur par ligne.
Les valeurs CSV qui pourraient être interprétées comme des formules de tableur sont protégées par une apostrophe initiale. Par exemple, un numéro de téléphone international commence par un signe plus. Utilisez le TXT si vous avez besoin d'une liste brute sans protection pour tableur.
Questions fréquentes
Puis-je utiliser la liste directement dans un outil de mailing ?
Copier tout ou le TXT donne une adresse par ligne. Le CSV conserve également les compteurs et les références de pages. Vérifiez la liste et la base de votre prise de contact avec les propriétaires avant de l'importer dans un autre système.
Que dois-je faire avec un PDF scanné ?
Exécutez OCR PDF d'abord, puis chargez la copie reconnue dans cet outil. Vérifiez attentivement la sortie OCR : un caractère erroné peut modifier une adresse ou un identifiant.
Quelles sont les limites d'extraction ?
Utilisez un PDF jusqu'à 50 MiB et 750 pages. L'extraction est limitée à 20 000 correspondances au total et 2 000 par page, avec un budget de traitement de 90 secondes. Des limites de texte et d'annotation s'appliquent également. Si une limite ou une page illisible interrompt l'analyse, l'outil affiche un avis de résultats partiels et marque le nom du fichier d'exportation comme partiel.
Mes liens PDF sont-ils ouverts automatiquement ?
Non. L'extraction lit le fichier dans le navigateur et ne visite pas les destinations extraites. Les boutons de page permettent de naviguer dans l'aperçu du PDF.
Conservez les valeurs et leur contexte
Extrayez une liste ciblée, vérifiez les pages sources et téléchargez le format qui convient à votre prochaine étape.

