Outils150

Une tâche PDF utile, simplifiée

Extraire les e-mails d'un PDF.

Transformez les coordonnées de votre PDF en une liste d'e-mails propre.

Advertisements
Votre espace de travail PDF
Sur votre appareil
ou déposez vos fichiers ici
Votre PDF est traité dans ce navigateur. PDF
Advertisements

Comment extraire des adresses e-mail d'un PDF

  1. 01

    Choisir un PDF

    Chargez un document avec du texte sélectionnable, ou essayez l'exemple.

  2. 02

    Extraire et vérifier

    Sélectionnez Extraire. Vérifiez les valeurs, les occurrences et les pages sources ; filtrez ou triez la liste.

  3. 03

    Copier ou télécharger

    Copiez les valeurs, ou téléchargez un CSV avec les références de page ou une liste TXT simple.

BlogComment extraire des adresses e-mail d'un PDFLire le guide

Extraire des adresses e-mail de répertoires et de rapports

Transformez le texte de contact sélectionnable dans un PDF en une liste d'e-mails réutilisable. Les adresses reconnues incluent le texte d'e-mail conventionnel et les cibles de lien mailto. Vérifiez les comptes et les pages sources avant de copier ou de télécharger.

Les valeurs reconnues deviennent une liste avec des références de page source.
TUTORIEL VIDÉO RAPIDE Comment extraire des adresses e-mail d'un PDF Transformez des coordonnées éparpillées en une liste d'e-mails propre. Narration en anglais Regarder la vidéo

Comment extraire des adresses e-mail d'un PDF

Quand est-ce utile ?

Répertoires

Collecter des adresses de contact

Transformez un répertoire de membres ou d'événements en une liste avec des références de page.

Recherche

Rassembler les contacts des auteurs

Trouvez des adresses de correspondance dans des documents, des CV ou des rapports.

PDF longs

Éviter les copies répétées

Regroupez les adresses répétées et inspectez leur fréquence d'apparition.

Fonctionnalités et contrôles

Reconnaître les adresses e-mail

Collectez les adresses à partir du texte et des liens e-mail.

Formes d'e-mail prises en charge

L'extracteur recherche les adresses conventionnelles local-part@domain, y compris les balises plus et les noms avec points. Il accepte les noms de domaine internationalisés mais pas les noms de boîte aux lettres non-ASCII, les parties locales entre guillemets ou les adresses délibérément obscurcies.

Les adresses sont comparées sans tenir compte de la casse lors de la suppression des doublons. Une adresse visible identique et une cible mailto sur la même page ne sont pas comptées deux fois simplement parce que le texte est cliquable. Les tables de caractères PDF corrompues et les adresses coupées sur plusieurs lignes peuvent nécessiter une vérification manuelle.

Vérifier les valeurs avec leurs pages sources

Vérifiez les totaux, accédez à une page PDF et filtrez la liste des résultats.

Examiner et organiser

Chaque résultat enregistre la position physique de la page dans le PDF, ce qui peut différer des numéros de page imprimés. Sélectionnez une puce de page pour ouvrir l'aperçu avec une mise en surbrillance approximative.

La suppression des doublons est activée par défaut. Les totaux combinent les répétitions reconnues de la même valeur ; désactivez cette option pour voir les occurrences séparées. Le tri alphabétique modifie l'ordre de la liste. Le filtrage s'applique également à la copie et aux téléchargements ainsi qu'aux lignes visibles.

Copier les valeurs ou télécharger une liste structurée

Choisissez CSV pour les totaux et les pages, ou TXT pour une valeur par ligne.

Ce que contient chaque téléchargement

Le CSV contient les colonnes Type, Valeur, Total et Pages. L'encodage UTF-8 prend en charge l'arabe et d'autres scripts. Les valeurs pouvant être interprétées comme des formules de tableur sont précédées d'une apostrophe pour un import plus sûr.

TXT et Copier tout contiennent uniquement les valeurs, une par ligne. Toutes les lignes correspondant au filtre sont incluses, même lorsque le tableau à l'écran s'étend sur plusieurs pages de résultats. Aucun nouveau PDF n'est créé et le PDF source reste inchangé.

Gérer les extractions volumineuses

Traitez un PDF dans votre navigateur, avec des limites explicites et des avis de résultats partiels.

Fichiers, limites et pages numérisées

Chargez un PDF jusqu'à 50 MiB et 500 pages. L'extraction vérifie jusqu'à 250 000 caractères et 2 000 correspondances par page, 10 millions de caractères et 20 000 correspondances au total, et 2 000 annotations par page. Un budget d'extraction de 90 secondes limite les exécutions trop longues. Les documents très complexes peuvent mieux fonctionner s'ils sont divisés en fichiers plus petits.

Lorsqu'une limite est atteinte ou qu'une page ne peut pas être entièrement lue, les résultats affichent un avis et les exécutions limitées ou échouées exportent avec la mention partial dans le nom de fichier. Les pages sans texte sélectionnable sont comptées séparément. Utilisez l'OCR PDF pour les scans d'images uniquement, puis revenez pour extraire le texte reconnu.

Le contenu PDF est traité localement dans ce navigateur. Les documents téléchargés ne sont pas envoyés vers un serveur d'extraction. Les liens, adresses e-mail et numéros de téléphone trouvés dans le PDF ne sont jamais contactés automatiquement.

Fichiers pris en charge et traitement

Entrée
PDF
Sortie
CSV / TXT

Ouvrez un PDF jusqu'à 50 Mo et 750 pages. Des limites supplémentaires de sortie, de mémoire et de traitement peuvent s'appliquer aux documents complexes.

Le traitement s'effectue sur votre appareil sans téléchargement du document. Téléchargez votre résultat avant de fermer la page ; conservez l'original séparément.

Advertisements
FAQ

Quelques réponses utiles

Sachez à quoi vous attendre avant de commencer.

Sur votre appareil
Que peut reconnaître cet outil ?

Transformez le texte de contact sélectionnable dans un PDF en une liste d'e-mails réutilisable. Les adresses reconnues incluent le texte d'e-mail conventionnel et les cibles de lien mailto. Vérifiez les comptes et les pages sources avant de copier ou de télécharger. Les pages numérisées et les adresses obscurcies telles que nom [at] exemple [dot] org nécessitent une préparation. Cet outil ne vérifie pas la livraison, la propriété ou le consentement pour contacter qui que ce soit.

Puis-je extraire des données de PDF numérisés ?

Seuls le texte sélectionnable et les cibles de lien reconnues sont lus. Les pages contenant uniquement des images nécessitent d'abord une OCR PDF. Exécutez l'OCR, téléchargez le PDF interrogeable, puis revenez à cet extracteur.

Comment les doublons et les totaux sont-ils gérés ?

La suppression des doublons combine les valeurs équivalentes reconnues. Le compteur indique les occurrences détectées et Pages liste les positions physiques des pages du PDF. Désactivez l'option pour conserver les occurrences séparées. Une cible imprimée et un lien cliquable correspondant sur la même page ne sont pas comptés deux fois.

Quelle est la différence entre CSV et TXT ?

Le format CSV inclut le type, la valeur, le nombre d'occurrences et les références de page. TXT et Copier tout fournissent uniquement les valeurs, une par ligne. Toutes les lignes correspondant au filtre actuel sont incluses, pas seulement la page de tableau visible.

Le PDF est-il téléchargé pour l'extraction ?

Non. L'analyse, la correspondance et les exportations PDF s'exécutent dans ce navigateur. Le PDF original reste inchangé. Aucun lien, e-mail ou numéro de téléphone extrait n'est contacté automatiquement.

Quelles sont les limites ?

Un PDF jusqu'à 50 MiB et 500 pages. L'extraction est limitée à 250 000 caractères de texte et 2 000 correspondances par page, 10 millions de caractères et 20 000 correspondances au total, et 2 000 annotations par page. Les résultats comportent un avis si les limites ou des pages illisibles les rendent partiels.

Continuer

Que souhaitez-vous faire ensuite ?

Choisissez un outil. Votre PDF final vous accompagne.

PDF

Advertisements

Langue38

English العربية Français Italiano Deutsch Español Português Nederlands Русский Türkçe 日本語 中文 हिन्दी Bahasa Indonesia Bahasa Melayu 한국어 Tiếng Việt ไทย Polski Svenska Українська Norsk বাংলা Ελληνικά فارسی اردو Čeština Dansk Magyar Română Suomi Български Filipino ქართული Slovenčina Azərbaycanca עברית Slovenščina