Outils150

UN GUIDE PRATIQUE DU PDF

Comment extraire du texte d'un PDF numérisé avec l'OCR

Extrayez les mots, puis affinez-les.

Reconnaissez une page PDF numérisée ou une zone sélectionnée, corrigez le texte avec Smart edit et téléchargez-le au format TXT ou Word.

Mis à jour

Suivre le guide
UN EXEMPLE D'OUTIL RÉEL
AvantPremière page d'une numérisation de quatre pages sans texte sélectionnable.
  • 4 pages PDF contenant uniquement des images
  • Page 1 sélectionnée
AprèsTexte réel téléchargé depuis la page 1 en utilisant le moteur Future.
  • TXT modifiable pour la page 1
  • Moteur Future · Anglais
La numérisation contient des pixels d'image ; l'OCR produit des mots modifiables. Cet exemple traite uniquement la page 1, et non l'ensemble du document.
Advertisements
TUTORIEL VIDÉO RAPIDE Comment extraire du texte d'un PDF numérisé avec l'OCR Extrayez les mots, puis affinez-les. Narration en anglais Regarder la vidéo

Comment extraire du texte d'un PDF numérisé avec l'OCR

Advertisements

Utilisez PDF OCR pour reconnaître les mots à partir d'images de pages. Notre exemple commence par une numérisation de quatre pages contenant uniquement des images et reconnaît sa première page, Overview, en texte modifiable.

01

Choisir une page ou une zone

Chargez le PDF et accédez à la page dont vous avez besoin. Utilisez la page entière ou ajustez un rectangle de sélection autour du texte nécessaire. L'exemple utilise la totalité de la page 1.

Une autre page ou zone nécessite une action de reconnaissance distincte. L'outil ne traite pas automatiquement chaque page du PDF téléchargé.

02

Choisir la langue, le moteur et le format

Choisissez la langue imprimée sur la page. Pour notre exemple en anglais, conservez Future comme moteur OCR et choisissez Texte modifiable (.txt).

Choisissez Classic lorsque vous avez besoin de son PDF interrogeable, qui conserve l'image source avec une couche de texte reconnu invisible. Future fournit du texte modifiable, Word et un PDF uniquement texte réorganisé.

03

Reconnaître, corriger et télécharger

Choisissez Start et complétez la case de vérification affichée. Comparez le résultat reconnu avec l'image source. Notre téléchargement inclut correctement Overview, Plan the session et Define the outcome.

Corrigez les noms, les chiffres et les mots incertains avant de copier ou de télécharger le texte. Les corrections mettent à jour les exportations modifiables ; le PDF interrogeable positionné de Classic conserve la reconnaissance originale, donc révisez ce fichier séparément.

04

Affiner le texte reconnu avec Smart edit

Pour un résultat TXT ou Word, choisissez Smart edit à côté de Copy. Sélectionnez un passage pour travailler sur ce texte, ou ne laissez rien sélectionné pour utiliser l'ensemble du brouillon. Choisissez Summarize text, Paraphrase text, Fix grammar ou Suggest a title, puis choisissez Apply. L'action de titre ajoute un en-tête au-dessus du texte.

Vérifiez chaque modification de l'IA par rapport à la numérisation, en particulier les noms, les chiffres et les mots manquants. La suggestion reste dans Smart edit jusqu'à ce que vous choisissiez Apply Changes. Les téléchargements TXT et Word utilisent alors le texte brut modifié. Formatted copy télécharge un fichier HTML séparé avec le style de l'éditeur ; la numérisation originale et la couche de texte du PDF interrogeable Classic ne changent pas.

QUELQUES DÉTAILS UTILES

Questions courantes

Puis-je reconnaître un seul paragraphe ?

Oui. Sélectionnez un rectangle autour avant de commencer. Vérifiez les bords afin que le texte à proximité soit exclu et que les mots importants ne soient pas coupés.

Future conservera-t-il la mise en page originale dans son PDF ?

Son PDF est un document uniquement texte réorganisé. Choisissez le PDF interrogeable de Classic lorsque l'objectif est de conserver l'image de la page numérisée avec une couche de texte.

Smart edit peut-il modifier le PDF interrogeable ?

Non. Smart edit est disponible avec les résultats TXT et Word. Apply Changes met à jour le texte modifiable ; il ne réécrit pas la page numérisée ou un PDF interrogeable précédemment généré.

À VOTRE TOUR

Essayez avec votre document

Révisez le résultat, puis enregistrez la version dont vous avez besoin.

Ouvrir PDF OCR

Détail de l'image

Advertisements

Langue38

English العربية Français Italiano Deutsch Español Português Nederlands Русский Türkçe 日本語 中文 हिन्दी Bahasa Indonesia Bahasa Melayu 한국어 Tiếng Việt ไทย Polski Svenska Українська Norsk বাংলা Ελληνικά فارسی اردو Čeština Dansk Magyar Română Suomi Български Filipino ქართული Slovenčina Azərbaycanca עברית Slovenščina