Open PDF naar Tekst, kies de pagina's en selecteer een downloadformaat. Ons voorbeeld van vier pagina's produceert één UTF-8 TXT-bestand met de geëxtraheerde paginatekst.
Laad een PDF met bruikbare tekst
Kies de originele PDF. Controleer of de tekst kan worden geselecteerd in een viewer. Een gescande pagina die alleen uit pixels bestaat, heeft PDF OCR nodig voordat deze bruikbare tekst kan leveren.
Stel de pagina's en verpakking in
Laat Pagina's leeg voor het hele document, of voer een bereik in voor een subset. De pagina in het voorbeeld is niet de exportomvang.
Kies Eén tekstbestand voor een gecombineerd TXT-bestand, zoals in het voorbeeld, of Afzonderlijke bestanden voor een ZIP-bestand met tekstbestanden per pagina en een gecombineerd bestand.
Extraheer en controleer de tekst
Kies Start en download. Het voorbeeld produceert 3,940 bytes, met vier paginasecties gescheiden door pagina-eindetekens.
Open het TXT-bestand in een teksteditor en controleer kolommen, bijschriften en tabellen. Extractie kan ongebruikelijke PDF-spatiëring behouden; ruim dit op voordat je de tekst in de bestemming plakt.
Veelgestelde vragen
Waarom is het resultaat leeg voor mijn scan?
De pagina bevat mogelijk alleen een afbeelding. Gebruik PDF OCR om de woorden te herkennen; deze tool extraheert een bestaande tekstlaag.
Welke tool is beter voor koppen en notities?
Probeer PDF naar Markdown wanneer koptekstmarkeringen en alinea's nuttiger zijn dan platte TXT. Controleer ook de afgeleide structuur.
Probeer het met jouw document
Controleer het resultaat en sla vervolgens de versie op die je nodig hebt.

