Verktyg150

EN PRAKTISK PDF-GUIDE

Hur man extraherar text från en skannad PDF med OCR

Extrahera orden och förfina dem sedan.

Identifiera en skannad PDF-sida eller ett valt område, korrigera texten med Smart edit och ladda ner som TXT eller Word.

Uppdaterad

Följ guiden
ETT VERKLIGT VERKTYGSEXEMPEL
FöreFörsta sidan av en skanning på fyra sidor utan valbar text.
  • 4 PDF-sidor som endast består av bilder
  • Sida 1 vald
EfterFaktisk text nedladdad från sida 1 med Future-motorn.
  • Redigerbar TXT för sida 1
  • Future-motor · Engelska
Skanningen innehåller bildpixlar; OCR skapar redigerbara ord. Detta exempel bearbetar endast sida 1, inte hela dokumentet.
Advertisements
SNABB VIDEO-TUTORIAL Hur man extraherar text från en skannad PDF med OCR Extrahera orden och förfina dem sedan. Engelsk berättarröst Se videon

Hur man extraherar text från en skannad PDF med OCR

Advertisements

Använd PDF OCR för att identifiera ord från sidbilder. Vårt exempel börjar med en skanning på fyra sidor som endast består av bilder och identifierar dess första sida, Översikt, till redigerbar text.

01

Välj en sida eller ett område

Ladda upp PDF-filen och navigera till den sida du behöver. Använd hela sidan eller justera en markeringsrektangel runt den text som behövs. Exemplet använder hela sida 1.

En annan sida eller ett annat område kräver en separat identifieringsåtgärd. Verktyget bearbetar inte automatiskt varje sida i den uppladdade PDF-filen.

02

Välj språk, motor och format

Välj språket som är tryckt på sidan. För vårt engelska exempel, behåll Future som OCR-motor och välj Redigerbar text (.txt).

Välj Classic när du behöver en sökbar PDF, som behåller källbilden med ett osynligt lager av identifierad text. Future tillhandahåller redigerbar text, Word och en omflödad PDF som endast innehåller text.

03

Identifiera, korrigera och ladda ner

Välj Start och slutför verifieringskryssrutan som visas. Jämför det identifierade resultatet med källbilden. Vår nedladdning inkluderar korrekt Översikt, Planera sessionen och Definiera resultatet.

Korrigera namn, siffror och osäkra ord innan du kopierar eller laddar ner text. Korrigeringar uppdaterar redigerbara exporter; Classics positionerade sökbara PDF behåller den ursprungliga identifieringen, så granska den filen separat.

04

Förfina den identifierade texten med Smart edit

För ett TXT- eller Word-resultat, välj Smart edit bredvid Kopiera. Markera ett stycke för att arbeta med den texten, eller lämna inget markerat för att använda hela utkastet. Välj Sammanfatta text, Parafrasera text, Korrigera grammatik eller Föreslå en titel, välj sedan Använd. Titelåtgärden lägger till en rubrik ovanför texten.

Kontrollera varje AI-ändring mot skanningen, särskilt namn, siffror och ord som saknas. Förslaget stannar i Smart edit tills du väljer Använd ändringar. TXT- och Word-nedladdningar använder sedan den redigerade klartexten. Formaterad kopia laddar ner en separat HTML-fil med redigeringsformatering; den ursprungliga skanningen och textlagret i Classics sökbara PDF ändras inte.

NÅGRA ANVÄNDBARA DETALJER

Vanliga frågor

Kan jag identifiera endast ett stycke?

Ja. Markera en rektangel runt det innan du börjar. Kontrollera kanterna så att närliggande text exkluderas och viktiga ord inte klipps av.

Behåller Future den ursprungliga sidlayouten i sin PDF?

Dess PDF är ett omflödat dokument som endast innehåller text. Välj Classics sökbara PDF när syftet är att behålla den skannade sidbilden med ett textlager.

Kan Smart edit ändra den sökbara PDF-filen?

Nej. Smart edit är tillgängligt med TXT- och Word-resultat. Använd ändringar uppdaterar den redigerbara texten; det skriver inte om den skannade sidan eller en tidigare genererad sökbar PDF.

DIN TUR

Prova det med ditt dokument

Granska resultatet och spara sedan den version du behöver.

Öppna PDF OCR

Bilddetalj

Advertisements

Språk38

English العربية Français Italiano Deutsch Español Português Nederlands Русский Türkçe 日本語 中文 हिन्दी Bahasa Indonesia Bahasa Melayu 한국어 Tiếng Việt ไทย Polski Svenska Українська Norsk বাংলা Ελληνικά فارسی اردو Čeština Dansk Magyar Română Suomi Български Filipino ქართული Slovenčina Azərbaycanca עברית Slovenščina