Åpne Trekk ut data fra PDF for å samle verdier fra én PDF uten å kopiere dem linje for linje. Sammenligningen bruker det faktiske eksempeldokumentet og en CSV lastet ned fra verktøyet. Med e-poster, telefonnumre, URL-er, DOI, ISBN og IPv4 valgt, produserer eksempelet på tre sider 11 unike rader fra 15 forekomster.
Åpne PDF-en din
Last opp én PDF, eller velg Prøv eksempel for å følge dette eksempelet. PDF-forhåndsvisningen og miniatyrbilder av sider vises. Den originale filen din forblir uendret, og uttrekket kjøres i nettleseren din.
En tekstbasert katalog, rapport, forskningsartikkel eller brosjyre er et nyttig utgangspunkt. Skanninger som kun består av bilder, trenger OCR før den trykte teksten kan gjenkjennes.
Velg de nyttige alternativene
På en telefon, åpne Innstillinger. På en datamaskin, bruk innstillingspanelet ved siden av forhåndsvisningen.
Under Hva skal trekkes ut, er e-poster, telefonnumre og URL-er valgt som standard. Åpne Flere datatyper og velg også DOI, ISBN og IPv4-adresser. La fjerning av duplikater være aktivert og velg CSV.
Trekk ut og sjekk treffene
Velg Trekk ut. Når behandlingen er ferdig, viser fanen Resultater verdiene, antall forekomster og kildesider. Velg et sirkulært sidetall for å inspisere plasseringen i PDF-forhåndsvisningen, og gå deretter tilbake til Resultater.
Utdataene kombinerer kontaktlisten med DOI 10.1000/182, ISBN 978-0-306-40615-7 og IPv4-adresse 192.0.2.10 fra side 2. Kolonnen Type identifiserer hver verdi. Filtrer til et relevant ord eller identifikator før du kopierer eller laster ned et mindre utvalg.
Bruk Filtrer resultater for å begrense listen. Kopiering og nedlasting inkluderer alle samsvarende rader, selv når resultattabellen strekker seg over flere skjermbilder med rader.
Last ned CSV eller TXT
Velg Last ned CSV, og bruk deretter hovedknappen Nedlasting på skjermen som er klar. CSV inneholder kolonnene Type, Verdi, Antall og Sider. TXT og Kopier alle inneholder én verdi per linje.
CSV-verdier som kan tolkes som regnearkformler, er beskyttet med en innledende apostrof. For eksempel begynner et internasjonalt telefonnummer med et pluss-tegn. Bruk TXT hvis du trenger en ren liste uten regnearkbeskyttelse.
Vanlige spørsmål
Trekker dette ut alle tall eller hver identifikator?
Nei. Hver valgt kategori har sine egne gjenkjenningsregler. IPv6, prosenter, priser og betalingskortnumre trekkes ikke ut. Gå gjennom samsvar mot kilden; gyldig formatering kan ikke bekrefte at en kontakt eller identifikator eksisterer.
Hva bør jeg gjøre med en skannet PDF?
Kjør PDF-OCR først, og last deretter den gjenkjente kopien inn i dette verktøyet. Sjekk OCR-utdataene nøye: et feilaktig tegn kan endre en adresse eller identifikator.
Hva er begrensningene for uttrekk?
Bruk én PDF på opptil 50 MiB og 750 sider. Uttrekket er begrenset til 20 000 treff totalt og 2 000 per side, med et tidsbudsjett på 90 sekunder for behandling. Begrensninger for tekst og merknader gjelder også. Hvis en begrensning eller en uleselig side avbryter skanningen, viser verktøyet et varsel om delvise resultater og merker eksportfilnavnet som delvis.
Åpnes PDF-lenkene mine automatisk?
Nei. Uttrekket leser filen i nettleseren og besøker ikke de ekstraherte destinasjonene. Sideknapper navigerer i PDF-forhåndsvisningen.
Behold verdiene og konteksten deres
Trekk ut en fokusert liste, sjekk kildesidene, og last ned formatet som passer for neste steg.

