Mga Tool150

ISANG PRAKTIKAL NA GABAY SA PDF

Paano i-convert ang PDF sa JSON na may layout data

Kumuha ng structured page data para sa iyong sariling workflow.

I-export ang text ng PDF, mga dimensyon ng pahina, at data ng drawing bilang JSON. Panatilihing magkasama ang mga referenced image at suriin ang istruktura bago ito gamitin sa code.

Sundin ang gabay
ISANG HALIMBAWA NG TUNAY NA TOOL
BagoUnang pahina ng apat na pahinang PDF source.
  • 4 mga pahina ng PDF
PagkataposMga panimulang linya ng aktwal na document.json export.
  • document.json · 4 mga page record
  • 1 referenced na PNG asset
Ang resulta ay structured JSON data, na ipinapakita bilang isang excerpt. Kasama sa kumpletong export ang lahat ng apat na pahina at ang referenced image asset.
Advertisements
MABILIS NA VIDEO TUTORIAL Paano i-convert ang PDF sa JSON na may layout data Kumuha ng structured page data para sa iyong sariling workflow. Pagsasalaysay sa Ingles Panoorin ang video

Paano i-convert ang PDF sa JSON na may layout data

Advertisements

Buksan ang PDF to JSON para i-export ang mga page record, text block, at data ng drawing. Ang aming apat na pahinang PDF ay gumagawa ng document.json at isang referenced na PNG image sa loob ng ZIP.

01

Piliin ang mga pahina ng PDF

I-load ang PDF at iwanang blangko ang Pages para sa buong dokumento, o ilagay ang subset na kailangan mo. Ang aming halimbawa ay may kasamang lahat ng apat na pahina.

02

I-export at panatilihing magkasama ang mga asset

Piliin ang Start. Ang export na may mga image asset ay mada-download bilang ZIP. I-extract ang buong archive at panatilihin ang images directory sa tabi ng document.json.

Ang sample ay may kasamang images/page-001-image-005.png. Ang mga image reference ay tumuturo sa mga asset path sa halip na i-embed ang binary data sa JSON. Ang export na walang mga image asset ay maaaring direktang ma-download bilang .json.

03

Basahin ang istruktura ng dokumento

Ang sample ay nagdedeklara ng bersyon 1, mga unit na pt, at top-left na origin. Ang mga page record ay may kasamang source page number, mga dimensyon, rotation, mga block, at mga drawing. Inilalarawan ng mga coordinate ang hindi naka-rotate na pahina; isaalang-alang ang rotation kapag ipinapatong ang data.

I-parse ang JSON gamit ang isang JSON parser. Suriin ang mga block, line, at span para sa text at styling, at ang mga bbox value para sa geometry. Inilalarawan ng mga nested object ang layout sa halip na isang solong text string.

Suriin ang pagkakasunod-sunod ng pagbabasa at mga image reference laban sa orihinal na PDF bago gamitin ang data sa iyong processing workflow.

ILANG KAPAKI-PAKINABANG NA DETALYE

Mga karaniwang tanong

Maaari ko bang buuin muli ang orihinal na PDF nang eksakto?

Huwag ipagpalagay ang eksaktong round-trip reconstruction. Inilalarawan ng export ang available na content at geometry, habang ang mga feature at semantics ng PDF ay maaaring mas kumplikado.

Bakit ako nakatanggap ng ZIP?

Ang sample ay naglalaman ng isang imahe. Pinapanatili ng ZIP ang document.json at ang referenced asset nang magkasama upang mahanap ang imahe.

IKAW NA ANG SUSUNOD

Subukan ito sa iyong dokumento

Suriin ang resulta, pagkatapos ay i-save ang bersyong kailangan mo.

Buksan ang PDF to JSON

Detalye ng larawan

Advertisements

Wika38

English العربية Français Italiano Deutsch Español Português Nederlands Русский Türkçe 日本語 中文 हिन्दी Bahasa Indonesia Bahasa Melayu 한국어 Tiếng Việt ไทย Polski Svenska Українська Norsk বাংলা Ελληνικά فارسی اردو Čeština Dansk Magyar Română Suomi Български Filipino ქართული Slovenčina Azərbaycanca עברית Slovenščina