पेज रिकॉर्ड, टेक्स्ट ब्लॉक और ड्राइंग डेटा एक्सपोर्ट करने के लिए PDF to JSON खोलें। हमारी चार-पेज वाली PDF document.json और ZIP के अंदर एक संदर्भित PNG छवि बनाती है।
PDF पेज चुनें
PDF लोड करें और पूरे दस्तावेज़ के लिए Pages को खाली छोड़ दें, या अपनी आवश्यकतानुसार सबसेट दर्ज करें। हमारे उदाहरण में सभी चार पेज शामिल हैं।
एक्सपोर्ट करें और एसेट को एक साथ रखें
Start चुनें। छवि एसेट के साथ एक्सपोर्ट ZIP के रूप में डाउनलोड होता है। पूरे आर्काइव को निकालें और document.json के बगल में images डायरेक्टरी रखें।
नमूने में images/page-001-image-005.png शामिल है। छवि संदर्भ JSON में बाइनरी डेटा एम्बेड करने के बजाय एसेट पथ की ओर इशारा करते हैं। बिना छवि एसेट वाला एक्सपोर्ट सीधे .json के रूप में डाउनलोड हो सकता है।
दस्तावेज़ संरचना पढ़ें
नमूना संस्करण 1, इकाइयाँ pt और एक top-left मूल घोषित करता है। पेज रिकॉर्ड में स्रोत पेज संख्या, आयाम, रोटेशन, ब्लॉक और ड्राइंग शामिल हैं। निर्देशांक बिना रोटेट किए पेज का वर्णन करते हैं; डेटा को ओवरले करते समय रोटेशन का ध्यान रखें।
JSON पार्सर के साथ JSON को पार्स करें। टेक्स्ट और स्टाइलिंग के लिए ब्लॉक, लाइन और स्पैन की जाँच करें, और ज्यामिति के लिए bbox मानों की जाँच करें। नेस्टेड ऑब्जेक्ट्स एक एकल टेक्स्ट स्ट्रिंग के बजाय लेआउट का वर्णन करते हैं।
अपने प्रोसेसिंग वर्कफ़्लो में डेटा का उपयोग करने से पहले मूल PDF के विरुद्ध पढ़ने के क्रम और छवि संदर्भों की जाँच करें।
सामान्य प्रश्न
क्या मैं मूल PDF को बिल्कुल वैसा ही फिर से बना सकता हूँ?
सटीक राउंड-ट्रिप पुनर्निर्माण का अनुमान न लगाएं। एक्सपोर्ट उपलब्ध सामग्री और ज्यामिति का वर्णन करता है, जबकि PDF सुविधाएँ और शब्दार्थ अधिक जटिल हो सकते हैं।
मुझे ZIP क्यों प्राप्त हुआ?
नमूने में एक छवि है। ZIP document.json और संदर्भित एसेट को एक साथ रखता है ताकि छवि का पता लगाया जा सके।
इसे अपने दस्तावेज़ के साथ आज़माएँ
परिणाम की समीक्षा करें, फिर अपनी आवश्यकतानुसार संस्करण सहेजें।

