เปิด ดึงลิงก์จาก PDF เพื่อรวบรวมค่าจาก PDF หนึ่งไฟล์โดยไม่ต้องคัดลอกทีละบรรทัด การเปรียบเทียบนี้ใช้เอกสารตัวอย่างจริงและไฟล์ CSV ที่ดาวน์โหลดจากเครื่องมือ ตัวอย่างสามหน้าสร้างที่อยู่เว็บที่ไม่ซ้ำกัน 4 รายการจากทั้งหมด 5 รายการ
เปิด PDF ของคุณ
อัปโหลด PDF หนึ่งไฟล์ หรือเลือก ลองใช้ตัวอย่าง เพื่อทำตามตัวอย่างนี้ การแสดงตัวอย่าง PDF และภาพขนาดย่อของหน้าจะปรากฏขึ้น ไฟล์ต้นฉบับของคุณจะไม่มีการเปลี่ยนแปลง และการดึงข้อมูลจะทำงานในเบราว์เซอร์ของคุณ
ไดเรกทอรี รายงาน เอกสารวิจัย หรือโบรชัวร์ที่เป็นข้อความคือจุดเริ่มต้นที่มีประโยชน์ การสแกนที่เป็นรูปภาพเท่านั้นจำเป็นต้องใช้ OCR ก่อนที่ข้อความที่พิมพ์จะสามารถจดจำได้
เลือกตัวเลือกที่มีประโยชน์
บนโทรศัพท์ ให้เปิด การตั้งค่า บนเดสก์ท็อป ให้ใช้แผงการตั้งค่าข้างการแสดงตัวอย่าง
เปิดใช้งาน ลบรายการที่ซ้ำกัน เพื่อจัดกลุ่มเป้าหมายที่ซ้ำกัน เลือก CSV เมื่อคุณต้องการการอ้างอิงหน้า หรือ TXT สำหรับรายการ URL แบบธรรมดา ตัวอย่างนี้ใช้รูปแบบ CSV เริ่มต้นและลำดับต้นฉบับ
ดึงข้อมูลและตรวจสอบรายการที่ตรงกัน
เลือก ดึงข้อมูล เมื่อการประมวลผลเสร็จสิ้น แท็บ ผลลัพธ์ จะแสดงค่า จำนวนที่พบ และหน้าต้นฉบับ เลือกหมายเลขหน้าที่เป็นวงกลมเพื่อตรวจสอบตำแหน่งในตัวอย่าง PDF จากนั้นกลับไปที่ผลลัพธ์
ตัวอย่างประกอบด้วย https://example.org/events สองครั้งและที่อยู่เว็บอื่นๆ อีกสามรายการ นอกจากนี้ยังแสดงลิงก์ที่คลิกได้ซึ่งป้ายกำกับที่มองเห็นได้แตกต่างจากเป้าหมาย URL ที่พิมพ์และเป้าหมายที่คลิกได้ที่เหมือนกันในหน้าเดียวกันจะไม่ถูกนับซ้ำ
ใช้ กรองผลลัพธ์ เพื่อจำกัดรายการให้แคบลง การคัดลอกและการดาวน์โหลดจะรวมแถวที่ตรงกันทั้งหมด แม้ว่าตารางผลลัพธ์จะครอบคลุมหลายหน้าจอก็ตาม
ดาวน์โหลด CSV หรือ TXT
เลือก ดาวน์โหลด CSV จากนั้นใช้ปุ่ม ดาวน์โหลด หลักบนหน้าจอที่พร้อมใช้งาน CSV ประกอบด้วยคอลัมน์ประเภท ค่า จำนวน และหน้า TXT และ คัดลอกทั้งหมด จะมีหนึ่งค่าต่อบรรทัด
ค่า CSV ที่อาจถูกตีความว่าเป็นสูตรสเปรดชีตจะได้รับการป้องกันด้วยเครื่องหมายอะพอสทรอฟีนำหน้า ตัวอย่างเช่น หมายเลขโทรศัพท์ระหว่างประเทศจะขึ้นต้นด้วยเครื่องหมายบวก ใช้ TXT หากคุณต้องการรายการธรรมดาโดยไม่มีการป้องกันสเปรดชีต
คำถามที่พบบ่อย
เครื่องมือนี้สามารถค้นหาลิงก์หลังคำเช่น “อ่านเพิ่มเติม” ได้หรือไม่?
ใช่ เมื่อคำเหล่านั้นมีคำอธิบายประกอบลิงก์ HTTP หรือ HTTPS ที่รองรับใน PDF ค่าที่ส่งออกคือปลายทางเว็บของลิงก์นั้น การขีดเส้นใต้ด้วยสายตาเพียงอย่างเดียวไม่ได้พิสูจน์ว่ามีลิงก์ที่คลิกได้อยู่จริง
ฉันควรทำอย่างไรกับ PDF ที่สแกนมา?
เรียกใช้ PDF OCR ก่อน จากนั้นโหลดสำเนาที่จดจำได้ลงในเครื่องมือนี้ ตรวจสอบผลลัพธ์ OCR อย่างระมัดระวัง: อักขระที่ผิดพลาดอาจเปลี่ยนที่อยู่หรือตัวระบุได้
ข้อจำกัดในการดึงข้อมูลคืออะไร?
ใช้ PDF หนึ่งไฟล์ที่มีขนาดสูงสุด 50 MiB และ 750 หน้า การดึงข้อมูลถูกจำกัดไว้ที่ 20,000 รายการโดยรวมและ 2,000 รายการต่อหน้า โดยมีงบประมาณการประมวลผล 90 วินาที ข้อจำกัดด้านข้อความและคำอธิบายประกอบก็มีผลเช่นกัน หากข้อจำกัดหรือหน้าที่อ่านไม่ได้ขัดจังหวะการสแกน เครื่องมือจะแสดงประกาศผลลัพธ์บางส่วนและทำเครื่องหมายชื่อไฟล์ส่งออกว่าเป็นบางส่วน
ลิงก์ PDF ของฉันจะถูกเปิดโดยอัตโนมัติหรือไม่?
ไม่ เครื่องมือจะอ่านไฟล์ในเบราว์เซอร์และไม่เยี่ยมชมปลายทางที่ดึงมา ปุ่มหน้าจะนำทางภายในตัวอย่าง PDF
เก็บค่าและบริบทของค่าเหล่านั้นไว้
ดึงรายการที่เน้น ตรวจสอบหน้าต้นฉบับ และดาวน์โหลดรูปแบบที่เหมาะสมกับขั้นตอนถัดไปของคุณ

