รวบรวมลิงก์แหล่งที่มา
สร้างรายการอ้างอิงจากรายงานและเอกสารวิจัย
นำลิงก์ที่มีประโยชน์ออกจาก PDF ของคุณ
| ประเภท | ค่า | จำนวน | หน้า |
|---|
การคัดลอกและดาวน์โหลดจะรวมทุกแถวที่ตรงกันจากทุกหน้าผลลัพธ์ CSV จะรวมจำนวนและเลขหน้า PDF ส่วน TXT จะมีเฉพาะค่าเท่านั้น
เลือกเลขหน้าในผลลัพธ์เพื่อตรวจสอบแหล่งที่มา ไฮไลต์จะแสดงตำแหน่งโดยประมาณ
รายการของคุณพร้อมแล้ว ดาวน์โหลดหรือย้อนกลับไปตรวจสอบและเปลี่ยนรูปแบบ
โหลดเอกสารที่มีข้อความที่เลือกได้ หรือลองใช้ตัวอย่าง
เลือก 'ดึงข้อมูล' ตรวจสอบค่า จำนวน และหน้าต้นฉบับ กรองหรือเรียงลำดับรายการ
คัดลอกค่า หรือดาวน์โหลด CSV พร้อมการอ้างอิงหน้า หรือรายการ TXT แบบง่าย
รวบรวมที่อยู่ HTTP/HTTPS ที่พิมพ์ไว้, ที่อยู่ www และเป้าหมายลิงก์เว็บที่คลิกได้จาก PDF หนึ่งไฟล์ เก็บการอ้างอิงหน้าและดาวน์โหลดรายการที่ลบข้อมูลซ้ำแล้วเป็น CSV หรือ TXT
สร้างรายการอ้างอิงจากรายงานและเอกสารวิจัย
ดึงปลายทางที่อยู่เบื้องหลังป้ายกำกับทรัพยากรที่คลิกได้
บันทึกตำแหน่งที่พบลิงก์แต่ละรายการก่อนที่จะตรวจสอบที่อื่น
รวมเป้าหมายลิงก์แม้ว่าป้ายกำกับจะระบุเพียงว่า “อ่านเพิ่มเติม” ก็ตาม
ลิงก์ที่พิมพ์ซึ่งขึ้นต้นด้วย http://, https:// หรือ www. จะถูกจดจำ คำอธิบายประกอบลิงก์ PDF ยังสามารถเปิดเผยเป้าหมาย HTTP/HTTPS ที่อยู่เบื้องหลังข้อความปกติได้ PDF ไม่จำเป็นต้องแสดง URL เป็นป้ายกำกับที่คลิกได้
เป้าหมายที่พิมพ์และคำอธิบายประกอบที่เหมือนกันในหน้าเดียวจะไม่ถูกนับซ้ำ รูปแบบ URL ที่ปรับให้เป็นมาตรฐานจะถูกใช้สำหรับการเปรียบเทียบรายการซ้ำ ในขณะที่การสะกดที่จดจำได้ครั้งแรกจะถูกแสดง URL ที่ยาว ถูกตัดบรรทัด หรือเสียหายอาจต้องมีการแก้ไขด้วยตนเอง ไม่มีการดึงข้อมูล URL ใดที่ถูกเรียกโดยอัตโนมัติ
ตรวจสอบจำนวน กระโดดไปยังหน้า PDF และกรองรายการผลลัพธ์
ผลลัพธ์แต่ละรายการจะบันทึกตำแหน่งหน้าจริงใน PDF ซึ่งอาจแตกต่างจากเลขหน้าที่พิมพ์ เลือกชิปหน้าเพื่อเปิดตัวอย่างพร้อมไฮไลต์โดยประมาณ
การลบรายการซ้ำจะเปิดใช้งานไว้ตั้งแต่ต้น จำนวนจะรวมการซ้ำกันของค่าเดียวกันที่จดจำได้ ปิดสวิตช์เพื่อดูเหตุการณ์ที่แยกจากกัน การเรียงลำดับตามตัวอักษรจะเปลี่ยนลำดับรายการ การกรองจะมีผลกับการคัดลอกและการดาวน์โหลดรวมถึงแถวที่มองเห็นได้
เลือก CSV สำหรับจำนวนและหน้า หรือ TXT สำหรับหนึ่งค่าต่อบรรทัด
CSV ประกอบด้วยคอลัมน์ประเภท ค่า จำนวน และหน้า การเข้ารหัส UTF-8 รองรับภาษาอาหรับและสคริปต์อื่นๆ ค่าที่อาจถูกตีความว่าเป็นสูตรสเปรดชีตจะถูกนำหน้าด้วยเครื่องหมายอะพอสทรอฟีเพื่อการนำเข้าที่ปลอดภัยยิ่งขึ้น
TXT และการคัดลอกทั้งหมดประกอบด้วยค่าเท่านั้น หนึ่งค่าต่อบรรทัด แถวทั้งหมดที่ตรงกับตัวกรองจะถูกรวมไว้ แม้ว่าตารางบนหน้าจอจะครอบคลุมหลายหน้าผลลัพธ์ก็ตาม ไม่มีการสร้าง PDF ใหม่และ PDF ต้นฉบับจะไม่เปลี่ยนแปลง
ประมวลผล PDF หนึ่งไฟล์ในเบราว์เซอร์ของคุณ พร้อมขีดจำกัดที่ชัดเจนและประกาศผลลัพธ์บางส่วน
โหลด PDF หนึ่งไฟล์สูงสุด 50 MiB และ 500 หน้า การดึงข้อมูลจะตรวจสอบอักขระสูงสุด 250,000 ตัวและ 2,000 รายการที่ตรงกันต่อหน้า, อักขระ 10 ล้านตัวและ 20,000 รายการที่ตรงกันโดยรวม และ 2,000 คำอธิบายประกอบต่อหน้า งบประมาณการดึงข้อมูล 90 วินาทีจะจำกัดการทำงานที่ยาวนาน เอกสารที่ซับซ้อนมากอาจทำงานได้ดีขึ้นเมื่อแบ่งเป็นไฟล์ขนาดเล็ก
เมื่อถึงขีดจำกัดหรือหน้าไม่สามารถอ่านได้ทั้งหมด ผลลัพธ์จะแสดงประกาศ และการทำงานที่จำกัดหรือล้มเหลวจะส่งออกพร้อมคำว่า partial ในชื่อไฟล์ หน้าที่ไม่มีข้อความที่เลือกได้จะถูกนับแยกต่างหาก ใช้ PDF OCR สำหรับการสแกนที่เป็นรูปภาพเท่านั้น จากนั้นกลับมาเพื่อดึงข้อความที่จดจำได้
เนื้อหา PDF จะถูกประมวลผลในเครื่องในเบราว์เซอร์นี้ เอกสารที่อัปโหลดจะไม่ถูกส่งไปยังเซิร์ฟเวอร์การดึงข้อมูล ลิงก์ ที่อยู่อีเมล และหมายเลขโทรศัพท์ที่พบภายใน PDF จะไม่ถูกติดต่อโดยอัตโนมัติ
เปิดไฟล์ PDF ได้หนึ่งไฟล์ขนาดสูงสุด 50 MB และ 750 หน้า อาจมีข้อจำกัดเพิ่มเติมด้านเอาต์พุต หน่วยความจำ และการประมวลผลสำหรับเอกสารที่มีความซับซ้อน
การประมวลผลจะเกิดขึ้นบนอุปกรณ์ของคุณโดยไม่ต้องอัปโหลดเอกสาร โปรดดาวน์โหลดผลลัพธ์ก่อนปิดหน้าเว็บ และเก็บไฟล์ต้นฉบับไว้แยกต่างหาก
รู้ว่าจะเกิดอะไรขึ้นก่อนที่คุณจะเริ่ม
บนอุปกรณ์ของคุณรวบรวมที่อยู่ HTTP/HTTPS ที่พิมพ์ไว้ ที่อยู่ www และเป้าหมายลิงก์เว็บที่คลิกได้จาก PDF หนึ่งไฟล์ เก็บการอ้างอิงหน้าและดาวน์โหลดรายการที่ลบรายการซ้ำแล้วในรูปแบบ CSV หรือ TXT เครื่องมือนี้ไม่ได้ตรวจสอบว่าลิงก์ยังใช้งานได้หรือไม่ ปลายทางภายในหน้า การดำเนินการ JavaScript, mailto และรูปแบบอื่นที่ไม่ใช่เว็บจะไม่ถูกส่งออกเป็นลิงก์เว็บ
ระบบจะอ่านเฉพาะข้อความที่เลือกได้และเป้าหมายลิงก์ที่ตรวจพบเท่านั้น หน้าที่เป็นรูปภาพล้วนจำเป็นต้องทำ OCR สำหรับ PDF ก่อน ให้รัน OCR ดาวน์โหลด PDF ที่ค้นหาได้ แล้วจึงกลับมาที่เครื่องมือดึงข้อมูลนี้
การลบรายการซ้ำจะรวมค่าที่ตรวจพบว่าเหมือนกันเข้าด้วยกัน โดยจำนวนนับจะแสดงการปรากฏที่ตรวจพบ และหน้าจะแสดงตำแหน่งหน้า PDF จริง ปิดตัวเลือกนี้หากต้องการแยกรายการที่ปรากฏออกจากกัน เป้าหมายที่พิมพ์ออกมาและลิงก์ที่คลิกได้ซึ่งตรงกันในหน้าเดียวกันจะไม่ถูกนับซ้ำ
CSV จะรวมประเภท ค่า จำนวนการปรากฏ และการอ้างอิงหน้า ส่วน TXT และคัดลอกทั้งหมดจะให้เฉพาะค่าเท่านั้น โดยแสดงค่าละหนึ่งบรรทัด ข้อมูลทุกแถวที่ตรงกับตัวกรองปัจจุบันจะถูกรวมไว้ ไม่ใช่แค่เฉพาะหน้าตารางที่มองเห็นได้เท่านั้น
ไม่ การแยกวิเคราะห์ PDF การจับคู่ และการส่งออกจะทำงานในเบราว์เซอร์นี้ PDF ต้นฉบับจะไม่เปลี่ยนแปลง ไม่มีการติดต่อลิงก์ อีเมล หรือหมายเลขโทรศัพท์ที่ดึงมาโดยอัตโนมัติ
PDF หนึ่งไฟล์ขนาดสูงสุด 50 MiB และ 500 หน้า การดึงข้อมูลจำกัดที่ 250,000 ตัวอักษรและ 2,000 รายการที่ตรงกันต่อหน้า รวมทั้งหมดไม่เกิน 10 ล้านตัวอักษรและ 20,000 รายการที่ตรงกัน และคำอธิบายประกอบ 2,000 รายการต่อหน้า ผลลัพธ์จะมีประกาศแจ้งหากถึงขีดจำกัดหรือมีหน้าที่ไม่สามารถอ่านได้ทำให้ข้อมูลไม่ครบถ้วน
วิดีโอสอนการใช้งานฉบับย่อ
วิธีดึงลิงก์และ URL จาก PDF
เก็บลิงก์เว็บที่มีประโยชน์ไว้โดยไม่ต้องเปิดทีละรายการ
คำบรรยายภาษาอังกฤษ
ดูวิดีโอ