ดึงข้อความจาก PDF

ดึงข้อความที่มีอยู่ใน PDF หรือเลือก OCR ในเครื่องสำหรับภาพและงานสแกนตัวพิมพ์ภาษาอังกฤษ สเปน และจีนตัวย่อ

เมื่อเครื่องมือนี้มีประโยชน์

คัดลอกข้อความที่อ่านได้จากรายงาน, บทความ, ใบแจ้งหนี้ และโน้ตที่สร้างด้วยคอมพิวเตอร์เพื่อค้นหาหรือแก้ไข

วิธีการประมวลผลท้องถิ่นทำงานอย่างไร

โหมดดึงข้อความพื้นฐาน: เบราว์เซอร์อ่านรายการข้อความของแต่ละหน้า, รวมเข้าด้วยกันตามลำดับอ่านคร่าวๆ, แยกหน้า, และสร้างการดาวน์โหลดเป็นข้อความธรรมดา UTF-8 เอกสารอยู่ในหน่วยความจำเบราว์เซอร์ โค้ด OCR และโมเดลภาษาที่เลือกดาวน์โหลดจากเว็บไซต์นี้ ไม่ใช่การอัปโหลดไฟล์ เมื่อออกจากหน้าหรือล้างข้อมูล เอกสารและผลลัพธ์จะถูกทิ้ง คัดลอกหน้าเหล่านี้โดยไม่ทำ OCR ปิดตัวเลือกนี้หากมีเพียงหัวกระดาษเป็นข้อความและส่วนที่เหลือยังต้องรู้จำ

วิธีใช้งาน

  1. เตรียมแหล่งข้อมูล: คัดลอกข้อความที่อ่านได้จากรายงาน, บทความ, ใบแจ้งหนี้ และโน้ตที่สร้างด้วยคอมพิวเตอร์เพื่อค้นหาหรือแก้ไข
  2. ประมวลผลในเครื่อง: โหมดดึงข้อความพื้นฐาน: เบราว์เซอร์อ่านรายการข้อความของแต่ละหน้า, รวมเข้าด้วยกันตามลำดับอ่านคร่าวๆ, แยกหน้า, และสร้างการดาวน์โหลดเป็นข้อความธรรมดา UTF-8 เอกสารอยู่ในหน่วยความจำเบราว์เซอร์ โค้ด OCR และโมเดลภาษาที่เลือกดาวน์โหลดจากเว็บไซต์นี้ ไม่ใช่การอัปโหลดไฟล์ เมื่อออกจากหน้าหรือล้างข้อมูล เอกสารและผลลัพธ์จะถูกทิ้ง คัดลอกหน้าเหล่านี้โดยไม่ทำ OCR ปิดตัวเลือกนี้หากมีเพียงหัวกระดาษเป็นข้อความและส่วนที่เหลือยังต้องรู้จำ
  3. ดาวน์โหลดและตรวจสอบ: ตรวจเทียบข้อความและ PDF ที่ดาวน์โหลดกับต้นฉบับก่อนใช้ ค่าความเชื่อมั่นเป็นเพียงประมาณการ ไม่รับประกันความถูกต้อง

ข้อจำกัดสำคัญ

สำหรับข้อความพิมพ์เท่านั้น อาจรู้จำผิด ไม่สร้างเค้าโครงที่แก้ไขได้ ตาราง หรือลายมือ หน้า OCR จะเป็นภาพพร้อมชั้นข้อความที่มองไม่เห็น ไม่เก็บลิงก์ แบบฟอร์ม หมายเหตุ หรือลายเซ็นในหน้านั้น และไม่ใช่การรับรอง PDF/A

ตรวจสอบผลลัพธ์ที่ดาวน์โหลดมา

ตรวจเทียบข้อความและ PDF ที่ดาวน์โหลดกับต้นฉบับก่อนใช้ ค่าความเชื่อมั่นเป็นเพียงประมาณการ ไม่รับประกันความถูกต้อง

เป็นส่วนตัวตามการออกแบบ

ไฟล์ของคุณจะยังอยู่ในเบราว์เซอร์นี้ เครื่องมือนี้จะไม่อัปโหลดแหล่งที่มาหรือผลลัพธ์ไปยังเซิร์ฟเวอร์ของเรา

คำถามและคำตอบ

เครื่องมือนี้มีประโยชน์เมื่อใด?

คัดลอกข้อความที่อ่านได้จากรายงาน, บทความ, ใบแจ้งหนี้ และโน้ตที่สร้างด้วยคอมพิวเตอร์เพื่อค้นหาหรือแก้ไข

เบราว์เซอร์ทำอะไรจริง ๆ?

โหมดดึงข้อความพื้นฐาน: เบราว์เซอร์อ่านรายการข้อความของแต่ละหน้า, รวมเข้าด้วยกันตามลำดับอ่านคร่าวๆ, แยกหน้า, และสร้างการดาวน์โหลดเป็นข้อความธรรมดา UTF-8 เอกสารอยู่ในหน่วยความจำเบราว์เซอร์ โค้ด OCR และโมเดลภาษาที่เลือกดาวน์โหลดจากเว็บไซต์นี้ ไม่ใช่การอัปโหลดไฟล์ เมื่อออกจากหน้าหรือล้างข้อมูล เอกสารและผลลัพธ์จะถูกทิ้ง คัดลอกหน้าเหล่านี้โดยไม่ทำ OCR ปิดตัวเลือกนี้หากมีเพียงหัวกระดาษเป็นข้อความและส่วนที่เหลือยังต้องรู้จำ

ฉันควรเข้าใจขีดจำกัดใดบ้าง?

สำหรับข้อความพิมพ์เท่านั้น อาจรู้จำผิด ไม่สร้างเค้าโครงที่แก้ไขได้ ตาราง หรือลายมือ หน้า OCR จะเป็นภาพพร้อมชั้นข้อความที่มองไม่เห็น ไม่เก็บลิงก์ แบบฟอร์ม หมายเหตุ หรือลายเซ็นในหน้านั้น และไม่ใช่การรับรอง PDF/A

ฉันควรตรวจสอบผลลัพธ์อย่างไร?

ตรวจเทียบข้อความและ PDF ที่ดาวน์โหลดกับต้นฉบับก่อนใช้ ค่าความเชื่อมั่นเป็นเพียงประมาณการ ไม่รับประกันความถูกต้อง

เครื่องมือที่เกี่ยวข้อง