เวิร์กโฟลว์ที่ใช้งานได้จริง
ทำให้เอกสารสแกนค้นหาได้ด้วย OCR
รู้จำข้อความจากเอกสารสแกนในเครื่อง แล้วดาวน์โหลดข้อความล้วนและ PDF ที่ค้นหาได้สำหรับเรียกดูภายหลัง
ค่าเริ่มต้น
เลือกการรู้จำภาษาอังกฤษ สเปน หรือจีนตัวย่อ รองรับไฟล์เข้าไม่เกิน 20 MiB, PDF ไม่เกิน 10 หน้า และภาพต้นทางไม่เกิน 12 ล้านพิกเซล โดยค่าเริ่มต้นจะข้ามหน้าที่มีข้อความอยู่แล้ว
ขั้นตอนการประมวลผล
- โหลดเอกสารสแกนหรือไฟล์ข้อความตัวอย่างสมมติ เลือกภาษาที่พิมพ์อยู่ในเอกสาร ซึ่งไม่จำเป็นต้องตรงกับภาษาของหน้าจอ
- เริ่ม OCR แล้วระบบจะดาวน์โหลดโมเดลภาษาที่เลือกเมื่อต้องใช้ หากหน้าสแกนมีเพียงหัวเรื่องที่เป็นข้อความ ให้ปิดตัวเลือกข้ามหน้าที่มีข้อความแล้วลองใหม่
- ตรวจข้อความที่รู้จำ จากนั้นดาวน์โหลดไฟล์ข้อความและ PDF ที่ค้นหาได้ ลองค้นหาวลีที่ทราบอยู่แล้วในโปรแกรมอ่าน PDF อื่น
ตรวจสอบผลลัพธ์
เทียบชื่อ ตัวเลข และข้อความสำคัญกับภาพ ค่าโดยประมาณของความเชื่อมั่นไม่ได้เป็นหลักฐานว่าข้อความถูกต้อง
ข้อจำกัดและข้อมูลที่สูญเสีย
หน้าที่ผ่าน OCR จะกลายเป็นภาพแรสเตอร์พร้อมข้อความที่มองไม่เห็น เลย์เอาต์เดิมที่แก้ไขได้ แบบฟอร์ม และลิงก์จะไม่ถูกเก็บไว้ นี่ไม่ใช่การแปลงเพื่อจัดเก็บถาวรแบบ PDF/A ที่ผ่านการรับรอง
ประมวลผลในเครื่อง
ไฟล์และผลลัพธ์อยู่ในเบราว์เซอร์นี้เท่านั้น โดยไม่เขียนทับต้นฉบับ ตัวอย่างใช้ข้อมูลสมมติ โปรดดาวน์โหลดผลลัพธ์ก่อนล้างข้อมูลหรือออกจากหน้า OCR จะดาวน์โหลดโมเดลรู้จำข้อความ ไม่ได้อัปโหลดเอกสารของคุณ