OCR ขั้นสูง

OCR เต็มหน้า · PDF ที่ค้นหาได้ · หลายรูปแบบเอาต์พุต · ประมวลผลเป็นชุด. ใช้งานได้ในเบราว์เซอร์ ฟรี 100% ปกป้องความเป็นส่วนตัว

OCR จะอ่านข้อความในหน้าเอกสารที่สแกนและรูปถ่าย แล้วแปลงให้เป็นข้อความจริงที่สามารถเลือกได้ เมื่อคุณใช้กับสัญญาที่สแกนมา หรือหน้าเอกสารที่ถ่ายรูปไว้ คุณจะได้ไฟล์ PDF ที่ค้นหาได้ ซึ่งดูเหมือนเดิมทุกประการ แต่มีเลเยอร์ข้อความซ่อนอยู่ด้านล่าง ทำให้สามารถใช้ Ctrl+F คัดลอกข้อความ และเครื่องมืออื่นๆ สามารถดึงข้อความออกมาได้ ผลลัพธ์ที่ได้อาจเป็นข้อความธรรมดา หรือเอกสารที่มีโครงสร้าง การรู้จำข้อความใช้ Tesseract ที่คอมไพล์เป็น WebAssembly และทำงานทั้งหมดในเบราว์เซอร์ของคุณ ซึ่งเป็นเรื่องที่ผิดปกติสำหรับ OCR เพราะบริการส่วนใหญ่ต้องอัปโหลดเอกสาร และรองรับภาษาที่หลากหลาย รวมถึงภาษาที่ไม่ได้ใช้ตัวอักษรละติน

  1. อัปโหลดไฟล์ — ลากและวางไฟล์ของคุณลงในพื้นที่อัปโหลด หรือคลิกเพื่อเลือกไฟล์จากอุปกรณ์ของคุณ
  2. ตั้งค่า — OCR เต็มหน้า · PDF ที่ค้นหาได้ · หลายรูปแบบเอาต์พุต · ประมวลผลเป็นชุด
  3. ดาวน์โหลด — คลิกปุ่มดาวน์โหลดเพื่อบันทึกไฟล์ที่คุณประมวลผล ไฟล์พร้อมใช้งานทันที!

คำถามที่พบบ่อย

รองรับภาษาใดบ้าง?

มีหลายภาษาที่รองรับ ได้แก่ English, Korean, Japanese, Chinese และภาษาหลักๆ ในยุโรป รวมถึงภาษาที่ไม่ได้ใช้ตัวอักษรละติน การเลือกภาษาที่ถูกต้องก่อนการประมวลผลจะส่งผลอย่างมากต่อความแม่นยำ

มีความแม่นยำแค่ไหน?

หากเป็นการสแกนข้อความที่พิมพ์มาอย่างสะอาดด้วยความละเอียด 300 DPI ความแม่นยำจะสูง ความแม่นยำจะลดลงหากมีความละเอียดต่ำ เอียง มีเงา คอนทราสต์ไม่ดี และตัวเขียน — โดยเฉพาะตัวเขียนจะไม่สามารถรู้จำได้อย่างน่าเชื่อถือ

เอกสารของฉันถูกอัปโหลดไปยังเซิร์ฟเวอร์ OCR หรือไม่?

ไม่ การรู้จำข้อความทำงานในเบราว์เซอร์ของคุณผ่าน WebAssembly ไฟล์จะไม่ถูกส่งออกจากอุปกรณ์ของคุณเลย ซึ่งเป็นเหตุผลหลักที่ควรใช้เครื่องมือนี้แทนบริการ OCR บนคลาวด์สำหรับเอกสารที่เป็นความลับ

ฉันจะได้รับผลลัพธ์ที่ดีที่สุดได้อย่างไร?

สแกนที่ 300 DPI, จัดหน้าให้ตรง, หลีกเลี่ยงเงา, และเลือกภาษาที่ถูกต้อง การแก้ไขความเอียงและการปรับคอนทราสต์ก่อนการรู้จำข้อความก็ช่วยให้ผลลัพธ์ดีขึ้นอย่างเห็นได้ชัด

ปรับแต่ง