PDF เป็น TXT

แยกข้อความจาก PDF. ใช้งานได้ในเบราว์เซอร์ ฟรี 100% ปกป้องความเป็นส่วนตัว

PDF เป็น TXT จะดึงเนื้อหาข้อความจากไฟล์ PDF ออกมาเป็นไฟล์ข้อความธรรมดา โดยตัดรูปแบบตัวอักษร ฟอนต์ และรูปภาพออก เหลือไว้เพียงตัวอักษรเท่านั้น นี่คือสิ่งที่คุณต้องการเมื่อข้อความต้องถูกนำไปใช้ในสคริปต์ เครื่องมือวิเคราะห์ กระบวนการแปล หรือดัชนีการค้นหา ซึ่งโครงสร้าง PDF อาจเป็นอุปสรรค การดึงข้อมูลจะรักษาลำดับการอ่านและการแบ่งย่อหน้าตามที่เอกสารต้นฉบับเอื้ออำนวย เครื่องมือนี้ทำงานในเบราว์เซอร์ของคุณโดยไม่ต้องอัปโหลดไฟล์

  1. อัปโหลดไฟล์ — ลากและวางไฟล์ของคุณลงในพื้นที่อัปโหลด หรือคลิกเพื่อเลือกไฟล์จากอุปกรณ์ของคุณ
  2. ตั้งค่า — แยกข้อความจาก PDF
  3. ดาวน์โหลด — คลิกปุ่มดาวน์โหลดเพื่อบันทึกไฟล์ที่คุณประมวลผล ไฟล์พร้อมใช้งานทันที!

คำถามที่พบบ่อย

สามารถใช้งานกับไฟล์ PDF ที่สแกนมาได้หรือไม่?

ไม่ได้ ไฟล์ที่สแกนมีรูปภาพของข้อความ ไม่ใช่ข้อความจริง ควรนำไปผ่าน OCR ก่อน ซึ่งจะจดจำตัวอักษรและเพิ่มเลเยอร์ข้อความจริงลงไป

รูปแบบเอกสารจะยังคงเดิมหรือไม่?

ไม่ และเป็นไปตามวัตถุประสงค์ เพราะข้อความธรรมดาไม่มีคอลัมน์หรือตำแหน่ง การจัดวางแบบหลายคอลัมน์โดยเฉพาะ จะถูกทำให้เรียบเป็นลำดับการอ่านเดียว

ผลลัพธ์ที่ได้ใช้การเข้ารหัสแบบใด?

UTF-8 เพื่อให้ตัวอักษรเน้นเสียงและสคริปต์ที่ไม่ใช่ภาษาละตินยังคงอยู่ครบถ้วน

ทำไมข้อความบางส่วนหายไป?

โดยปกติแล้วเป็นเพราะบางส่วนของหน้าเป็นรูปภาพไม่ใช่ข้อความ หรือไฟล์ PDF ใช้ฟอนต์ที่มีการแมปตัวอักษรที่เสียหาย OCR จะจัดการกรณีแรกได้

แปลง