PDF เป็น TXT
แยกข้อความจาก PDF. ใช้งานได้ในเบราว์เซอร์ ฟรี 100% ปกป้องความเป็นส่วนตัว
PDF เป็น TXT จะดึงเนื้อหาข้อความจากไฟล์ PDF ออกมาเป็นไฟล์ข้อความธรรมดา โดยตัดรูปแบบตัวอักษร ฟอนต์ และรูปภาพออก เหลือไว้เพียงตัวอักษรเท่านั้น นี่คือสิ่งที่คุณต้องการเมื่อข้อความต้องถูกนำไปใช้ในสคริปต์ เครื่องมือวิเคราะห์ กระบวนการแปล หรือดัชนีการค้นหา ซึ่งโครงสร้าง PDF อาจเป็นอุปสรรค การดึงข้อมูลจะรักษาลำดับการอ่านและการแบ่งย่อหน้าตามที่เอกสารต้นฉบับเอื้ออำนวย เครื่องมือนี้ทำงานในเบราว์เซอร์ของคุณโดยไม่ต้องอัปโหลดไฟล์
- อัปโหลดไฟล์ — ลากและวางไฟล์ของคุณลงในพื้นที่อัปโหลด หรือคลิกเพื่อเลือกไฟล์จากอุปกรณ์ของคุณ
- ตั้งค่า — แยกข้อความจาก PDF
- ดาวน์โหลด — คลิกปุ่มดาวน์โหลดเพื่อบันทึกไฟล์ที่คุณประมวลผล ไฟล์พร้อมใช้งานทันที!
คำถามที่พบบ่อย
สามารถใช้งานกับไฟล์ PDF ที่สแกนมาได้หรือไม่?
ไม่ได้ ไฟล์ที่สแกนมีรูปภาพของข้อความ ไม่ใช่ข้อความจริง ควรนำไปผ่าน OCR ก่อน ซึ่งจะจดจำตัวอักษรและเพิ่มเลเยอร์ข้อความจริงลงไป
รูปแบบเอกสารจะยังคงเดิมหรือไม่?
ไม่ และเป็นไปตามวัตถุประสงค์ เพราะข้อความธรรมดาไม่มีคอลัมน์หรือตำแหน่ง การจัดวางแบบหลายคอลัมน์โดยเฉพาะ จะถูกทำให้เรียบเป็นลำดับการอ่านเดียว
ผลลัพธ์ที่ได้ใช้การเข้ารหัสแบบใด?
UTF-8 เพื่อให้ตัวอักษรเน้นเสียงและสคริปต์ที่ไม่ใช่ภาษาละตินยังคงอยู่ครบถ้วน
ทำไมข้อความบางส่วนหายไป?
โดยปกติแล้วเป็นเพราะบางส่วนของหน้าเป็นรูปภาพไม่ใช่ข้อความ หรือไฟล์ PDF ใช้ฟอนต์ที่มีการแมปตัวอักษรที่เสียหาย OCR จะจัดการกรณีแรกได้
แปลง
- PDF เป็น Word — แปลง PDF เป็นเอกสาร Word
- PDF เป็น PPTX — แปลง PDF เป็น PowerPoint
- PDF เป็น Excel — แปลง PDF เป็นสเปรดชีต Excel
- PDF เป็น JPG — แปลงหน้า PDF เป็นรูปภาพ JPG
- PDF เป็น PNG — แปลงหน้า PDF เป็นรูปภาพ PNG
- PDF เป็น Markdown — แปลง PDF เป็นรูปแบบ Markdown
- Word เป็น PDF — แปลงเอกสาร Word เป็น PDF
- PPTX เป็น PDF — แปลง PowerPoint เป็น PDF
- Excel เป็น PDF — แปลงไฟล์ Excel เป็น PDF
- JPG เป็น PDF — แปลงรูปภาพ JPG เป็น PDF
- PNG เป็น PDF — แปลงรูปภาพ PNG เป็น PDF