PDF ke TXT

Ekstrak teks daripada PDF. Terus dalam pelayar anda. 100% percuma, privasi dilindungi.

PDF ke TXT mengekstrak kandungan teks PDF ke dalam fail teks biasa, menanggalkan susun atur, fon dan imej supaya anda hanya mempunyai perkataan. Ini adalah tepat apa yang anda mahu apabila teks perlu dimasukkan ke dalam skrip, alat analisis, aliran kerja terjemahan atau indeks carian, di mana struktur PDF hanya akan menghalang. Pengekstrakan mengekalkan susunan bacaan dan pemisah perenggan sejauh mana dokumen sumber membenarkan. Ia berfungsi dalam pelayar anda tanpa sebarang muat naik.

  1. Muat Naik Fail — Seret dan lepas fail anda ke kawasan muat naik, atau klik untuk melayari dan pilih fail dari peranti anda.
  2. Tetapan — Ekstrak teks daripada PDF
  3. Muat Turun — Klik butang muat turun untuk menyimpan fail yang telah diproses anda. Ia sedia serta-merta!

Soalan Lazim

Adakah ia berfungsi pada PDF yang diimbas?

Tidak. Imbasan mengandungi imej teks, bukan teks. Jalankannya melalui OCR terlebih dahulu, yang akan mengenali aksara dan menambah lapisan teks sebenar.

Adakah susun atur dikekalkan?

Tidak, dan sememangnya begitu — teks biasa tidak mempunyai lajur atau kedudukan. Susun atur berbilang lajur khususnya diratakan menjadi susunan bacaan tunggal.

Apakah pengekodan output?

UTF-8, jadi aksara beraksen dan skrip bukan Latin kekal utuh.

Mengapa ada teks yang hilang?

Biasanya kerana sebahagian halaman adalah imej dan bukannya teks, atau PDF menggunakan fon dengan peta aksara yang rosak. OCR mengendalikan kes pertama.

Tukar