PDF ke TXT

Ekstrak teks dari PDF. Langsung di browser. 100% gratis, privasi terlindungi.

PDF ke TXT mengekstrak konten teks dari PDF ke dalam file teks biasa, menghilangkan tata letak, font, dan gambar sehingga yang tersisa hanyalah kata-kata. Ini adalah persis yang Anda inginkan saat teks harus dimasukkan ke dalam skrip, alat analisis, alur kerja terjemahan, atau indeks pencarian, di mana struktur PDF hanya akan menjadi penghalang. Ekstraksi mempertahankan urutan baca dan pemisah paragraf sejauh yang diizinkan oleh dokumen sumber. Ini berjalan di browser Anda tanpa perlu mengunggah file.

  1. Unggah File — Seret dan lepas file Anda ke area unggah, atau klik untuk mencari dan memilih file dari perangkat Anda.
  2. Atur Opsi — Ekstrak teks dari PDF
  3. Unduh — Klik tombol unduh untuk menyimpan file yang telah diproses. File siap seketika!

Pertanyaan yang Sering Diajukan

Apakah ini berfungsi pada PDF yang dipindai?

Tidak. Hasil pindaian berisi gambar teks, bukan teks. Jalankan melalui OCR terlebih dahulu, yang akan mengenali karakter dan menambahkan lapisan teks asli.

Apakah tata letak dipertahankan?

Tidak, dan memang disengaja — teks biasa tidak memiliki kolom atau penempatan. Tata letak multi-kolom khususnya diratakan menjadi satu urutan baca.

Apa pengodean outputnya?

UTF-8, sehingga karakter beraksen dan skrip non-Latin tetap utuh.

Mengapa ada beberapa teks yang hilang?

Biasanya karena bagian halaman adalah gambar, bukan teks, atau PDF menggunakan font dengan peta karakter yang rusak. OCR menangani kasus pertama.

Konversi