PDF a TXT

Extraer texto del PDF. Directamente en tu navegador. 100% gratis, privacidad protegida.

PDF a TXT extrae el contenido de texto de un PDF en un archivo de texto plano, eliminando el diseño, las fuentes y las imágenes para que te quedes solo con las palabras. Esto es exactamente lo que necesitas cuando el texto debe ser introducido en un script, una herramienta de análisis, un flujo de trabajo de traducción o un índice de búsqueda, donde la estructura del PDF solo estorba. La extracción conserva el orden de lectura y los saltos de párrafo en la medida en que el documento fuente lo permite. Se ejecuta en tu navegador sin necesidad de subir archivos.

  1. Subir archivo — Arrastra y suelta tus archivos en el área de carga, o haz clic para explorar y seleccionar archivos desde tu dispositivo.
  2. Configurar opciones — Extraer texto del PDF
  3. Descargar — Haz clic en el botón de descargar para guardar tu archivo procesado. ¡Está listo al instante!

Preguntas Frecuentes

¿Funciona con archivos PDF escaneados?

No. Un escaneo contiene imágenes de texto, no texto. Primero, ejecútalo a través de OCR, que reconoce los caracteres y añade una capa de texto real.

¿Se conserva el diseño?

No, y esto es intencional: el texto plano no tiene columnas ni posicionamiento. Los diseños de varias columnas, en particular, se aplanan en un único orden de lectura.

¿Qué codificación tiene la salida?

UTF-8, por lo que los caracteres acentuados y los scripts no latinos se conservan intactos.

¿Por qué falta texto?

Normalmente porque partes de la página son imágenes en lugar de texto, o el PDF utiliza una fuente con un mapa de caracteres defectuoso. OCR se encarga del primer caso.

Convertir