PDF a TXT

Estrai testo dal PDF. Direttamente nel browser. 100% gratuito, privacy protetta.

PDF a TXT estrae il contenuto testuale di un PDF in un file di testo semplice, eliminando layout, font e immagini, lasciandoti solo le parole. Questo è esattamente ciò che desideri quando il testo deve essere inserito in uno script, uno strumento di analisi, un flusso di lavoro di traduzione o un indice di ricerca, dove la struttura PDF è solo d'intralcio. L'estrazione preserva l'ordine di lettura e le interruzioni di paragrafo per quanto consentito dal documento originale. Funziona nel tuo browser senza alcun caricamento.

  1. Carica file — Trascina e rilascia i tuoi file nell'area di caricamento, oppure clicca per sfogliare e selezionare i file dal tuo dispositivo.
  2. Configura — Estrai testo dal PDF
  3. Scarica — Clicca sul pulsante di download per salvare il tuo file elaborato. È pronto all'istante!

Domande Frequenti

Funziona con i PDF scannerizzati?

No. Una scansione contiene immagini di testo, non testo. Eseguila prima tramite OCR, che riconosce i caratteri e aggiunge un vero e proprio livello di testo.

Il layout viene preservato?

No, e intenzionalmente — il testo semplice non ha colonne o posizionamento. In particolare, i layout a più colonne vengono appiattiti in un unico ordine di lettura.

Qual è la codifica dell'output?

UTF-8, in modo che i caratteri accentati e gli script non latini rimangano intatti.

Perché manca del testo?

Di solito perché alcune parti della pagina sono immagini anziché testo, o il PDF utilizza un font con una mappa dei caratteri danneggiata. OCR gestisce il primo caso.

Converti