PDF para TXT

Extrair texto de PDF. Diretamente no seu navegador. 100% gratuito, privacidade protegida.

PDF para TXT extrai o conteúdo de texto de um PDF para um arquivo de texto simples, removendo layout, fontes e imagens, deixando você apenas com as palavras. Isso é exatamente o que você precisa quando o texto tem que ser inserido em um script, uma ferramenta de análise, um fluxo de trabalho de tradução ou um índice de pesquisa, onde a estrutura do PDF é apenas um obstáculo. A extração preserva a ordem de leitura e as quebras de parágrafo, tanto quanto o documento de origem permite. Ele funciona no seu navegador sem upload.

  1. Enviar arquivo — Arraste e solte seus arquivos na área de upload, ou clique para navegar e selecionar arquivos do seu dispositivo.
  2. Configurar — Extrair texto de PDF
  3. Baixar — Clique no botão de download para salvar seu arquivo processado. Ele está pronto instantaneamente!

Perguntas Frequentes

Funciona em PDFs digitalizados?

Não. Uma digitalização contém imagens de texto, não texto. Execute-o através de OCR primeiro, que reconhece os caracteres e adiciona uma camada de texto real.

O layout é preservado?

Não, e deliberadamente — texto simples não tem colunas ou posicionamento. Layouts de várias colunas, em particular, são achatados em uma única ordem de leitura.

Qual é a codificação da saída?

UTF-8, para que caracteres acentuados e escritas não latinas permaneçam intactos.

Por que falta algum texto?

Geralmente porque partes da página são imagens em vez de texto, ou o PDF usa uma fonte com um mapa de caracteres corrompido. O OCR lida com o primeiro caso.

Converter