PDF till TXT

Extrahera text från PDF. Direkt i din webbläsare. 100% gratis, integritet skyddad.

PDF to TXT extraherar textinnehållet i en PDF till en vanlig textfil och tar bort layout, typsnitt och bilder så att du bara har kvar orden. Det är precis vad du vill ha när texten ska matas in i ett skript, ett analysverktyg, ett översättningsarbetsflöde eller ett sökindex, där PDF-strukturen bara är i vägen. Extraktionen bevarar läsordning och styckeindelningar så långt källdokumentet tillåter. Det körs i din webbläsare utan uppladdning.

  1. Ladda upp fil — Dra och släpp dina filer till uppladdningsområdet, eller klicka för att bläddra och välja filer från din enhet.
  2. Inställningar — Extrahera text från PDF
  3. Ladda ner — Klicka på nedladdningsknappen för att spara din bearbetade fil. Den är redo direkt!

Vanliga frågor och svar

Fungerar det på skannade PDF-filer?

Nej. En skanning innehåller bilder av text, inte text. Kör den först genom OCR, vilket identifierar tecknen och lägger till ett riktigt textlager.

Bevaras layouten?

Nej, och det är avsiktligt – en vanlig text har inga kolumner eller placering. Särskilt flerkolumnslayouter plattas till en enda läsordning.

Vilken teckenkodning har utdata?

UTF-8, så accentuerade tecken och icke-latinska skriftsystem bevaras intakta.

Varför saknas viss text?

Vanligtvis beror det på att delar av sidan är bilder snarare än text, eller att PDF-filen använder ett typsnitt med en trasig teckenmappning. OCR hanterar det första fallet.

Konvertera