PDF na TXT

Wyodrębnij tekst z PDF-a. Bezpośrednio w przeglądarce. 100% za darmo, prywatność chroniona.

PDF na TXT wyodrębnia treść tekstową z pliku PDF do zwykłego pliku tekstowego, usuwając układ, czcionki i obrazy, tak że pozostają tylko słowa. Jest to dokładnie to, czego potrzebujesz, gdy tekst ma być wprowadzony do skryptu, narzędzia analitycznego, procesu tłumaczenia lub indeksu wyszukiwania, gdzie struktura PDF jest tylko przeszkodą. Wyodrębnianie zachowuje kolejność czytania i podziały akapitów, na ile pozwala na to dokument źródłowy. Działa w Twojej przeglądarce bez przesyłania plików.

  1. Prześlij plik — Przeciągnij i upuść pliki w obszarze przesyłania lub kliknij, aby przeglądać i wybrać pliki z urządzenia.
  2. Ustawienia — Wyodrębnij tekst z PDF-a
  3. Pobierz — Kliknij przycisk pobierania, aby zapisać przetworzony plik. Jest gotowy natychmiast!

Często Zadawane Pytania

Czy działa na zeskanowanych plikach PDF?

Nie. Skan zawiera obrazy tekstu, a nie tekst. Najpierw przetwórz go przez OCR, które rozpozna znaki i doda prawdziwą warstwę tekstową.

Czy układ jest zachowany?

Nie, i to celowo — zwykły tekst nie ma kolumn ani pozycjonowania. Układy wielokolumnowe w szczególności są spłaszczane do jednej kolejności czytania.

Jakie kodowanie ma wynikowy plik?

UTF-8, dzięki czemu znaki akcentowane i skrypty spoza alfabetu łacińskiego pozostają nienaruszone.

Dlaczego brakuje części tekstu?

Zazwyczaj dlatego, że części strony są obrazami, a nie tekstem, lub plik PDF używa czcionki z uszkodzoną mapą znaków. OCR radzi sobie z pierwszym przypadkiem.

Konwersja