Wyodrębnianie tekstu z PDF
Wyodrębnij tekst z pliku PDF.
O tym narzędziu
Narzędzie do wyodrębniania tekstu z PDF odczytuje tekst zawarty w dokumencie PDF strona po stronie, umożliwiając jego skopiowanie lub zapisanie w postaci pliku TXT. Możesz wyodrębnić cały dokument lub wybrać tylko potrzebny zakres stron, a wyniki przeglądać w całości lub z podziałem na strony. Przydaje się przy ponownym wykorzystaniu treści z raportów, artykułów naukowych, specyfikacji czy umów albo gdy chcesz uporządkować je w formie umożliwiającej przeszukiwanie.
Jak używać
Wybierz plik PDF
Prześlij plik PDF, z którego chcesz wyodrębnić tekst. Po wybraniu pliku zobaczysz jego nazwę, rozmiar i łączną liczbę stron.
Określ zakres stron
Aby wyodrębnić tekst ze wszystkich stron, pozostaw pole zakresu puste. Jeśli potrzebujesz tylko wybranych stron, wpisz numery lub zakresy.
Wyodrębnij i zapisz tekst
Kliknij przycisk wyodrębniania tekstu, a następnie przeglądaj wynik jako całość lub z podziałem na strony. Potrzebną treść możesz skopiować lub zapisać jako plik TXT.
Funkcje
Całość lub wybrane strony
Wyodrębnij tekst z całego PDF-a albo tylko z wybranych stron, podając np. 3, 1-3, 4-.
Widok całości i według stron
Przeglądaj wyodrębniony tekst jako jednolitą całość lub z podziałem na poszczególne strony.
Nawigacja po stronach i kopiowanie
Przejdź bezpośrednio do wybranej strony i skopiuj tekst tylko z bieżącej strony.
Zapis do pliku TXT
Zapisz cały wyodrębniony tekst jako plik TXT, aby użyć go w edytorze tekstu lub w innych narzędziach.
Przetwarzanie w przeglądarce
Wybrany plik PDF i wyodrębniony tekst są przetwarzane wyłącznie w przeglądarce i nie są wysyłane na serwer.
Przypadki użycia
Ponowne wykorzystanie treści raportów
Kopiuj zdania lub nagłówki tabel z raportu PDF, aby wykorzystać je w nowym dokumencie, podsumowaniu czy prezentacji.
Porządkowanie artykułów i materiałów badawczych
Wyodrębniaj tekst z artykułów naukowych i dokumentacji technicznej, aby tworzyć notatki, gromadzić cytaty lub budować bazę przeszukiwalnych materiałów.
Przeglądanie umów i specyfikacji
Przeglądaj tekst długich umów, regulaminów czy specyfikacji technicznych strona po stronie i kopiuj tylko potrzebne fragmenty.
Zapis zawartości PDF jako TXT
Konwertuj treść PDF-a do pliku tekstowego, aby używać go w notatniku, edytorze kodu, narzędziu tłumaczeniowym itp.
Wyodrębnianie tylko wybranych stron
Zamiast całego dokumentu wybierz tylko tekst z potrzebnego rozdziału, załącznika lub konkretnych stron.
Często zadawane pytania
Czy mogę wyodrębnić tekst z zeskanowanego PDF-a?
To narzędzie nie obsługuje obecnie OCR. W przypadku zeskanowanych dokumentów lub plików PDF składających się wyłącznie z obrazów tekst może nie zostać wyodrębniony lub wynik będzie pusty.
Jak wpisać zakres stron?
Aby wyodrębnić pojedynczą stronę, wpisz np. 3. Dla ciągłego zakresu użyj 1-3. Zapis 4- oznacza od strony 4 do końca, a -3 – od pierwszej strony do 3 włącznie.
Czy mogę przeglądać wyniki według stron?
Tak. Po przejściu na zakładkę widoku według stron zobaczysz tekst i liczbę znaków dla każdej strony osobno.
Czy mogę szybko przejść do konkretnej strony?
Tak. Wpisz numer strony w polu nawigacji, aby natychmiast przejść do wyników dla tej strony.
Czy układ i podział wierszy w wyodrębnionym tekście odpowiadają oryginałowi?
W zależności od wewnętrznego sposobu przechowywania tekstu w pliku PDF podział wierszy, kolejność wyrazów lub układ akapitów mogą różnić się od wyglądu oryginalnego dokumentu.
Czy mogę zapisać wyodrębniony tekst jako plik?
Tak. Przycisk zapisu TXT pozwala zapisać całość wyodrębnionego tekstu jako plik tekstowy.
Czy narzędzie obsługuje pliki PDF zabezpieczone hasłem?
Nie. Pliki PDF chronione hasłem nie mogą zostać przetworzone. Przed użyciem narzędzia najpierw usuń zabezpieczenie hasłem.
Czy wybrany plik PDF jest wysyłany na serwer?
Nie. Całe przetwarzanie odbywa się w przeglądarce użytkownika – wybrany plik PDF i wyniki nie są nigdzie przesyłane.