Czym jest to narzędzie?
To narzędzie odczytuje warstwę tekstową PDF-a (rzeczywisty, zaznaczalny i możliwy do skopiowania tekst osadzony w pliku — nie obraz) i odtwarza go jako nowy dokument Word, przy czym każdy wykryty wiersz staje się akapitem, a między poszczególnymi oryginalnymi stronami PDF-a wstawiany jest podział strony. Przydaje się, gdy masz PDF oparty na tekście — raport, artykuł, wyeksportowany dokument — i musisz skopiować, edytować lub ponownie wykorzystać tekst bez przepisywania wszystkiego od nowa.
Szczerze mówiąc, to narzędzie do wyodrębniania tekstu, a nie konwerter zachowujący układ strony: nie odtworzy dokładnie wielokolumnowych układów, tabel, nagłówków/stopek, konkretnych czcionek ani osadzonych obrazów tak, jak wyglądały w PDF-ie. Jeśli Twój PDF jest zeskanowanym obrazem (zdjęciem lub skanem bez leżącej pod spodem warstwy tekstowej), to narzędzie nie znajdzie żadnego tekstu do wyodrębnienia — najpierw potrzebowałbyś narzędzia OCR do rozpoznania tekstu z obrazu.
Dlaczego warto go używać?
- Zamienia tekst statycznego PDF-a w edytowalny dokument Word w kilka sekund, bez przepisywania.
- Działa całkowicie offline w Twojej przeglądarce — plik PDF nigdy nie jest przesyłany na żaden serwer.
- Darmowe, bez rejestracji, bez limitu stron innego niż ten, jaki jest w stanie obsłużyć Twoja przeglądarka.
- Uczciwe co do swoich ograniczeń: wyodrębnia tekst, zamiast udawać, że idealnie odtwarza oryginalny układ.
Jak używać
- Kliknij pole lub przeciągnij na nie plik PDF.
- Poczekaj, aż tekst zostanie wyodrębniony, a dokument Word wygenerowany.
- Kliknij przycisk pobierania, aby zapisać plik .docx.
Przykład
Wejście
raport.pdf — 3-stronicowy dokument tekstowyWynik
raport.docx — edytowalny plik Word z wyodrębnionym tekstem, z zachowanymi podziałami stron między oryginalnymi 3 stronamiKażdy wiersz tekstu staje się akapitem w dokumencie Word; oryginalny układ wizualny, czcionki i wszelkie osadzone obrazy nie są odtwarzane.
Najczęściej zadawane pytania
Czy to narzędzie zachowa dokładne formatowanie mojego PDF-a?
Nie, nie dokładnie. To narzędzie wyodrębnia treść tekstową i odtwarza ją jako zwykłe akapity w nowym dokumencie Word, z podziałami stron między oryginalnymi stronami. Nie odtwarza wielokolumnowych układów, tabel, konkretnych czcionek, nagłówków/stopek ani osadzonych obrazów. Jeśli potrzebujesz zachowania układu co do piksela, to nie jest odpowiednie narzędzie — zostało zaprojektowane do wyodrębniania i edytowania treści tekstowej.
Dlaczego pojawia się informacja, że w moim PDF-ie nie znaleziono tekstu?
Dzieje się tak, gdy Twój PDF jest zeskanowanym obrazem — zasadniczo zdjęciem strony bez leżącej pod spodem zaznaczalnej warstwy tekstowej, samymi pikselami. To narzędzie odczytuje dane tekstowe już osadzone w PDF-ie; nie wykonuje OCR (optycznego rozpoznawania znaków), aby odczytać tekst z obrazu. Potrzebowałbyś narzędzia OCR, aby najpierw przekonwertować zeskanowany obraz na tekst.
Czy mój PDF jest przesyłany na serwer?
Nie. Cały proces konwersji — odczytanie PDF-a i wygenerowanie pliku Word — odbywa się lokalnie w Twojej przeglądarce przy użyciu JavaScript. Twój plik nigdy nie opuszcza Twojego urządzenia, dzięki czemu można go bezpiecznie używać z prywatnymi lub wrażliwymi dokumentami.
Jaki format pliku jest pobierany?
Standardowy plik .docx, kompatybilny z Microsoft Word, Google Docs, LibreOffice Writer i innymi edytorami tekstu obsługującymi format Office Open XML.
Czy mogę skonwertować PDF chroniony hasłem?
Nie, obecnie nie — to narzędzie nie obsługuje zaszyfrowanych ani chronionych hasłem plików PDF. Musiałbyś najpierw usunąć zabezpieczenie hasłem za pomocą edytora PDF, zanim dokonasz konwersji.