Šta je ovaj alat?
Ovaj alat čita tekstualni sloj PDF-a (stvarni, označivi i kopirljivi tekst ugrađen u fajl — ne sliku) i ponovo ga gradi kao novi Word dokument, pri čemu svaki prepoznati red postaje pasus, a prelom stranice se umeće između svake originalne stranice PDF-a. Korisno je kada imate tekstualni PDF — izveštaj, članak, izvezeni dokument — i treba da kopirate, uredite ili ponovo iskoristite tekst bez ponovnog kucanja svega.
Iskreno, ovo je alat za izvlačenje teksta, a ne konvertor koji čuva raspored: neće verno rekreirati raspored sa više kolona, tabele, zaglavlja/podnožja, određene fontove ili ugrađene slike tačno onako kako su izgledali u PDF-u. Ako je vaš PDF skenirana slika (fotografija ili sken bez tekstualnog sloja u osnovi), ovaj alat neće pronaći tekst za izvlačenje — prvo bi vam trebao OCR alat koji prepoznaje tekst sa slike.
Zašto ga koristiti?
- Pretvara tekst statičnog PDF-a u uredivi Word dokument za nekoliko sekundi, bez ponovnog kucanja.
- Radi potpuno van mreže u vašem pretraživaču — PDF fajl se nikada ne šalje ni na jedan server.
- Besplatan je, bez registracije, bez ograničenja broja stranica osim onoga što vaš pretraživač može da obradi.
- Iskren je u vezi svojih ograničenja: izvlači tekst umesto da se pravi da savršeno rekreira originalni raspored.
Kako se koristi
- Kliknite na okvir ili prevucite PDF fajl na njega.
- Sačekajte dok se tekst izvlači i generiše Word dokument.
- Kliknite dugme za preuzimanje da sačuvate .docx fajl.
Primer
Unos
report.pdf — tekstualni dokument od 3 straniceRezultat
report.docx — uredivi Word dokument sa izvučenim tekstom, uz očuvane prelome stranica između originalne 3 straniceSvaki red teksta postaje pasus u Word dokumentu; originalni vizuelni raspored, fontovi i sve ugrađene slike se ne reprodukuju.
Često postavljana pitanja
Da li će ovaj alat sačuvati tačno formatiranje mog PDF-a?
Ne, ne tačno. Ovaj alat izvlači tekstualni sadržaj i ponovo ga gradi kao obične pasuse u novom Word dokumentu, sa prelomima stranica između originalnih stranica. Ne rekreira raspored sa više kolona, tabele, određene fontove, zaglavlja/podnožja ili ugrađene slike. Ako vam je potrebno očuvanje rasporeda do piksela, ovo nije pravi alat — napravljen je za izvlačenje i uređivanje tekstualnog sadržaja.
Zašto piše da u mom PDF-u nije pronađen tekst?
To se dešava kada je vaš PDF skenirana slika — u suštini fotografija stranice bez tekstualnog sloja koji se može označiti u osnovi, samo pikseli. Ovaj alat čita tekstualne podatke već ugrađene u PDF; ne izvodi OCR (optičko prepoznavanje karaktera) za čitanje teksta sa slike. Trebaće vam OCR alat da biste prvo pretvorili skeniranu sliku u tekst.
Da li se moj PDF šalje na server?
Ne. Ceo proces konverzije — čitanje PDF-a i generisanje Word fajla — odvija se lokalno u vašem pretraživaču pomoću JavaScript-a. Vaš fajl nikada ne napušta vaš uređaj, zbog čega je bezbedno koristiti ga sa privatnim ili osetljivim dokumentima.
Koji format fajla se preuzima?
Standardni .docx fajl, kompatibilan sa Microsoft Word-om, Google Docs-om, LibreOffice Writer-om i drugim programima za obradu teksta koji podržavaju format Office Open XML.
Mogu li da konvertujem PDF zaštićen lozinkom?
Ne, trenutno ne — ovaj alat ne obrađuje šifrovane ili lozinkom zaštićene PDF fajlove. Prvo biste morali da uklonite zaštitu lozinkom pomoću PDF editora pre konverzije.