Što je ovaj alat?
Ovaj alat čita tekstualni sloj PDF-a (stvarni, označivi i kopirljivi tekst ugrađen u datoteku — ne sliku) i ponovno ga izgrađuje kao novi Word dokument, pri čemu svaki prepoznati redak postaje odlomak, a prijelom stranice umeće se između svake izvorne stranice PDF-a. Korisno je kada imate tekstualni PDF — izvještaj, članak, izvezeni dokument — i trebate kopirati, urediti ili ponovno iskoristiti tekst bez ponovnog upisivanja svega.
Iskreno, ovo je alat za izdvajanje teksta, a ne pretvarač koji čuva izgled: neće vjerno rekreirati raspored s više stupaca, tablice, zaglavlja/podnožja, određene fontove ili umetnute slike točno onako kako su izgledali u PDF-u. Ako je vaš PDF skenirana slika (fotografija ili sken bez podložnog tekstualnog sloja), ovaj alat neće pronaći tekst za izdvajanje — prvo bi vam trebao alat za OCR koji prepoznaje tekst sa slike.
Zašto ga koristiti?
- Pretvara tekst statičnog PDF-a u uredivi Word dokument u nekoliko sekundi, bez ponovnog upisivanja.
- Radi potpuno izvanmrežno u vašem pregledniku — PDF datoteka se nikada ne šalje ni na jedan poslužitelj.
- Besplatan je, bez registracije, bez ograničenja broja stranica osim onoga što vaš preglednik može obraditi.
- Iskren je u vezi svojih ograničenja: izdvaja tekst umjesto da se pretvara da savršeno rekreira izvorni izgled.
Kako ga koristiti
- Kliknite na okvir ili povucite PDF datoteku na njega.
- Pričekajte dok se tekst izdvaja i generira Word dokument.
- Kliknite gumb za preuzimanje kako biste spremili .docx datoteku.
Primjer
Ulaz
report.pdf — tekstualni dokument od 3 straniceIzlaz
report.docx — uredivi Word dokument s izdvojenim tekstom, uz očuvane prijelome stranica između izvorne 3 straniceSvaki redak teksta postaje odlomak u Word dokumentu; izvorni vizualni izgled, fontovi i sve umetnute slike se ne reproduciraju.
Često postavljana pitanja
Hoće li ovaj alat sačuvati točno oblikovanje mog PDF-a?
Ne, ne točno. Ovaj alat izdvaja tekstualni sadržaj i ponovno ga izgrađuje kao obične odlomke u novom Word dokumentu, s prijelomima stranica između izvornih stranica. Ne rekreira raspored s više stupaca, tablice, određene fontove, zaglavlja/podnožja ili umetnute slike. Ako vam treba očuvanje izgleda do piksela, ovo nije pravi alat — izrađen je za izdvajanje i uređivanje tekstualnog sadržaja.
Zašto piše da u mom PDF-u nije pronađen tekst?
To se događa kada je vaš PDF skenirana slika — u biti fotografija stranice bez podložnog označivog tekstualnog sloja, samo pikseli. Ovaj alat čita tekstualne podatke već ugrađene u PDF; ne izvodi OCR (optičko prepoznavanje znakova) za čitanje teksta sa slike. Trebat će vam alat za OCR da biste prvo pretvorili skeniranu sliku u tekst.
Šalje li se moj PDF na poslužitelj?
Ne. Cijela pretvorba — čitanje PDF-a i generiranje Word datoteke — odvija se lokalno u vašem pregledniku pomoću JavaScripta. Vaša datoteka nikada ne napušta vaš uređaj, zbog čega je sigurno koristiti je s privatnim ili osjetljivim dokumentima.
Koji se format datoteke preuzima?
Standardna .docx datoteka, kompatibilna s Microsoft Wordom, Google Docsom, LibreOffice Writerom i drugim uredskim programima koji podržavaju format Office Open XML.
Mogu li pretvoriti PDF zaštićen lozinkom?
Ne, trenutno ne — ovaj alat ne obrađuje šifrirane ili lozinkom zaštićene PDF datoteke. Prvo biste morali ukloniti zaštitu lozinkom pomoću uređivača PDF-a prije pretvorbe.