Čo je tento nástroj?
Tento nástroj číta textovú vrstvu PDF (skutočný, vybrateľný a kopírovateľný text vložený v súbore — nie obrázok) a znovu ho zostaví ako nový dokument Word, pričom každý rozpoznaný riadok sa stane odsekom a medzi jednotlivé pôvodné strany PDF sa vloží zalomenie strany. Je to užitočné, keď máte textové PDF — správu, článok, exportovaný dokument — a potrebujete text skopírovať, upraviť alebo znova použiť bez toho, aby ste všetko prepisovali.
Úprimne povedané, ide o nástroj na extrakciu textu, nie o konvertor zachovávajúci rozvrhnutie: presne neobnoví viacstĺpcové rozvrhnutia, tabuľky, hlavičky/päty, konkrétne písma ani vložené obrázky tak, ako vyzerali v PDF. Ak je vaše PDF naskenovaným obrázkom (fotografia alebo sken bez podkladovej textovej vrstvy), tento nástroj v ňom nenájde žiadny text na extrakciu — najprv by ste potrebovali nástroj OCR, ktorý text z obrázka rozpozná.
Prečo ho používať?
- Počas pár sekúnd zmení text statického PDF na upraviteľný dokument Word, bez prepisovania.
- Funguje úplne offline vo vašom prehliadači — PDF súbor sa nikdy nenahráva na žiadny server.
- Zadarmo, bez registrácie, bez obmedzenia počtu strán nad rámec toho, čo zvládne váš prehliadač.
- Úprimný ohľadom svojich limitov: extrahuje text namiesto toho, aby predstieral dokonalé obnovenie pôvodného rozvrhnutia.
Ako sa používa
- Kliknite na pole alebo naň presuňte PDF súbor.
- Počkajte, kým sa text extrahuje a vygeneruje sa dokument Word.
- Kliknutím na tlačidlo stiahnutia uložte súbor .docx.
Príklad
Vstup
report.pdf — trojstranový textový dokumentVýstup
report.docx — upraviteľný súbor Word s extrahovaným textom, so zachovanými zalomeniami strán medzi pôvodnými 3 stranamiKaždý riadok textu sa v dokumente Word stane odsekom; pôvodné vizuálne rozvrhnutie, písma a akékoľvek vložené obrázky sa nereprodukujú.
Časté otázky
Zachová tento nástroj presné formátovanie môjho PDF?
Nie, nie presne. Tento nástroj extrahuje textový obsah a znovu ho zostaví ako obyčajné odseky v novom dokumente Word, so zalomeniami strán medzi pôvodnými stranami. Neobnovuje viacstĺpcové rozvrhnutia, tabuľky, konkrétne písma, hlavičky/päty ani vložené obrázky. Ak potrebujete zachovanie rozvrhnutia na pixel presne, nie je to správny nástroj — je určený na extrakciu a úpravu textového obsahu.
Prečo sa zobrazuje, že v mojom PDF nebol nájdený žiadny text?
To sa stáva, keď je vaše PDF naskenovaným obrázkom — v podstate fotografiou strany bez podkladovej vybrateľnej textovej vrstvy, len pixely. Tento nástroj číta textové dáta, ktoré sú už v PDF vložené; nevykonáva OCR (optické rozpoznávanie znakov) na prečítanie textu z obrázka. Najprv by ste potrebovali nástroj OCR na prevod naskenovaného obrázka na text.
Nahráva sa moje PDF na server?
Nie. Celý proces konverzie — čítanie PDF a generovanie súboru Word — prebieha lokálne vo vašom prehliadači pomocou JavaScriptu. Váš súbor nikdy neopustí vaše zariadenie, takže je bezpečné ho používať aj pri súkromných či citlivých dokumentoch.
Aký formát súboru sa sťahuje?
Štandardný súbor .docx, kompatibilný s Microsoft Word, Google Docs, LibreOffice Writer a ďalšími textovými procesormi podporujúcimi formát Office Open XML.
Môžem konvertovať PDF chránené heslom?
Nie, momentálne nie — tento nástroj nezvláda šifrované ani heslom chránené PDF súbory. Pred konverziou by ste museli najprv odstrániť ochranu heslom pomocou editora PDF.