Kaj je to orodje?
To orodje prebere besedilno plast PDF-ja (dejansko, izbirljivo in kopirljivo besedilo, vdelano v datoteki — ne slike) in ga znova zgradi kot nov dokument Word, pri čemer vsaka zaznana vrstica postane odstavek, med posameznimi izvirnimi stranmi PDF-ja pa se vstavi prelom strani. Uporabno je, kadar imate besedilni PDF — poročilo, članek, izvožen dokument — in morate besedilo kopirati, urediti ali ponovno uporabiti, ne da bi vse na novo natipkali.
Iskreno povedano, gre za orodje za izvlečenje besedila, ne za pretvornik, ki ohranja postavitev: ne bo natančno obnovilo večstolpičnih postavitev, tabel, glav/nog, določenih pisav ali vdelanih slik tako, kot so bile videti v PDF-ju. Če je vaš PDF skenirana slika (fotografija ali sken brez osnovne besedilne plasti), orodje ne bo našlo nobenega besedila za izvlečenje — najprej boste potrebovali orodje OCR, ki prepozna besedilo s slike.
Zakaj ga uporabiti?
- V nekaj sekundah spremeni besedilo statičnega PDF-ja v uredljiv dokument Word, brez ponovnega tipkanja.
- Deluje popolnoma brez povezave v vašem brskalniku — datoteka PDF se nikoli ne naloži na noben strežnik.
- Brezplačno, brez registracije, brez omejitve strani, razen tega, kar zmore vaš brskalnik.
- Iskreno glede svojih omejitev: izvleče besedilo, namesto da bi se pretvarjalo, da popolnoma obnavlja izvirno postavitev.
Kako ga uporabljati
- Kliknite polje ali nanj povlecite datoteko PDF.
- Počakajte, da se besedilo izvleče in ustvari dokument Word.
- Kliknite gumb za prenos, da shranite datoteko .docx.
Primer
Vnos
report.pdf — 3-stranski besedilni dokumentRezultat
report.docx — uredljiva datoteka Word z izvlečenim besedilom, pri čemer so ohranjeni prelomi strani med izvirnimi 3 stranmiVsaka vrstica besedila postane odstavek v dokumentu Word; izvirna vizualna postavitev, pisave in morebitne vdelane slike se ne obnovijo.
Pogosta vprašanja
Ali bo to orodje ohranilo natančno oblikovanje mojega PDF-ja?
Ne, ne natančno. To orodje izvleče besedilno vsebino in jo znova zgradi kot navadne odstavke v novem dokumentu Word, s prelomi strani med izvirnimi stranmi. Ne obnovi večstolpičnih postavitev, tabel, določenih pisav, glav/nog ali vdelanih slik. Če potrebujete ohranitev postavitve, natančno do slikovne pike, to ni pravo orodje — zasnovano je za izvlečenje in urejanje besedilne vsebine.
Zakaj piše, da v mojem PDF-ju ni bilo najdenega besedila?
To se zgodi, kadar je vaš PDF skenirana slika — v bistvu fotografija strani brez osnovne izbirljive besedilne plasti, le slikovne pike. To orodje prebere besedilne podatke, ki so že vdelani v PDF-ju; ne izvaja OCR (optičnega prepoznavanja znakov) za branje besedila s slike. Najprej boste potrebovali orodje OCR, da skenirano sliko pretvorite v besedilo.
Ali se moj PDF naloži v strežnik?
Ne. Celoten postopek pretvorbe — branje PDF-ja in ustvarjanje datoteke Word — poteka lokalno v vašem brskalniku s pomočjo JavaScripta. Vaša datoteka nikoli ne zapusti vaše naprave, zaradi česar je varna za uporabo z zasebnimi ali občutljivimi dokumenti.
Kateri format datoteke se prenese?
Standardna datoteka .docx, združljiva s programi Microsoft Word, Google Docs, LibreOffice Writer in drugimi urejevalniki besedil, ki podpirajo format Office Open XML.
Ali lahko pretvorim PDF, zaščiten z geslom?
Ne, trenutno ne — to orodje ne obravnava šifriranih ali z geslom zaščitenih datotek PDF. Pred pretvorbo boste morali najprej odstraniti zaščito z geslom z urejevalnikom PDF.