Kaj je to orodje?
To orodje prebere besedilno vsebino vsake strani v PDF-ju in jo znova sestavi kot vrstice in stolpce v Excelovem delovnem zvezku, en delovni list na stran. Besedilo razvrsti v vrstice glede na navpični položaj, nato pa vsako vrstico razdeli na celice tam, kjer je med besedami širša vodoravna vrzel — razumen znak, da se 'tu začne nov stolpec', ne le presledek.
Ta hevristika dobro deluje pri PDF-jih s preprostimi, enakomerno razporejenimi tabelami ali seznami — računi, ceniki, izvoženimi poročili. Zanesljivo pa ne obnovi zapletenih postavitev z združenimi celicami, večvrstično vsebino celic ali tabelami brez jasnih razmikov med stolpci; v takih primerih lahko po prenosu pričakujete, da boste morali rezultat ročno prilagoditi.
Zakaj ga uporabiti?
- Spremeni tabele in sezname iz PDF-ja v urejljivo, razvrstljivo datoteko Excel, namesto ročnega ponovnega vnašanja podatkov.
- Brez prijave, brez vodnega žiga, popolnoma brezplačno.
- Lokalno in zasebno — vaš PDF se nikoli ne naloži na noben strežnik.
- En delovni list za vsako stran PDF-ja, tako da večstranski dokumenti ostanejo urejeni.
Kako ga uporabljati
- Kliknite na polje ali nanj povlecite datoteko PDF.
- Počakajte, da orodje izvleče besedilo in ga razporedi v vrstice in stolpce.
- Prenesite datoteko .xlsx in jo odprite v Excelu, Google Preglednicah ali kateri koli drugi aplikaciji za preglednice.
- Preglejte delitev na stolpce — pri zapletenih tabelah boste morda morali nekaj celic ročno prilagoditi.
Primer
Vnos
invoice.pdf — enostranski račun s tabelo postavkRezultat
invoice.xlsx — en delovni list, kjer je vsaka vrstica računa svoja vrstica, s stolpci za izdelek, količino in cenoNatančnost je zelo odvisna od postavitve izvirnega PDF-ja — preproste tabele z jasnimi razmiki med stolpci se pretvorijo čisto, gostejše ali neenakomerno razporejene tabele pa lahko zahtevajo ročno čiščenje.
Pogosta vprašanja
Zakaj so nekateri moji stolpci združeni ali napačno razdeljeni?
To orodje meje stolpcev ugiba na podlagi vodoravnega razmika med besedami v osnovni besedilni plasti PDF-ja — nima dostopa do izvirne strukture tabele v PDF-ju (večina PDF-jev je sploh ne ohrani). Če so stolpci blizu skupaj ali tabela uporablja nenavadne razmike, je lahko ugibanje napačno. Preglejte rezultat in ga po potrebi ročno prilagodite.
Ali to deluje na skeniranih PDF-jih?
Ne. To orodje bere besedilno plast, vgrajeno v PDF; skenirani dokumenti so zgolj slike in nimajo besedila, ki bi ga bilo mogoče izvleči. Najprej zaženite orodje za OCR PDF-ja, da dodate besedilno plast, nato pa uporabite ta pretvornik.
Ali se moj PDF naloži na strežnik?
Ne. Tako izvlečenje besedila kot ustvarjanje datoteke Excel potekata lokalno v vašem brskalniku s pomočjo JavaScripta. Vaša datoteka nikoli ne zapusti vaše naprave.
Ali to ohrani oblikovanje celic, barve ali združene celice iz izvirne tabele?
Ne. Rezultat je navadno besedilo, razporejeno v mrežo — pisave, barve, obrobe in združene celice iz izvirnega PDF-ja se ne prenesejo.