Što je ovaj alat?
Ovaj alat čita tekstualni sadržaj svake stranice PDF-a i rekonstruira ga kao retke i stupce u Excel radnoj knjizi, po jedan list za svaku stranicu. Grupira tekst u retke prema okomitom položaju, a zatim svaki redak dijeli u ćelije ondje gdje postoji širok vodoravni razmak između riječi — razuman pokazatelj da 'ovdje počinje novi stupac', a ne samo razmak.
Ova heuristika dobro funkcionira za PDF-ove s jednostavnim, ravnomjerno raspoređenim tablicama ili popisima — računima, cjenicima, izvezenim izvještajima. Ne rekonstruira pouzdano složene rasporede sa spojenim ćelijama, višerednim sadržajem ćelija ili tablicama bez jasnih razmaka između stupaca; za takve slučajeve očekujte da ćete rezultat nakon preuzimanja morati ručno doraditi.
Zašto ga koristiti?
- Pretvara tablice i popise iz PDF-a u uredivu, sortirajuću Excel datoteku, umjesto ručnog ponovnog upisivanja podataka.
- Bez registracije, bez vodenog žiga, potpuno besplatno.
- Lokalno i privatno — vaš PDF se nikada ne prenosi na bilo koji poslužitelj.
- Jedan list za svaku stranicu PDF-a, tako da višestranični dokumenti ostaju uredno organizirani.
Kako ga koristiti
- Kliknite na okvir ili povucite PDF datoteku na njega.
- Pričekajte dok alat izdvaja tekst i raspoređuje ga u retke i stupce.
- Preuzmite .xlsx datoteku i otvorite je u Excelu, Google tablicama ili bilo kojoj drugoj aplikaciji za tablice.
- Provjerite podjelu stupaca — kod složenijih tablica možda ćete morati ručno prilagoditi nekoliko ćelija.
Primjer
Ulaz
invoice.pdf — jednostranični račun s tablicom stavkiIzlaz
invoice.xlsx — jedan list na kojem je svaka stavka računa zaseban redak, sa stupcima za artikl, količinu i cijenuTočnost uvelike ovisi o rasporedu izvornog PDF-a — jednostavne tablice s jasnim razmacima između stupaca pretvaraju se besprijekorno, dok guste ili nepravilno raspoređene tablice mogu zahtijevati ručno čišćenje.
Često postavljana pitanja
Zašto su neki od mojih stupaca spojeni ili pogrešno podijeljeni?
Ovaj alat pogađa granice stupaca na temelju vodoravnog razmaka između riječi u tekstualnom sloju PDF-a — nema pristup izvornoj strukturi tablice u PDF-u (većina PDF-ova takvu strukturu i ne čuva). Ako su stupci blizu jedni drugima ili tablica koristi neobične razmake, pogađanje može biti pogrešno. Pregledajte rezultat i ručno ga prilagodite ako je potrebno.
Radi li ovo na skeniranim PDF-ovima?
Ne. Ovaj alat čita tekstualni sloj ugrađen u PDF; skenirani dokumenti su samo slike i nemaju tekst koji se može izdvojiti. Prvo pokrenite alat za OCR PDF-a kako biste dodali tekstualni sloj, a zatim upotrijebite ovaj pretvarač.
Prenosi li se moj PDF na poslužitelj?
Ne. I izdvajanje teksta i generiranje Excel datoteke odvijaju se lokalno u vašem pregledniku pomoću JavaScripta. Vaša datoteka nikada ne napušta vaš uređaj.
Hoće li ovo sačuvati formatiranje ćelija, boje ili spojene ćelije iz izvorne tablice?
Ne. Rezultat je obični tekst raspoređen u mrežu — fontovi, boje, obrubi i spojene ćelije iz izvornog PDF-a se ne prenose.