Co je tento nástroj?
Tento nástroj načte textový obsah každé stránky PDF a znovu ho sestaví jako řádky a sloupce v sešitu Excel, jeden list na stránku. Text seskupuje do řádků podle svislé pozice a poté každý řádek rozdělí na buňky tam, kde je mezi slovy širší vodorovná mezera — což je rozumný signál, že 'tady začíná nový sloupec', a ne jen obyčejná mezera.
Tato heuristika funguje dobře u PDF s jednoduchými, pravidelně rozloženými tabulkami nebo seznamy — faktury, ceníky, exportované reporty. Spolehlivě nerekonstruuje složitá rozvržení se sloučenými buňkami, víceřádkovým obsahem buněk nebo tabulkami bez jasných mezer mezi sloupci; u nich počítejte s tím, že výsledek po stažení ručně doladíte.
Proč ho používat?
- Změní tabulky a seznamy z PDF v editovatelný a řaditelný Excel soubor, místo ručního přepisování dat.
- Žádná registrace, žádný vodoznak, zcela zdarma.
- Lokální a soukromé — vaše PDF se nikdy nenahrává na žádný server.
- Jeden list na každou stránku PDF, takže vícestránkové dokumenty zůstávají přehledné.
Jak se používá
- Klikněte na pole nebo na něj přetáhněte PDF soubor.
- Počkejte, než nástroj extrahuje text a rozloží ho do řádků a sloupců.
- Stáhněte soubor .xlsx a otevřete ho v Excelu, Google Sheets nebo jiné tabulkové aplikaci.
- Zkontrolujte rozdělení sloupců — u složitějších tabulek možná bude nutné ručně upravit několik buněk.
Příklad
Vstup
invoice.pdf — jednostránková faktura s tabulkou položekVýstup
invoice.xlsx — jeden list, kde je každá položka faktury samostatný řádek se sloupci pro položku, množství a cenuPřesnost silně závisí na rozvržení původního PDF — jednoduché tabulky s jasnými mezerami mezi sloupci se převedou bez problémů, zatímco husté nebo nepravidelně rozložené tabulky mohou vyžadovat ruční dočištění.
Časté dotazy
Proč jsou některé mé sloupce spojené dohromady nebo špatně rozdělené?
Tento nástroj odhaduje hranice sloupců podle vodorovných mezer mezi slovy v textové vrstvě PDF — nemá přístup k původní struktuře tabulky v PDF (většina PDF ji ani neuchovává). Pokud jsou sloupce blízko sebe nebo tabulka používá neobvyklé mezery, odhad může být špatný. Zkontrolujte výsledek a v případě potřeby ho ručně upravte.
Funguje to i na naskenovaná PDF?
Ne. Tento nástroj čte textovou vrstvu vloženou v PDF; naskenované dokumenty jsou pouze obrázky a neobsahují žádný extrahovatelný text. Nejprve použijte nástroj na OCR PDF, který přidá textovou vrstvu, a poté použijte tento převodník.
Nahrává se moje PDF na server?
Ne. Extrakce textu i generování Excel souboru probíhá lokálně ve vašem prohlížeči pomocí JavaScriptu. Váš soubor nikdy neopustí vaše zařízení.
Zachová se formátování buněk, barvy nebo sloučené buňky z původní tabulky?
Ne. Výstupem je prostý text uspořádaný do mřížky — písma, barvy, ohraničení a sloučené buňky z původního PDF se nepřenášejí.