CodeKitHub
PDF nástroje

Převést PDF do Excelu

Naposledy aktualizováno:

Vložte PDF a získáte zpět tabulku Excel. Tento nástroj extrahuje text z každé stránky a rozloží ho do řádků a sloupců, přičemž hranice sloupců odhaduje podle mezer mezi slovy — je to skutečně užitečný výchozí bod pro získávání dat z PDF, i když nenahrazuje pořádný software na rozpoznávání tabulek u složitých rozvržení. Vše probíhá lokálně ve vašem prohlížeči; soubor se nikam nenahrává.

Note: this tool guesses column boundaries from the whitespace gaps between text on each line, and lays out each page as rows and columns in Excel. It works well on regularly-structured tables; on merged cells or irregular layouts the split can be inaccurate — review and adjust the result after downloading.

Co je tento nástroj?

Tento nástroj načte textový obsah každé stránky PDF a znovu ho sestaví jako řádky a sloupce v sešitu Excel, jeden list na stránku. Text seskupuje do řádků podle svislé pozice a poté každý řádek rozdělí na buňky tam, kde je mezi slovy širší vodorovná mezera — což je rozumný signál, že 'tady začíná nový sloupec', a ne jen obyčejná mezera.

Tato heuristika funguje dobře u PDF s jednoduchými, pravidelně rozloženými tabulkami nebo seznamy — faktury, ceníky, exportované reporty. Spolehlivě nerekonstruuje složitá rozvržení se sloučenými buňkami, víceřádkovým obsahem buněk nebo tabulkami bez jasných mezer mezi sloupci; u nich počítejte s tím, že výsledek po stažení ručně doladíte.

Proč ho používat?

  • Změní tabulky a seznamy z PDF v editovatelný a řaditelný Excel soubor, místo ručního přepisování dat.
  • Žádná registrace, žádný vodoznak, zcela zdarma.
  • Lokální a soukromé — vaše PDF se nikdy nenahrává na žádný server.
  • Jeden list na každou stránku PDF, takže vícestránkové dokumenty zůstávají přehledné.

Jak se používá

  1. Klikněte na pole nebo na něj přetáhněte PDF soubor.
  2. Počkejte, než nástroj extrahuje text a rozloží ho do řádků a sloupců.
  3. Stáhněte soubor .xlsx a otevřete ho v Excelu, Google Sheets nebo jiné tabulkové aplikaci.
  4. Zkontrolujte rozdělení sloupců — u složitějších tabulek možná bude nutné ručně upravit několik buněk.

Příklad

Vstup

invoice.pdf — jednostránková faktura s tabulkou položek

Výstup

invoice.xlsx — jeden list, kde je každá položka faktury samostatný řádek se sloupci pro položku, množství a cenu

Přesnost silně závisí na rozvržení původního PDF — jednoduché tabulky s jasnými mezerami mezi sloupci se převedou bez problémů, zatímco husté nebo nepravidelně rozložené tabulky mohou vyžadovat ruční dočištění.

Časté dotazy

Proč jsou některé mé sloupce spojené dohromady nebo špatně rozdělené?

Tento nástroj odhaduje hranice sloupců podle vodorovných mezer mezi slovy v textové vrstvě PDF — nemá přístup k původní struktuře tabulky v PDF (většina PDF ji ani neuchovává). Pokud jsou sloupce blízko sebe nebo tabulka používá neobvyklé mezery, odhad může být špatný. Zkontrolujte výsledek a v případě potřeby ho ručně upravte.

Funguje to i na naskenovaná PDF?

Ne. Tento nástroj čte textovou vrstvu vloženou v PDF; naskenované dokumenty jsou pouze obrázky a neobsahují žádný extrahovatelný text. Nejprve použijte nástroj na OCR PDF, který přidá textovou vrstvu, a poté použijte tento převodník.

Nahrává se moje PDF na server?

Ne. Extrakce textu i generování Excel souboru probíhá lokálně ve vašem prohlížeči pomocí JavaScriptu. Váš soubor nikdy neopustí vaše zařízení.

Zachová se formátování buněk, barvy nebo sloučené buňky z původní tabulky?

Ne. Výstupem je prostý text uspořádaný do mřížky — písma, barvy, ohraničení a sloučené buňky z původního PDF se nepřenášejí.

Související nástroje