CodeKitHub
PDF eszközök

PDF átalakítása Excellé

Utolsó frissítés:

Húzzon be egy PDF-et, és cserébe egy Excel-táblázatot kap. Ez az eszköz kinyeri a szöveget az összes oldalról, és sorokba, oszlopokba rendezi, az oszlophatárokat a szavak közötti térközök alapján megbecsülve — igazán hasznos kiindulópont adatok kinyeréséhez PDF-ekből, bár összetett elrendezéseknél nem helyettesíti a valódi táblázatfelismerő szoftvereket. Minden helyben, a böngészőjében történik; a fájl soha nem kerül feltöltésre.

Note: this tool guesses column boundaries from the whitespace gaps between text on each line, and lays out each page as rows and columns in Excel. It works well on regularly-structured tables; on merged cells or irregular layouts the split can be inaccurate — review and adjust the result after downloading.

Mi ez az eszköz?

Ez az eszköz beolvassa egy PDF minden oldalának szöveges tartalmát, és sorokként és oszlopokként állítja vissza egy Excel munkafüzetben, oldalanként egy munkalapon. A szöveget függőleges pozíció alapján sorokba csoportosítja, majd minden sort ott bont cellákra, ahol a szavak között széles vízszintes rés van — ez ésszerű jelzés arra, hogy 'itt kezdődik egy új oszlop', nem csupán egy szóköz.

Ez a heurisztika jól működik egyszerű, egyenletesen elrendezett táblázatokat vagy listákat tartalmazó PDF-eknél — számláknál, árlistáknál, exportált jelentéseknél. Nem rekonstruálja megbízhatóan az összevont cellákat, többsoros cellatartalmat vagy oszlopok közötti egyértelmű térköz nélküli táblázatokat tartalmazó összetett elrendezéseket; ezeknél számítson arra, hogy letöltés után kézzel kell finomítania az eredményt.

Miért érdemes használni?

  • A PDF-ben lévő táblázatokat és listákat szerkeszthető, rendezhető Excel-fájllá alakítja, ahelyett hogy kézzel kellene újra begépelnie az adatokat.
  • Regisztráció nem szükséges, nincs vízjel, teljesen ingyenes.
  • Helyi és privát — a PDF-je soha nem kerül feltöltésre semmilyen szerverre.
  • PDF-oldalanként egy munkalap, így a többoldalas dokumentumok is átláthatók maradnak.

Használati útmutató

  1. Kattintson a mezőre, vagy húzzon rá egy PDF-fájlt.
  2. Várjon, amíg az eszköz kinyeri a szöveget, és sorokba, oszlopokba rendezi.
  3. Töltse le az .xlsx fájlt, és nyissa meg Excelben, Google Táblázatokban vagy bármely más táblázatkezelő alkalmazásban.
  4. Ellenőrizze az oszlopfelosztást — összetett táblázatoknál előfordulhat, hogy néhány cellát kézzel kell módosítania.

Példa

Bemenet

invoice.pdf — egy egyoldalas számla tételsorokat tartalmazó táblázattal

Kimenet

invoice.xlsx — egy munkalap, amelyben minden számlasor egy sor, tétel, mennyiség és ár oszlopokkal

A pontosság nagymértékben függ az eredeti PDF elrendezésétől — az egyértelmű oszlopközökkel rendelkező egyszerű táblázatok tisztán alakulnak át, míg a sűrű vagy szabálytalanul elrendezett táblázatok kézi tisztítást igényelhetnek.

Gyakori kérdések

Miért olvadt össze vagy oszlott meg helytelenül néhány oszlopom?

Ez az eszköz az oszlophatárokat a PDF szöveges rétegében lévő szavak közötti vízszintes térköz alapján becsli meg — nincs hozzáférése a PDF eredeti táblázatszerkezetéhez (a legtöbb PDF nem is őriz meg ilyet). Ha az oszlopok közel vannak egymáshoz, vagy egy táblázat szokatlan térközöket használ, a becslés téves lehet. Ellenőrizze az eredményt, és szükség esetén kézzel igazítsa ki.

Működik ez beszkennelt PDF-eken?

Nem. Ez az eszköz a PDF-be ágyazott szöveges réteget olvassa be; a beszkennelt dokumentumok csupán képek, és nincs bennük kinyerhető szöveg. Először futtasson egy PDF OCR eszközt a szöveges réteg hozzáadásához, majd használja ezt az átalakítót.

Feltöltésre kerül a PDF-em egy szerverre?

Nem. Mind a szövegkinyerés, mind az Excel-fájl létrehozása helyben, a böngészőjében történik JavaScript segítségével. A fájlja soha nem hagyja el az eszközét.

Megőrzi ez a cellák formázását, színeit vagy az eredeti táblázat összevont celláit?

Nem. A kimenet egyszerű, rácsba rendezett szöveg — az eredeti PDF betűtípusai, színei, szegélyei és összevont cellái nem kerülnek át.

Kapcsolódó eszközök