Hvad er dette værktøj?
Dette værktøj læser tekstindholdet på hver side i en PDF og genopbygger det som rækker og kolonner i en Excel-projektmappe, ét ark pr. side. Det grupperer tekst i linjer efter lodret position og opdeler derefter hver linje i celler, hvor der er et bredt vandret mellemrum mellem ordene — en rimelig indikator for 'her starter en ny kolonne' frem for bare et mellemrum.
Denne heuristik fungerer godt til PDF'er med simple, jævnt fordelte tabeller eller lister — fakturaer, prislister, eksporterede rapporter. Den genskaber ikke pålideligt komplekse layouts med sammenlagte celler, flerlinjet celleindhold eller tabeller uden tydelig afstand mellem kolonnerne; for dem må du forvente at skulle justere resultatet manuelt efter download.
Hvorfor bruge det?
- Gør PDF-tabeller og -lister til en redigerbar, sorterbar Excel-fil i stedet for at skulle genindtaste data manuelt.
- Ingen tilmelding, intet vandmærke, helt gratis.
- Lokalt og privat — din PDF bliver aldrig uploadet til nogen server.
- Ét ark pr. PDF-side, så flersidede dokumenter forbliver overskuelige.
Sådan bruger du det
- Klik på boksen, eller træk en PDF-fil hen på den.
- Vent, mens værktøjet udtrækker tekst og lægger den ud i rækker og kolonner.
- Download .xlsx-filen, og åbn den i Excel, Google Sheets eller et andet regnearksprogram.
- Gennemgå kolonneopdelingen — ved komplekse tabeller kan det være nødvendigt at justere nogle celler manuelt.
Eksempel
Input
invoice.pdf — en enkeltsidet faktura med en tabel over varelinjerOutput
invoice.xlsx — ét ark hvor hver fakturalinje er en række, med kolonner for vare, antal og prisNøjagtigheden afhænger i høj grad af, hvordan den oprindelige PDF er sat op — simple tabeller med tydelige kolonnemellemrum konverteres problemfrit, mens tætte eller uregelmæssigt fordelte tabeller kan kræve manuel oprydning.
Ofte stillede spørgsmål
Hvorfor er nogle af mine kolonner slået sammen eller delt forkert?
Værktøjet gætter kolonnegrænser ud fra den vandrette afstand mellem ord i PDF'ens underliggende tekstlag — det har ikke adgang til PDF'ens oprindelige tabelstruktur (de fleste PDF'er bevarer ingen). Hvis kolonnerne ligger tæt, eller en tabel bruger usædvanlig afstand, kan gættet være forkert. Gennemgå resultatet, og juster manuelt om nødvendigt.
Virker det på scannede PDF'er?
Nej. Værktøjet læser tekstlaget, der er indlejret i PDF'en; scannede dokumenter er blot billeder og har ingen tekst, der kan udtrækkes. Kør først et PDF OCR-værktøj for at tilføje et tekstlag, og brug derefter denne konverter.
Bliver min PDF uploadet til en server?
Nej. Både tekstudtræk og generering af Excel-filen sker lokalt i din browser ved hjælp af JavaScript. Din fil forlader aldrig din enhed.
Bevarer det celleformatering, farver eller sammenlagte celler fra den oprindelige tabel?
Nej. Resultatet er ren tekst lagt ud i et gitter — skrifttyper, farver, kanter og sammenlagte celler fra den oprindelige PDF følger ikke med.