CodeKitHub
PDF-værktøjer

Konverter PDF til Excel

Senest opdateret:

Slip en PDF, og få et Excel-regneark tilbage. Værktøjet udtrækker teksten fra hver side og lægger den ud som rækker og kolonner, ved at gætte kolonneskift ud fra mellemrummet mellem ordene — et virkelig nyttigt udgangspunkt til at trække data ud af PDF'er, men ikke en erstatning for rigtig tabelgenkendelsessoftware ved komplekse layouts. Alt kører lokalt i din browser; filen bliver aldrig uploadet.

Note: this tool guesses column boundaries from the whitespace gaps between text on each line, and lays out each page as rows and columns in Excel. It works well on regularly-structured tables; on merged cells or irregular layouts the split can be inaccurate — review and adjust the result after downloading.

Hvad er dette værktøj?

Dette værktøj læser tekstindholdet på hver side i en PDF og genopbygger det som rækker og kolonner i en Excel-projektmappe, ét ark pr. side. Det grupperer tekst i linjer efter lodret position og opdeler derefter hver linje i celler, hvor der er et bredt vandret mellemrum mellem ordene — en rimelig indikator for 'her starter en ny kolonne' frem for bare et mellemrum.

Denne heuristik fungerer godt til PDF'er med simple, jævnt fordelte tabeller eller lister — fakturaer, prislister, eksporterede rapporter. Den genskaber ikke pålideligt komplekse layouts med sammenlagte celler, flerlinjet celleindhold eller tabeller uden tydelig afstand mellem kolonnerne; for dem må du forvente at skulle justere resultatet manuelt efter download.

Hvorfor bruge det?

  • Gør PDF-tabeller og -lister til en redigerbar, sorterbar Excel-fil i stedet for at skulle genindtaste data manuelt.
  • Ingen tilmelding, intet vandmærke, helt gratis.
  • Lokalt og privat — din PDF bliver aldrig uploadet til nogen server.
  • Ét ark pr. PDF-side, så flersidede dokumenter forbliver overskuelige.

Sådan bruger du det

  1. Klik på boksen, eller træk en PDF-fil hen på den.
  2. Vent, mens værktøjet udtrækker tekst og lægger den ud i rækker og kolonner.
  3. Download .xlsx-filen, og åbn den i Excel, Google Sheets eller et andet regnearksprogram.
  4. Gennemgå kolonneopdelingen — ved komplekse tabeller kan det være nødvendigt at justere nogle celler manuelt.

Eksempel

Input

invoice.pdf — en enkeltsidet faktura med en tabel over varelinjer

Output

invoice.xlsx — ét ark hvor hver fakturalinje er en række, med kolonner for vare, antal og pris

Nøjagtigheden afhænger i høj grad af, hvordan den oprindelige PDF er sat op — simple tabeller med tydelige kolonnemellemrum konverteres problemfrit, mens tætte eller uregelmæssigt fordelte tabeller kan kræve manuel oprydning.

Ofte stillede spørgsmål

Hvorfor er nogle af mine kolonner slået sammen eller delt forkert?

Værktøjet gætter kolonnegrænser ud fra den vandrette afstand mellem ord i PDF'ens underliggende tekstlag — det har ikke adgang til PDF'ens oprindelige tabelstruktur (de fleste PDF'er bevarer ingen). Hvis kolonnerne ligger tæt, eller en tabel bruger usædvanlig afstand, kan gættet være forkert. Gennemgå resultatet, og juster manuelt om nødvendigt.

Virker det på scannede PDF'er?

Nej. Værktøjet læser tekstlaget, der er indlejret i PDF'en; scannede dokumenter er blot billeder og har ingen tekst, der kan udtrækkes. Kør først et PDF OCR-værktøj for at tilføje et tekstlag, og brug derefter denne konverter.

Bliver min PDF uploadet til en server?

Nej. Både tekstudtræk og generering af Excel-filen sker lokalt i din browser ved hjælp af JavaScript. Din fil forlader aldrig din enhed.

Bevarer det celleformatering, farver eller sammenlagte celler fra den oprindelige tabel?

Nej. Resultatet er ren tekst lagt ud i et gitter — skrifttyper, farver, kanter og sammenlagte celler fra den oprindelige PDF følger ikke med.

Relaterede værktøjer