Hva er dette verktøyet?
Dette verktøyet leser tekstinnholdet på hver side i en PDF og bygger det opp igjen som rader og kolonner i en Excel-arbeidsbok, ett ark per side. Det grupperer tekst i linjer etter loddrett posisjon, og deler deretter hver linje inn i celler der det er et bredt vannrett mellomrom mellom ord — et rimelig tegn på at 'her begynner en ny kolonne', ikke bare et mellomrom.
Denne heuristikken fungerer godt for PDF-er med enkle, jevnt fordelte tabeller eller lister — fakturaer, prislister, eksporterte rapporter. Den gjenskaper ikke pålitelig komplekse oppsett med sammenslåtte celler, flerlinjet celleinnhold eller tabeller uten tydelig avstand mellom kolonnene; for slike tilfeller må du regne med å justere resultatet manuelt etter nedlasting.
Hvorfor bruke det?
- Gjør PDF-tabeller og -lister om til en redigerbar, sorterbar Excel-fil i stedet for å skrive inn data på nytt for hånd.
- Ingen registrering, ingen vannmerke, helt gratis.
- Lokalt og privat — PDF-en din lastes aldri opp til noen server.
- Ett ark per PDF-side, slik at flersidede dokumenter forblir oversiktlige.
Slik bruker du det
- Klikk på boksen, eller dra en PDF-fil over på den.
- Vent mens verktøyet trekker ut teksten og legger den ut i rader og kolonner.
- Last ned .xlsx-filen, og åpne den i Excel, Google Regneark eller en annen regnearkapp.
- Se gjennom kolonnedelingen — for komplekse tabeller kan det hende du må justere noen celler manuelt.
Eksempel
Inndata
invoice.pdf — en enkeltsidet faktura med en tabell over varelinjerResultat
invoice.xlsx — ett ark der hver fakturalinje er en rad, med kolonner for vare, antall og prisNøyaktigheten avhenger i stor grad av hvordan den opprinnelige PDF-en er satt opp — enkle tabeller med tydelige kolonneavstander konverteres problemfritt, mens tette eller uregelmessig fordelte tabeller kan kreve manuell opprydding.
Ofte stilte spørsmål
Hvorfor er noen av kolonnene mine slått sammen eller delt feil?
Dette verktøyet gjetter kolonnegrenser ut fra den vannrette avstanden mellom ord i PDF-ens underliggende tekstlag — det har ikke tilgang til PDF-ens opprinnelige tabellstruktur (de fleste PDF-er bevarer ingen). Hvis kolonnene ligger tett, eller en tabell bruker uvanlig avstand, kan gjetningen bli feil. Se gjennom resultatet, og juster manuelt om nødvendig.
Fungerer dette på skannede PDF-er?
Nei. Dette verktøyet leser tekstlaget som er innebygd i PDF-en; skannede dokumenter er bare bilder og har ingen tekst som kan trekkes ut. Kjør først et PDF OCR-verktøy for å legge til et tekstlag, og bruk deretter denne konverteren.
Blir PDF-en min lastet opp til en server?
Nei. Både tekstuttrekk og generering av Excel-filen skjer lokalt i nettleseren din ved hjelp av JavaScript. Filen din forlater aldri enheten din.
Beholder dette celleformatering, farger eller sammenslåtte celler fra den opprinnelige tabellen?
Nei. Resultatet er ren tekst lagt ut i et rutenett — skrifttyper, farger, kanter og sammenslåtte celler fra den opprinnelige PDF-en følger ikke med.