Vad är detta verktyg?
Det här verktyget läser textinnehållet på varje sida i en PDF och återskapar det som rader och kolumner i en Excel-arbetsbok, ett blad per sida. Det grupperar text i rader utifrån vertikal position och delar sedan upp varje rad i celler där det finns ett brett horisontellt mellanrum mellan orden — en rimlig indikation på att 'här börjar en ny kolumn', inte bara ett vanligt mellanslag.
Den här heuristiken fungerar bra för PDF-filer med enkla, jämnt fördelade tabeller eller listor — fakturor, prislistor, exporterade rapporter. Den återskapar inte tillförlitligt komplexa layouter med sammanslagna celler, flerradigt cellinnehåll eller tabeller utan tydliga mellanrum mellan kolumnerna; för sådana kan du förvänta dig att behöva justera resultatet manuellt efter nedladdning.
Varför använda det?
- Förvandlar PDF-tabeller och -listor till en redigerbar, sorterbar Excel-fil i stället för att skriva om data för hand.
- Ingen registrering, inget vattenstämpel, helt gratis.
- Lokalt och privat — din PDF laddas aldrig upp till någon server.
- Ett blad per PDF-sida, så att flersidiga dokument förblir organiserade.
Så använder du det
- Klicka på rutan eller dra en PDF-fil till den.
- Vänta medan verktyget extraherar texten och lägger upp den i rader och kolumner.
- Ladda ner .xlsx-filen och öppna den i Excel, Google Kalkylark eller valfri annan kalkylbladsapp.
- Granska kolumnuppdelningen — för komplexa tabeller kan du behöva justera några celler manuellt.
Exempel
Inmatning
invoice.pdf — en enkelsidig faktura med en tabell över radposterResultat
invoice.xlsx — ett blad där varje fakturarad är en rad, med kolumner för artikel, antal och prisNoggrannheten beror till stor del på hur den ursprungliga PDF-filen är utformad — enkla tabeller med tydliga kolumnmellanrum konverteras rent, medan täta eller oregelbundet fördelade tabeller kan behöva manuell uppstädning.
Vanliga frågor
Varför är några av mina kolumner sammanslagna eller felaktigt uppdelade?
Det här verktyget gissar kolumngränser utifrån det horisontella mellanrummet mellan ord i PDF-filens underliggande textlager — det har inte tillgång till PDF-filens ursprungliga tabellstruktur (de flesta PDF-filer bevarar ingen sådan). Om kolumnerna ligger nära varandra eller en tabell använder ovanliga mellanrum kan gissningen bli fel. Granska resultatet och justera manuellt vid behov.
Fungerar det här på skannade PDF-filer?
Nej. Det här verktyget läser textlagret som är inbäddat i PDF-filen; skannade dokument är bara bilder och har ingen text som kan extraheras. Kör först ett PDF OCR-verktyg för att lägga till ett textlager, och använd sedan den här konverteraren.
Laddas min PDF upp till en server?
Nej. Både textextraktion och generering av Excel-filen sker lokalt i din webbläsare med JavaScript. Din fil lämnar aldrig din enhet.
Bevaras cellformatering, färger eller sammanslagna celler från den ursprungliga tabellen?
Nej. Utdata är ren text upplagd i ett rutnät — teckensnitt, färger, kantlinjer och sammanslagna celler från den ursprungliga PDF-filen förs inte över.