Wat is deze tool?
Deze tool leest de tekstinhoud van elke pagina in een PDF en reconstrueert die als rijen en kolommen in een Excel-werkmap, één werkblad per pagina. De tekst wordt op verticale positie in regels gegroepeerd, waarna elke regel wordt opgesplitst in cellen op plekken met een brede horizontale ruimte tussen woorden — een redelijke aanwijzing dat 'hier begint een nieuwe kolom', in plaats van gewoon een spatie.
Deze heuristiek werkt goed bij PDF's met eenvoudige, gelijkmatig verdeelde tabellen of lijsten — facturen, prijslijsten, geëxporteerde rapporten. Ze reconstrueert complexe lay-outs met samengevoegde cellen, meerregelige celinhoud of tabellen zonder duidelijke ruimte tussen kolommen niet betrouwbaar; verwacht in die gevallen dat je het resultaat na het downloaden handmatig moet aanpassen.
Waarom gebruiken?
- Zet PDF-tabellen en -lijsten om in een bewerkbaar, sorteerbaar Excel-bestand, in plaats van gegevens handmatig over te typen.
- Geen aanmelding, geen watermerk, volledig gratis.
- Lokaal en privé — je PDF wordt nooit naar een server geüpload.
- Eén werkblad per PDF-pagina, zodat documenten met meerdere pagina's overzichtelijk blijven.
Hoe te gebruiken
- Klik op het vak of sleep er een PDF-bestand naartoe.
- Wacht terwijl de tool de tekst extraheert en indeelt in rijen en kolommen.
- Download het .xlsx-bestand en open het in Excel, Google Spreadsheets of een andere spreadsheettoepassing.
- Controleer de kolomindeling — bij complexe tabellen moet je mogelijk enkele cellen handmatig aanpassen.
Voorbeeld
Invoer
invoice.pdf — een factuur van één pagina met een tabel met regelitemsUitvoer
invoice.xlsx — één werkblad waarin elke factuurregel een rij is, met kolommen voor artikel, aantal en prijsDe nauwkeurigheid hangt sterk af van de lay-out van de oorspronkelijke PDF — eenvoudige tabellen met duidelijke ruimte tussen kolommen converteren netjes, terwijl dichte of onregelmatig ingedeelde tabellen mogelijk handmatig moeten worden opgeschoond.
Veelgestelde vragen
Waarom zijn sommige van mijn kolommen samengevoegd of verkeerd gesplitst?
Deze tool raadt kolomgrenzen op basis van de horizontale ruimte tussen woorden in de onderliggende tekstlaag van de PDF — hij heeft geen toegang tot de oorspronkelijke tabelstructuur van de PDF (de meeste PDF's bewaren die ook niet). Als kolommen dicht bij elkaar staan of een tabel ongebruikelijke afstanden gebruikt, kan de inschatting fout zijn. Controleer het resultaat en pas het zo nodig handmatig aan.
Werkt dit met gescande PDF's?
Nee. Deze tool leest de tekstlaag die in de PDF is ingebed; gescande documenten zijn alleen afbeeldingen en bevatten geen tekst die kan worden geëxtraheerd. Gebruik eerst een PDF OCR-tool om een tekstlaag toe te voegen en gebruik daarna deze converter.
Wordt mijn PDF naar een server geüpload?
Nee. Zowel het extraheren van tekst als het genereren van het Excel-bestand gebeurt lokaal in je browser met JavaScript. Je bestand verlaat nooit je apparaat.
Blijven celopmaak, kleuren of samengevoegde cellen uit de oorspronkelijke tabel behouden?
Nee. De uitvoer is platte tekst in een raster — lettertypen, kleuren, randen en samengevoegde cellen uit de oorspronkelijke PDF worden niet overgenomen.