Che cos'è questo strumento?
Questo strumento legge il contenuto testuale di ogni pagina di un PDF e lo ricostruisce come righe e colonne in una cartella di lavoro Excel, con un foglio per pagina. Raggruppa il testo in righe in base alla posizione verticale, quindi divide ogni riga in celle nei punti in cui rileva un ampio spazio orizzontale tra le parole — un'approssimazione ragionevole per capire 'qui inizia una nuova colonna', non un semplice spazio.
Questa euristica funziona bene con PDF che contengono tabelle o elenchi semplici e regolarmente spaziati — fatture, listini prezzi, report esportati. Non ricostruisce in modo affidabile layout complessi con celle unite, contenuto su più righe all'interno di una cella, o tabelle senza una spaziatura chiara tra le colonne; in questi casi, dopo il download potrebbe essere necessario correggere manualmente il risultato.
Perché usarlo?
- Trasforma tabelle ed elenchi da PDF in un file Excel modificabile e ordinabile, evitando di riscrivere i dati a mano.
- Nessuna registrazione, nessuna filigrana, completamente gratuito.
- Locale e privato — il tuo PDF non viene mai caricato su alcun server.
- Un foglio per ogni pagina del PDF, così i documenti con più pagine restano organizzati.
Come si usa
- Clicca sul riquadro o trascina un file PDF al suo interno.
- Attendi mentre lo strumento estrae il testo e lo dispone in righe e colonne.
- Scarica il file .xlsx e aprilo in Excel, Google Fogli o qualsiasi altro programma per fogli di calcolo.
- Controlla la suddivisione delle colonne — per le tabelle complesse potrebbe essere necessario regolare manualmente alcune celle.
Esempio
Input
invoice.pdf — una fattura di una pagina con una tabella delle vociRisultato
invoice.xlsx — un foglio con ogni riga della fattura come una riga, con colonne per articolo, quantità e prezzoLa precisione dipende molto da come è impaginato il PDF originale — le tabelle semplici con spazi chiari tra le colonne si convertono in modo pulito, mentre le tabelle dense o con spaziatura irregolare potrebbero richiedere una pulizia manuale.
Domande frequenti
Perché alcune delle mie colonne risultano unite insieme o divise in modo errato?
Questo strumento deduce i confini delle colonne dallo spazio orizzontale tra le parole nel livello di testo sottostante del PDF — non ha accesso alla struttura originale della tabella del PDF (la maggior parte dei PDF non la conserva). Se le colonne sono vicine tra loro o una tabella usa una spaziatura insolita, la deduzione può risultare errata. Controlla il risultato e correggilo manualmente se necessario.
Funziona con i PDF scansionati?
No. Questo strumento legge il livello di testo incorporato nel PDF; i documenti scansionati sono semplici immagini e non contengono testo estraibile. Usa prima uno strumento di OCR per PDF per aggiungere un livello di testo, quindi utilizza questo convertitore.
Il mio PDF viene caricato su un server?
No. Sia l'estrazione del testo che la generazione del file Excel avvengono localmente nel tuo browser tramite JavaScript. Il tuo file non lascia mai il tuo dispositivo.
Vengono mantenuti la formattazione delle celle, i colori o le celle unite della tabella originale?
No. Il risultato è testo semplice disposto in una griglia — font, colori, bordi e celle unite del PDF originale non vengono conservati.