CodeKitHub
Italiano
Strumenti immagine

Da pagina del libro a testo

Trasforma la foto di una pagina di un libro in testo modificabile e ricercabile — progettato appositamente per foto reali di libri reali, non per scansioni piatte di documenti. La maggior parte degli strumenti OCR presuppone una scansione perfettamente allineata; questo strumento rileva e corregge automaticamente l’angolazione storta che si ottiene fotografando una pagina a mano, per poi riconoscere il testo. Tutto avviene nel tuo browser: né la foto né il testo estratto lasciano mai il tuo dispositivo.

Come si usa

  1. Scatta una foto della pagina del libro: cerca di inquadrare l'intera pagina, ma non preoccuparti di tenere la fotocamera perfettamente in orizzontale.
  2. Clicca sulla foto oppure trascinala nell'area di caricamento.
  3. Lascia selezionata l'opzione "Correzione automatica della distorsione" (è attiva per impostazione predefinita) e seleziona la lingua della pagina.
  4. Fai clic su "Estrai testo": lo strumento prima raddrizza l'immagine, poi riconosce il testo.
  5. Copia il risultato oppure scaricalo come file .txt.

Esempio

Input

A phone photo of an open paperback page, held at roughly a 10° angle

Risultato

Detected skew: -10.5° → text extracted with full paragraph structure preserved

Senza la fase di correzione dell'inclinazione, una foto scattata con questa angolazione perde in genere un terzo delle parole a causa di errori di lettura; correggendo prima l'angolazione, il riconoscimento torna a livelli di precisione quasi pari a quelli di uno scanner.

Che cos'è questo strumento?

Questo strumento estrae il testo da una fotografia di un libro, un libro di testo o una pagina stampata utilizzando la tecnologia OCR (riconoscimento ottico dei caratteri) che funziona interamente all’interno del browser. A differenza degli strumenti OCR basati su scanner, è stato progettato per risolvere il problema specifico delle foto scattate a mano libera: pagine fotografate con una leggera angolazione, cosa quasi inevitabile quando si tiene il telefono sopra un libro aperto invece di appoggiarlo piatto sul vetro dello scanner.

Ancor prima che il riconoscimento abbia inizio, lo strumento analizza l’immagine per rilevare esattamente di quanti gradi sia ruotata rispetto all’orizzontale, per poi raddrizzarla automaticamente. Questo singolo passaggio è più importante di quasi qualsiasi altra cosa nell’OCR basato su foto: una pagina fotografata con una deviazione di soli 10-12 gradi rispetto al piano orizzontale può far scendere la precisione di riconoscimento da oltre il 95% a meno del 70%, trasformando un testo chiaramente leggibile in un insieme di caratteri incomprensibili; la correzione della rotazione la riporta a risultati di qualità quasi pari a quelli di uno scanner.

Perché l'angolazione della foto è più importante di quanto si possa pensare

I motori OCR leggono il testo scansionando le righe di pixel alla ricerca di bande orizzontali uniformi di inchiostro: è così che distinguono una riga di testo dalla successiva. Quando una pagina è inclinata anche solo leggermente, quella che dovrebbe essere una linea orizzontale nitida di testo diventa una macchia diagonale che attraversa molte righe di pixel, e la logica di segmentazione delle righe del motore inizia a unire caratteri di righe adiacenti o a separare singoli caratteri.

Ecco perché una foto che ai tuoi occhi sembra perfettamente leggibile può comunque produrre un risultato OCR distorto: il tuo cervello compensa senza sforzo una leggera inclinazione, ma un sistema OCR “ingenuo” non è in grado di farlo. La soluzione non sta in un modello di riconoscimento più intelligente, bensì nel raddrizzare prima l’immagine: ed è esattamente ciò che fa la fase di correzione automatica di questo strumento prima ancora che il riconoscimento abbia inizio.

Casi d'uso comuni

  • Digitalizzare appunti o estratti da un libro di testo cartaceo senza doverli riscrivere a mano.
  • Estrarre un brano da un vecchio libro tascabile o da un volume della biblioteca per citarlo o consultarlo in seguito.
  • Convertire un volantino, un foglio di lavoro o un articolo stampato, ripreso con una fotografia, in testo ricercabile e modificabile.
  • Archiviazione delle pagine di un libro che si sta sfaldando o che è troppo fragile per essere scansionato in piano sul piano di scansione.

Convertitore da immagine ad arte ASCII · Contatore di parole

Ottenere i migliori risultati

  • Un'illuminazione buona e uniforme è più importante di una mano perfettamente ferma: una foto leggermente storta ma ben illuminata è migliore di una foto perfettamente dritta con un'ombra marcata sul testo.
  • Evita di puntare il flash direttamente sulle pagine lucide; il riflesso o il punto luminoso che ne deriva può rendere illeggibile il testo sottostante, indipendentemente dalla correzione dell'angolazione.
  • Adatta l'intera pagina alla cornice lasciando un po' di margine: se ritagli troppo stretto, potresti tagliare via la prima o l'ultima riga.
  • Nel caso di brani molto lunghi, è preferibile fotografare ed elaborare una pagina alla volta, anziché cercare di riprendere una doppia pagina, poiché ciò comporta una distorsione dovuta alla curvatura in corrispondenza del dorso.

Perché usarlo?

Correzione automatica dell'inclinazione: rileva e corregge le foto scattate con angolazioni storte prima del riconoscimento; questo è il fattore che incide maggiormente sulla precisione delle foto di libri scattate a mano libera.

Elaborazione completamente offline: la foto e il testo estratto non escono mai dal tuo browser — nulla viene caricato su un server.

È adatto sia alle pagine di libri vecchi, ingialliti o leggermente sbiaditi, sia alle stampe moderne ben nitide.

Supporta diverse lingue di riconoscimento (inglese, cinese, spagnolo, francese, tedesco, giapponese), consentendoti di scansionare libri in diverse lingue.

Nessun account, nessun limite di caricamento, nessun abbonamento: gratuito per tutte le pagine che ti servono.

Domande frequenti

Perché la foto del mio libro richiede un trattamento speciale invece del normale OCR?

I normali strumenti OCR vengono solitamente testati e ottimizzati su scansioni piatte e perfettamente allineate. Una pagina di libro fotografata a mano non è quasi mai perfettamente orizzontale: anche una piccola inclinazione di 8-12 gradi, normale per uno scatto a mano libera, può far crollare la precisione del riconoscimento ben al di sotto del 70%. Questo strumento misura tale inclinazione e la corregge automaticamente prima di eseguire il riconoscimento, il che fa la differenza tra un testo utilizzabile e un risultato illeggibile.

Funziona anche sulle pagine dei libri vecchi o ingiallite?

Sì — lo scolorimento delle pagine e la lieve perdita di contrasto dovuta all’invecchiamento della carta hanno, di per sé, un effetto minimo sull’accuratezza del riconoscimento. Il fattore determinante è l’angolazione della foto, non il colore della carta; pertanto, i libri tascabili vecchi e i libri di testo usati funzionano più o meno come quelli nuovi, una volta che l’immagine è stata raddrizzata.

La mia foto è stata caricata da qualche parte?

No. Sia il rilevamento della distorsione che il riconoscimento del testo vengono eseguiti interamente nel browser tramite WebAssembly: nessuna informazione relativa alla foto o al suo contenuto viene inviata ad alcun server. È persino possibile disconnettersi da Internet dopo il caricamento iniziale della pagina e il servizio continuerà a funzionare (a parte il download una tantum del motore di riconoscimento).

Posso disattivare la correzione automatica se la mia foto è già dritta?

Sì, deseleziona l'opzione "Correzione automatica della distorsione" se stai lavorando su una scansione piatta o su una foto che hai già raddrizzato: in questo modo si salta la fase di rilevamento e il riconoscimento viene eseguito leggermente più velocemente.

Perché la prima estrazione è lenta?

La prima volta che clicchi su "Estrai testo", lo strumento scarica il motore di riconoscimento OCR (poche megabyte, una sola volta; in seguito verrà memorizzato nella cache del browser). Da quel momento in poi, ogni estrazione sarà molto più veloce, poiché il motore è già caricato.

Quali lingue è in grado di riconoscere?

Nel selettore della lingua sono disponibili inglese, cinese semplificato, spagnolo, francese, tedesco e giapponese. Per ottenere la massima precisione, seleziona la lingua in cui la pagina è effettivamente stampata: la qualità del riconoscimento diminuisce notevolmente se viene selezionata una lingua errata.

Strumenti correlati