Πώς χρησιμοποιείται
- Τράβηξε μια φωτογραφία της σελίδας βιβλίου — προσπάθησε να χωρέσεις ολόκληρη τη σελίδα στο κάδρο, αλλά μην ανησυχείς για το να κρατάς την κάμερα τέλεια οριζόντια.
- Κάνε κλικ ή σύρε τη φωτογραφία στην περιοχή ανεβάσματος.
- Άφησε το "Αυτόματη διόρθωση κλίσης" επιλεγμένο (είναι ενεργό από προεπιλογή) και επίλεξε τη γλώσσα της σελίδας.
- Κάνε κλικ στο "Εξαγωγή κειμένου" — το εργαλείο ισιώνει πρώτα την εικόνα, μετά αναγνωρίζει το κείμενο.
- Αντέγραψε το αποτέλεσμα ή κατέβασέ το ως αρχείο .txt.
Παράδειγμα
Είσοδος
Φωτογραφία κινητού μιας ανοιχτής σελίδας χαρτόδετου βιβλίου, κρατημένη σε περίπου γωνία 10°Έξοδος
Εντοπισμένη κλίση: -10,5° → κείμενο εξήχθη με πλήρη δομή παραγράφων διατηρημένηΧωρίς το βήμα διόρθωσης κλίσης, μια φωτογραφία σε αυτή τη γωνία τυπικά χάνει το ένα τρίτο των λέξεών της σε λανθασμένες αναγνώσεις· η διόρθωση της γωνίας πρώτα επαναφέρει την αναγνώριση σε σχεδόν ακρίβεια σαρωτή.
Τι είναι αυτό το εργαλείο;
Αυτό το εργαλείο εξάγει κείμενο από φωτογραφία βιβλίου, σχολικού βιβλίου, ή τυπωμένης σελίδας χρησιμοποιώντας OCR (οπτική αναγνώριση χαρακτήρων) που τρέχει εξ ολοκλήρου μέσα στο πρόγραμμά σου περιήγησης. Σε αντίθεση με εργαλεία OCR βασισμένα σε σαρωτή, είναι φτιαγμένο γύρω από το συγκεκριμένο πρόβλημα των φωτογραφιών με το χέρι: σελίδες φωτογραφημένες σε ελαφριά γωνία, κάτι σχεδόν αναπόφευκτο όταν κρατάς ένα κινητό πάνω από ένα ανοιχτό βιβλίο αντί να το πιέζεις επίπεδα σε γυαλί σαρωτή.
Πριν καν ξεκινήσει η αναγνώριση, το εργαλείο αναλύει την εικόνα για να εντοπίσει ακριβώς πόσες μοίρες είναι περιστραμμένη από το οριζόντιο, και μετά την ισιώνει αυτόματα. Αυτό το ένα βήμα έχει μεγαλύτερη σημασία από σχεδόν οτιδήποτε άλλο για OCR βασισμένο σε φωτογραφία: μια σελίδα φωτογραφημένη σε μόλις 10-12 μοίρες εκτός επιπέδου μπορεί να ρίξει την ακρίβεια αναγνώρισης από πάνω από 95% σε κάτω από 70%, μετατρέποντας ξεκάθαρα αναγνώσιμο κείμενο σε ακατάληπτη ασυναρτησία — η αρχική διόρθωση κλίσης το επαναφέρει σε αποτελέσματα σχεδόν ποιότητας σαρωτή.
Γιατί η γωνία της φωτογραφίας έχει μεγαλύτερη σημασία απ' όσο νομίζεις
Οι μηχανές OCR διαβάζουν κείμενο σαρώνοντας σειρές pixel αναζητώντας συνεπείς οριζόντιες ζώνες μελανιού — έτσι ξεχωρίζουν μια γραμμή κειμένου από την επόμενη. Όταν μια σελίδα είναι έστω και ελαφρώς κεκλιμένη, αυτό που θα έπρεπε να είναι μια καθαρή οριζόντια γραμμή κειμένου γίνεται μια διαγώνια αμαυρωμένη λωρίδα σε πολλές σειρές pixel, και η λογική τμηματοποίησης γραμμής της μηχανής αρχίζει να συγχωνεύει χαρακτήρες από γειτονικές γραμμές ή να διαχωρίζει μεμονωμένους χαρακτήρες.
Γι' αυτό μια φωτογραφία που φαίνεται τέλεια αναγνώσιμη στα μάτια σου μπορεί ακόμα να παράγει ακατάληπτη έξοδο OCR: ο εγκέφαλός σου αντισταθμίζει αβίαστα μια ελαφριά κλίση, αλλά μια αφελής διοχέτευση OCR όχι. Η λύση δεν είναι ένα πιο έξυπνο μοντέλο αναγνώρισης — είναι το ίσιωμα της εικόνας πρώτα, ακριβώς αυτό που κάνει το βήμα αυτόματης διόρθωσης σε αυτό το εργαλείο πριν καν τρέξει η αναγνώριση.
Κοινές περιπτώσεις χρήσης
- Ψηφιοποίηση σημειώσεων ή αποσπασμάτων από φυσικό σχολικό βιβλίο χωρίς επαναπληκτρολόγησή τους με το χέρι.
- Εξαγωγή ενός αποσπάσματος από παλιό χαρτόδετο ή βιβλιοθηκονομικό βιβλίο για παράθεση ή αναζήτηση αργότερα.
- Μετατροπή φωτογραφημένου εντύπου, φύλλου εργασίας, ή τυπωμένου άρθρου σε αναζητήσιμο, επεξεργάσιμο κείμενο.
- Αρχειοθέτηση σελίδων από βιβλίο που καταρρέει ή είναι πολύ εύθραυστο για να σαρωθεί επίπεδα σε τράπεζα σαρωτή.
Πώς να πάρεις τα καλύτερα αποτελέσματα
- Καλός, ομοιόμορφος φωτισμός έχει μεγαλύτερη σημασία από ένα τέλεια σταθερό χέρι — μια ελαφρώς λοξή αλλά καλά φωτισμένη φωτογραφία ξεπερνά μια οριζόντια φωτογραφία με βαριά σκιά πάνω στο κείμενο.
- Απόφυγε απευθείας φλας σε γυαλιστερές σελίδες· η προκύπτουσα λάμψη/κάψιμο μπορεί να λευκάνει το κείμενο από κάτω του ανεξάρτητα από τη διόρθωση γωνίας.
- Χώρεσε ολόκληρη τη σελίδα στο κάδρο με λίγο περιθώριο — η υπερβολικά σφιχτή περικοπή μπορεί να κόψει την πρώτη ή τελευταία γραμμή.
- Για πολύ μεγάλα αποσπάσματα, φωτογράφισε και επεξεργάσου μία σελίδα κάθε φορά αντί να προσπαθήσεις να καταγράψεις ανοιχτή διπλή σελίδα, που εισάγει τη δική της παραμόρφωση καμπυλότητας κοντά στη ράχη.
Γιατί να το χρησιμοποιήσετε;
Αυτόματη διόρθωση κλίσης: εντοπίζει και ισιώνει λοξές γωνίες φωτογραφίας πριν την αναγνώριση, ο μεγαλύτερος παράγοντας ακρίβειας για φωτογραφίες βιβλίων με το χέρι.
Πλήρως εκτός σύνδεσης επεξεργασία: η φωτογραφία και το εξαγόμενο κείμενο δεν φεύγουν ποτέ από το πρόγραμμά σου περιήγησης — τίποτα δεν ανεβαίνει σε διακομιστή.
Λειτουργεί για παλιές, κιτρινισμένες, ή ελαφρώς ξεθωριασμένες σελίδες βιβλίου όπως και για καθαρά σύγχρονα τυπωμένα κείμενα.
Υποστηρίζει πολλαπλές γλώσσες αναγνώρισης (Αγγλικά, Κινέζικα, Ισπανικά, Γαλλικά, Γερμανικά, Ιαπωνικά) ώστε να μπορείς να σαρώνεις βιβλία σε διαφορετικές γλώσσες.
Χωρίς λογαριασμό, χωρίς όριο ανεβάσματος, χωρίς συνδρομή — δωρεάν για όσες σελίδες χρειάζεσαι.
Συχνές ερωτήσεις
Γιατί η φωτογραφία του βιβλίου μου χρειάζεται ειδικό χειρισμό αντί για κανονικό OCR;
Τα κανονικά εργαλεία OCR συνήθως δοκιμάζονται και ρυθμίζονται σε επίπεδες, τέλεια ευθυγραμμισμένες σαρώσεις. Μια σελίδα βιβλίου φωτογραφημένη με το χέρι σχεδόν ποτέ δεν είναι οριζόντια — ακόμα και μια μικρή κλίση 8-12 μοιρών, που είναι φυσιολογική για μια λήψη με το χέρι, μπορεί να ρίξει την ακρίβεια αναγνώρισης πολύ κάτω από 70%. Αυτό το εργαλείο μετρά αυτή την κλίση και τη διορθώνει αυτόματα πριν εκτελέσει την αναγνώριση, κάτι που είναι η διαφορά ανάμεσα σε χρησιμοποιήσιμο κείμενο και ακατάληπτη έξοδο.
Λειτουργεί αυτό σε παλιές ή κιτρινισμένες σελίδες βιβλίου;
Ναι — ο αποχρωματισμός σελίδας και η ήπια απώλεια αντίθεσης από γερασμένο χαρτί έχουν πολύ μικρή επίδραση στην ακρίβεια αναγνώρισης από μόνες τους. Η γωνία της φωτογραφίας είναι ο κυρίαρχος παράγοντας, όχι το χρώμα του χαρτιού, οπότε παλιά χαρτόδετα και χρησιμοποιημένα σχολικά βιβλία λειτουργούν περίπου εξίσου καλά με τα καινούρια μόλις η εικόνα ισιωθεί.
Ανεβαίνει η φωτογραφία μου πουθενά;
Όχι. Τόσο ο εντοπισμός κλίσης όσο και η αναγνώριση κειμένου τρέχουν εξ ολοκλήρου στο πρόγραμμά σου περιήγησης χρησιμοποιώντας WebAssembly — τίποτα σχετικά με τη φωτογραφία σου ή το περιεχόμενό της δεν αποστέλλεται σε κανέναν διακομιστή. Μπορείς ακόμα και να αποσυνδεθείς από το διαδίκτυο μετά την πρώτη φόρτωση της σελίδας και θα συνεχίσει να λειτουργεί (εκτός από το μονοφορικό κατέβασμα της μηχανής αναγνώρισης).
Μπορώ να απενεργοποιήσω την αυτόματη διόρθωση αν η φωτογραφία μου είναι ήδη ίσια;
Ναι, αποεπίλεξε το "Αυτόματη διόρθωση κλίσης" αν δουλεύεις με επίπεδη σάρωση ή φωτογραφία που έχεις ήδη ισιώσει — αυτό παραλείπει το βήμα εντοπισμού και τρέχει την αναγνώριση λίγο πιο γρήγορα.
Γιατί η πρώτη εξαγωγή είναι αργή;
Την πρώτη φορά που κάνεις κλικ στο "Εξαγωγή κειμένου", το εργαλείο κατεβάζει τη μηχανή αναγνώρισης OCR (μερικά megabytes, μία φορά μόνο, αποθηκεύεται στη μνήμη cache του προγράμματός σου περιήγησης μετά). Κάθε εξαγωγή μετά από αυτό είναι πολύ πιο γρήγορη αφού η μηχανή είναι ήδη φορτωμένη.
Ποιες γλώσσες μπορεί να αναγνωρίσει;
Αγγλικά, Απλοποιημένα Κινέζικα, Ισπανικά, Γαλλικά, Γερμανικά, και Ιαπωνικά είναι διαθέσιμα στον επιλογέα γλώσσας. Επίλεξε τη γλώσσα στην οποία είναι πραγματικά τυπωμένη η σελίδα για την καλύτερη ακρίβεια — η ποιότητα αναγνώρισης πέφτει απότομα αν επιλεγεί λάθος γλώσσα.