CodeKitHub
Slikovna orodja

Stran knjige v besedilo

Nazadnje posodobljeno:

Spremeni fotografijo strani knjige v urejljivo, iskalno besedilo — zgrajeno posebej za prave fotografije pravih knjig, ne ploske dokumentne skene. Večina orodij za OCR predvideva popolnoma poravnan sken; to orodje samodejno zazna in popravi poševen kot, ki nastane, ko stran fotografiraš iz roke, nato pa prepozna besedilo. Vse poteka v tvojem brskalniku: fotografija in izluščeno besedilo nikoli ne zapustita tvoje naprave.

Kako ga uporabljati

  1. Fotografiraj stran knjige — poskusi ujeti celo stran v okvir, a se ni treba obremenjevati s popolnoma poravnano roko.
  2. Klikni ali povleci fotografijo v območje za nalaganje.
  3. Pusti "Samodejni popravek poševnosti" obkljukan (privzeto vklopljen) in izberi jezik strani.
  4. Klikni "Izlušči besedilo" — orodje najprej poravna sliko, nato prepozna besedilo.
  5. Kopiraj rezultat ali ga prenesi kot datoteko .txt.

Primer

Vnos

Fotografija odprte strani žepnice s telefonom, posneta pod približno 10-stopinjskim kotom

Rezultat

Zaznana poševnost: -10,5° → besedilo izluščeno z ohranjeno celotno strukturo odstavkov

Brez koraka poravnave fotografija pod tem kotom navadno izgubi tretjino besed zaradi napačnega branja; s popravkom kota se prepoznavanje vrne skoraj na natančnost skenerja.

Kaj je to orodje?

To orodje izlušči besedilo iz fotografije knjige, učbenika ali natisnjene strani z OCR (optičnim prepoznavanjem znakov), ki poteka v celoti znotraj tvojega brskalnika. Za razliko od orodij OCR, zasnovanih za skenerje, je zgrajeno okoli specifičnega problema fotografij iz roke: strani, fotografirane pod rahlim kotom, kar je skoraj neizogibno, ko telefon držiš nad odprto knjigo namesto da bi jo poravnano pritisnil na stekleno površino skenerja.

Preden se prepoznavanje sploh začne, orodje analizira sliko, zazna, za koliko stopinj je zasukana od vodoravnice, in jo samodejno poravna. Prav ta korak je pomembnejši od skoraj vsega drugega za OCR na podlagi fotografij: stran, fotografirana pod le 10-12 stopinjami poševnosti, lahko natančnost prepoznavanja zniža z več kot 95 % na pod 70 %, s tem pa jasno berljivo besedilo spremeni v nesmisel — poravnava pred obdelavo to povrne v skoraj sken-kakovosten rezultat.

Zakaj je kot fotografije pomembnejši, kot bi mislil

Mehanizmi OCR berejo besedilo tako, da skenirajo vrstice slikovnih pik in iščejo dosledne vodoravne pasove črnila — tako ločijo eno vrstico besedila od naslednje. Ko je stran čeprav rahlo nagnjena, se to, kar bi moralo biti čista vodoravna vrstica besedila, spremeni v diagonalen razmaz čez veliko vrstic slikovnih pik, logika za segmentacijo vrstic pri mehanizmu pa začne mešati znake iz sosednjih vrstic ali deliti posamezne znake narazen.

Zato lahko fotografija, ki je za tvoje oči videti popolnoma berljiva, kljub temu da nerazumljiv izpis OCR: tvoji možgani brez truda kompenzirajo rahel nagib, preprost cevovod OCR pa ne. Rešitev ni pametnejši model prepoznavanja — je poravnava slike vnaprej, kar natanko naredi korak samodejnega popravka v tem orodju, preden se prepoznavanje sploh izvede.

Pogosti primeri uporabe

  • Digitalizacija zapiskov ali odlomkov iz fizičnega učbenika brez ponovnega tipkanja z roko.
  • Izluščanje odlomka iz stare žepnice ali knjižnične knjige za citiranje ali kasnejše iskanje.
  • Pretvorba fotografiranega gradiva, delovnega lista ali natisnjenega članka v iskalno, urejljivo besedilo.
  • Arhiviranje strani knjige, ki razpada ali je preveč krhka, da bi jo ploskо skeniral na skenerju.

Pretvornik slike v ASCII umetnost · Števec besed

Kako doseči najboljše rezultate

  • Dobra, enakomerna osvetlitev je pomembnejša od popolnoma mirne roke — rahlo poševna, a dobro osvetljena fotografija je boljša od poravnane fotografije z močno senco čez besedilo.
  • Izogibaj se neposrednemu bliskavici na sijočih straneh; posledičen odsev/svetla lisa lahko izbriše besedilo pod njim ne glede na popravek kota.
  • Ujemi celo stran v okvir z malo roba — pretesno obrezovanje lahko odreže prvo ali zadnjo vrstico.
  • Za zelo dolge odlomke fotografiraj in obdelaj eno stran naenkrat, namesto da poskušaš zajeti dvostransko razprtje, kar vnese lastno popačenje ukrivljenosti blizu hrbta knjige.

Zakaj ga uporabiti?

Samodejni popravek poševnosti: zazna in poravna poševne kote fotografije pred prepoznavanjem, kar je posamezni najpomembnejši dejavnik natančnosti za fotografije knjig iz roke.

Popolnoma brez povezave: fotografija in izluščeno besedilo nikoli ne zapustita tvojega brskalnika — nič se ne nalaga na strežnik.

Deluje za stare, porumenele ali rahlo zbledele strani knjig kot tudi za oster sodoben tisk.

Podpira več jezikov za prepoznavanje (angleščina, kitajščina, španščina, francoščina, nemščina, japonščina), tako da lahko skeniraš knjige v različnih jezikih.

Brez računa, brez omejitve nalaganj, brez naročnine — brezplačno za toliko strani, kolikor jih potrebuješ.

Pogosta vprašanja

Zakaj moja fotografija strani knjige potrebuje posebno obravnavo namesto navadnega OCR?

Navadna orodja OCR so navadno testirana in prilagojena na ploske, popolnoma poravnane skene. Stran knjige, fotografirana iz roke, skoraj nikoli ni poravnana — celo majhen nagib 8-12 stopinj, ki je za posnetek iz roke normalen, lahko podre natančnost prepoznavanja daleč pod 70 %. To orodje izmeri ta nagib in ga samodejno popravi pred prepoznavanjem, kar je razlika med uporabnim besedilom in nerazumljivim izpisom.

Ali to deluje na starih ali porumenelih straneh knjig?

Da — razbarvanost strani in blaga izguba kontrasta zaradi staranja papirja same po sebi zelo malo vplivata na natančnost prepoznavanja. Kot fotografije je prevladujoč dejavnik, ne barva papirja, zato stare žepnice in rabljeni učbeniki delujejo približno enako dobro kot novi, ko je slika enkrat poravnana.

Ali se moja fotografija kje nalaga?

Ne. Tako zaznavanje poševnosti kot prepoznavanje besedila potekata v celoti v tvojem brskalniku z WebAssembly — nič o tvoji fotografiji ali njeni vsebini se ne pošilja na noben strežnik. Po prvem nalaganju strani se lahko celo odklopiš od interneta, orodje pa bo še naprej delovalo (razen enkratnega prenosa mehanizma za prepoznavanje).

Ali lahko izklopim samodejni popravek, če je moja fotografija že poravnana?

Da, odkljukaj "Samodejni popravek poševnosti", če delaš s ploskim skenom ali fotografijo, ki si jo že poravnal — to preskoči korak zaznavanja in prepoznavanje izvede nekoliko hitreje.

Zakaj je prvo luščenje počasno?

Ob prvem kliku na "Izlušči besedilo" orodje prenese mehanizem za prepoznavanje OCR (nekaj megabajtov, enkratno, kasneje shranjeno v predpomnilniku tvojega brskalnika). Vsako naslednje luščenje je veliko hitrejše, ker je mehanizem že naložen.

Katere jezike lahko prepozna?

V izbirniku jezika so na voljo angleščina, poenostavljena kitajščina, španščina, francoščina, nemščina in japonščina. Za najboljšo natančnost izberi jezik, v katerem je stran dejansko natisnjena — kakovost prepoznavanja močno pade, če je izbran napačen jezik.

Sorodna orodja