Käyttöohje
- Ota valokuva kirjan sivusta — yritä saada koko sivu kuvaan, mutta älä huoli, jos kamera ei ole täysin vaakasuorassa.
- Napsauta tai vedä valokuva latausalueelle.
- Jätä "Korjaa vinous automaattisesti" valituksi (oletuksena päällä) ja valitse sivun kieli.
- Napsauta "Poimi teksti" — työkalu suoristaa kuvan ensin ja tunnistaa sitten tekstin.
- Kopioi tulos tai lataa se .txt-tiedostona.
Esimerkki
Syöte
Puhelimella otettu valokuva avoimesta pehmeäkantisesta sivusta, noin 10° kulmassaTuloste
Havaittu vinous: -10,5° → teksti poimittu kappalerakenne säilyttäenIlman vinouden korjausta tällaisessa kulmassa otettu valokuva menettää tyypillisesti kolmasosan sanoista virhetulkintoina; kulman korjaaminen ensin palauttaa tunnistustarkkuuden lähes skannerin tasolle.
Mikä tämä työkalu on?
Tämä työkalu erottaa tekstin kirjan, oppikirjan tai painetun sivun valokuvasta käyttäen OCR-tekniikkaa (optinen merkintunnistus), joka toimii kokonaan selaimessasi. Toisin kuin skanneripohjaiset OCR-työkalut, tämä on rakennettu ratkaisemaan nimenomaan käsivaralla otettujen valokuvien ongelma: sivut, jotka on kuvattu hieman vinossa, mikä on lähes väistämätöntä, kun pidät puhelinta avoimen kirjan yläpuolella sen sijaan, että painaisit sitä tasaisesti skannerin lasia vasten.
Ennen kuin tunnistus edes alkaa, työkalu analysoi kuvan havaitakseen tarkalleen, kuinka monta astetta se on kiertynyt vaakatasosta, ja suoristaa sen sitten automaattisesti. Tämä yksittäinen vaihe vaikuttaa lähes enemmän kuin mikään muu valokuvapohjaisen OCR:n tarkkuuteen: sivu, joka on kuvattu vain 10–12 astetta vinossa, voi pudottaa tunnistustarkkuuden yli 95 %:sta alle 70 %:iin, muuttaen selvästi luettavan tekstin sekavaksi hölynpölyksi — vinouden korjaaminen ensin palauttaa tuloksen lähes skannerin tasoiseksi.
Miksi kuvakulma vaikuttaa enemmän kuin luulisi
OCR-moottorit lukevat tekstiä skannaamalla pikselirivejä etsien johdonmukaisia vaakasuoria mustesuikaleita — näin ne erottavat yhden tekstirivin toisesta. Kun sivu on edes hieman vinossa, siitä mikä pitäisi olla siisti vaakasuora tekstirivi, tulee viisto tahra useiden pikselirivien poikki, ja moottorin rivinsegmentointilogiikka alkaa yhdistää merkkejä viereisiltä riveiltä tai jakaa yksittäisiä merkkejä osiin.
Tästä syystä valokuva, joka näyttää silmillesi täysin luettavalta, voi silti tuottaa sekavaa OCR-tulostetta: aivosi kompensoivat vaivattomasti pienen kallistuksen, mutta yksinkertainen OCR-putki ei. Ratkaisu ei ole älykkäämpi tunnistusmalli — se on kuvan suoristaminen ensin, mikä on juuri sitä, mitä tämän työkalun automaattinen korjausvaihe tekee ennen tunnistuksen ajamista.
Yleisiä käyttötapauksia
- Fyysisen oppikirjan muistiinpanojen tai otteiden digitointi ilman käsin uudelleenkirjoitusta.
- Katkelman poimiminen vanhasta pehmeäkantisesta tai kirjastokirjasta lainattavaksi tai myöhemmin haettavaksi.
- Valokuvatun monisteen, tehtävälehden tai lehtiartikkelin muuntaminen haettavaksi, muokattavaksi tekstiksi.
- Hajoamassa olevan tai skanneriin liian hauraan kirjan sivujen arkistointi.
Parhaan tuloksen saavuttaminen
- Hyvä, tasainen valaistus merkitsee enemmän kuin täysin vakaa käsi — hieman vino mutta hyvin valaistu valokuva päihittää suoran kuvan, jossa on raskas varjo tekstin päällä.
- Vältä suoraa salamaa kiiltävillä sivuilla; syntyvä häikäisy/kuumakohta voi pyyhkiä sen alla olevan tekstin näkymättömiin kulman korjauksesta riippumatta.
- Ota koko sivu kuvaan hieman marginaalilla — liian tiukka rajaus voi leikata ensimmäisen tai viimeisen rivin pois.
- Hyvin pitkille katkelmille kuvaa ja käsittele yksi sivu kerrallaan sen sijaan, että yrittäisit kuvata kahden sivun aukeaman, mikä aiheuttaa oman vääristymänsä selän lähellä.
Miksi käyttää sitä?
Automaattinen vinouden korjaus: tunnistaa ja suoristaa vinot kuvakulmat ennen tunnistusta, tärkein yksittäinen tarkkuustekijä käsivaralla otetuissa kirjavalokuvissa.
Täysin offline-käsittely: kuva ja siitä poimittu teksti eivät koskaan poistu selaimestasi — mitään ei ladata palvelimelle.
Toimii sekä vanhoille, kellastuneille tai hieman haalistuneille kirjansivuille että terävälle nykyaikaiselle painojäljelle.
Tukee useita tunnistuskieliä (englanti, kiina, espanja, ranska, saksa, japani), joten voit skannata kirjoja eri kielillä.
Ei tiliä, ei latausrajaa, ei tilausmaksua — ilmainen niin monelle sivulle kuin tarvitset.
Usein kysytyt kysymykset
Miksi kirjani valokuva tarvitsee erityiskäsittelyä tavallisen OCR:n sijaan?
Tavalliset OCR-työkalut on yleensä testattu ja viritetty tasaisille, täydellisesti kohdistetuille skannauksille. Käsivaralla kuvattu kirjan sivu ei juuri koskaan ole vaakatasossa — jopa pieni 8–12 asteen kallistus, joka on tavallista käsivaralla otetussa kuvassa, voi romahduttaa tunnistustarkkuuden reilusti alle 70 %:n. Tämä työkalu mittaa kyseisen kallistuksen ja korjaa sen automaattisesti ennen tunnistuksen ajamista, mikä on ero käyttökelpoisen tekstin ja sekavan tulosteen välillä.
Toimiiko tämä vanhoille tai kellastuneille kirjansivuille?
Kyllä — vanhenevan paperin värimuutoksella ja lievällä kontrastin heikkenemisellä on itsessään hyvin vähän vaikutusta tunnistustarkkuuteen. Kuvakulma on hallitseva tekijä, ei paperin väri, joten vanhat pehmeäkantiset ja käytetyt oppikirjat toimivat suunnilleen yhtä hyvin kuin uudet, kunhan kuva on ensin suoristettu.
Ladataanko valokuvani jonnekin?
Ei. Sekä vinouden tunnistus että tekstintunnistus tapahtuvat kokonaan selaimessasi WebAssemblyä käyttäen — mitään valokuvastasi tai sen sisällöstä ei lähetetä millekään palvelimelle. Voit jopa katkaista internetyhteyden sivun ensimmäisen latauksen jälkeen, ja se toimii silti (lukuun ottamatta tunnistusmoottorin kertaluontoista latausta).
Voinko poistaa automaattisen korjauksen käytöstä, jos valokuvani on jo suora?
Kyllä, poista valinta "Korjaa vinous automaattisesti", jos työskentelet tasaisesta skannauksesta tai jo suoristetusta valokuvasta — tämä ohittaa tunnistusvaiheen ja tunnistus toimii hieman nopeammin.
Miksi ensimmäinen poiminta on hidas?
Kun napsautat "Poimi teksti" ensimmäistä kertaa, työkalu lataa OCR-tunnistusmoottorin (muutama megatavu, kertaluontoisesti, selaimesi tallentaa sen välimuistiin sen jälkeen). Jokainen sitä seuraava poiminta on paljon nopeampi, koska moottori on jo ladattu.
Mitä kieliä se tunnistaa?
Kielivalikosta löytyvät englanti, yksinkertaistettu kiina, espanja, ranska, saksa ja japani. Valitse kieli, jolla sivu on todellisuudessa painettu, parhaan tarkkuuden saavuttamiseksi — tunnistuslaatu heikkenee jyrkästi, jos väärä kieli on valittu.