Kuidas kasutada
- Tee foto raamatu leheküljest — proovi mahutada kogu lehekülg kaadrisse, aga ära muretse kaamera täiusliku tasakaalu pärast.
- Klõpsa või lohista foto üleslaadimisalale.
- Jäta "Paranda kalle automaatselt" märgituks (see on vaikimisi sees) ja vali lehekülje keel.
- Klõpsa "Eralda tekst" — tööriist sirgestab kõigepealt pildi, seejärel tuvastab teksti.
- Kopeeri tulemus või laadi see alla .txt failina.
Näide
Sisend
Telefonifoto avatud pehmekaanelise raamatu leheküljest, tehtud umbes 10° nurga allTulemus
Tuvastatud kalle: -10,5° → tekst eraldatud, lõikude struktuur täielikult säilinudIlma kaldeparanduseta kaotab sellises nurgas foto tavaliselt kolmandiku sõnadest valelugemiste tõttu; nurga eelnev parandamine viib tuvastuse peaaegu skanneri-tasemel täpsuseni tagasi.
Mis see tööriist on?
See tööriist eraldab raamatu, õpiku või trükitud lehekülje fotolt teksti, kasutades OCR-i (optiline märgituvastus), mis töötab täielikult su brauseris. Erinevalt skanneripõhistest OCR-tööriistadest on see loodud spetsiifiliselt käsipealt tehtud fotode probleemi lahendamiseks: leheküljed, mis on pildistatud kerges nurgas, mis on peaaegu vältimatu, kui hoiad telefoni avatud raamatu kohal, mitte ei suru seda skanneriklaasi vastu lamedaks.
Enne tuvastuse algustki analüüsib tööriist pilti, et tuvastada, mitu kraadi see horisondist pöördunud on, ning sirgestab selle seejärel automaatselt. See üks samm loeb foto-OCR-i puhul peaaegu kõige rohkem: lehekülg, mis on pildistatud vaid 10-12 kraadi kaldu, võib langetada tuvastustäpsuse üle 95%-lt alla 70%-ni, muutes selgelt loetava teksti arusaamatuks jorasegaduseks — kalde eemaldamine enne taastab peaaegu skanneri-tasemel tulemused.
Miks foto nurk loeb rohkem, kui arvaksid
OCR-mootorid loevad teksti, skaneerides pikslite ridu, otsides ühtlasi horisontaalseid tindiribasid — nii eristavad nad ühe tekstirea järgmisest. Kui lehekülg on isegi kergelt kaldus, muutub see, mis peaks olema puhas horisontaalne tekstirida, diagonaalseks laiaks jäljeks üle paljude pikslite ridade, ning mootori rea-segmenteerimise loogika hakkab ühendama naaberridade märke või jagama üksikuid tähemärke.
Sellepärast võib foto, mis näib su silmale täiesti loetav, siiski anda segase OCR-väljundi: su aju kompenseerib kerget kallet vaevata, aga naiivne OCR-torustik seda ei tee. Lahendus ei ole targem tuvastusmudel — see on pildi kõigepealt sirgestamine, täpselt see, mida selle tööriista automaatne parandusetapp enne tuvastuse käivitumist teeb.
Levinud kasutusjuhud
- Märkmete või katkendite digiteerimine füüsilisest õpikust ilma neid käsitsi ümber trükkimata.
- Lõigu eraldamine vanast pehmekaanelisest raamatust või laenatud raamatust hilisemaks tsiteerimiseks või otsimiseks.
- Pildistatud jaotusmaterjali, töölehe või trükitud artikli teisendamine otsitavaks, redigeeritavaks tekstiks.
- Lehekülgede arhiveerimine raamatust, mis laguneb või on liiga habras, et seda skanneril lamedalt skannida.
Parima tulemuse saamiseks
- Hea, ühtlane valgustus loeb rohkem kui täiuslikult kindel käsi — veidi kaldus, ent hästi valgustatud foto ületab tasase foto, millel on üle teksti raske vari.
- Väldi otsest välku läikival lehel; sellest tulenev sära/hõõguv laik võib selle alla jääva teksti täielikult tühjaks muuta, olenemata nurgaparandusest.
- Mahuta kogu lehekülg kaadrisse väikese varuga — liiga tiheda kaadri lõikamine võib esimese või viimase rea ära lõigata.
- Väga pikkade lõikude puhul pildista ja töötle ühte lehekülge korraga, mitte ei püüa jäädvustada kaheleheküljelist avalehte, mis toob kaasa oma moonutuse köite ligidal.
Miks seda kasutada?
Automaatne kaldeparandus: tuvastab ja sirgestab kaldu fotonurgad enne tuvastust — käsipealt tehtud raamatufotode kõige olulisem täpsust mõjutav tegur.
Täielikult offline töötlus: foto ja eraldatud tekst ei lahku kunagi su brauserist — midagi ei laadita üles serverisse.
Töötab vanade, kollaseks tõmbunud või kergelt tuhmunud raamatulehekülgede peal sama hästi kui teravate tänapäevaste trükistega.
Toetab mitut tuvastuskeelt (inglise, hiina, hispaania, prantsuse, saksa, jaapani), et saaksid skannida raamatuid eri keeltes.
Ei mingit kontot, üleslaadimise piiranguid ega tellimust — tasuta nii mitme lehekülje jaoks kui vaja.
Korduma kippuvad küsimused
Miks vajab mu raamatufoto erilist käsitlust tavalise OCR-i asemel?
Tavalised OCR-tööriistad on tavaliselt testitud ja häälestatud tasastele, täiuslikult joondatud skaneeringutele. Käsipealt pildistatud raamatuleht ei ole peaaegu kunagi tasane — isegi väike 8-12 kraadine kalle, mis on käsipealt tehtud foto puhul normaalne, võib tuvastustäpsuse alla 70% langetada. See tööriist mõõdab seda kallet ja parandab selle automaatselt enne tuvastuse käivitamist, mis teebki vahe kasutuskõlbliku teksti ja segase väljundi vahel.
Kas see töötab vanade või kollaste raamatulehekülgedega?
Jah — vananevast paberist tulenev lehekülje värvimuutus ja kerge kontrastikadu ise mõjutavad tuvastustäpsust väga vähe. Foto nurk on domineeriv tegur, mitte paberi värvus, seega toimivad vanad pehmekaanelised raamatud ja kasutatud õpikud enam-vähem sama hästi kui uued, kui pilt on kord sirgestatud.
Kas mu foto laaditakse kuhugi üles?
Ei. Nii kalde tuvastus kui ka tekstituvastus toimuvad täielikult su brauseris WebAssembly abil — mitte midagi su foto või selle sisu kohta ei saadeta ühelegi serverile. Saad isegi pärast lehe esmakordset laadimist internetiühenduse katkestada ja see töötab endiselt edasi (kui välja arvata tuvastusmootori ühekordne allalaadimine).
Kas saan automaatse paranduse välja lülitada, kui mu foto on juba sirge?
Jah, eemalda märge "Paranda kalle automaatselt", kui töötad tasase skaneeringu või juba sirgestatud fotoga — see jätab tuvastussammu vahele ja tuvastus töötab veidi kiiremini.
Miks on esimene eraldamine aeglane?
Kui klõpsad esimest korda "Eralda tekst", laadib tööriist alla OCR-tuvastusmootori (paar megabaiti, ühekordselt, hiljem su brauseris vahemällu salvestatud). Iga järgnev eraldamine on palju kiirem, kuna mootor on juba laaditud.
Milliseid keeli see tuvastab?
Keelevalikus on saadaval inglise, lihtsustatud hiina, hispaania, prantsuse, saksa ja jaapani keel. Vali keel, milles lehekülg tegelikult trükitud on, parima täpsuse saavutamiseks — tuvastuse kvaliteet langeb järsult, kui vale keel on valitud.