Kā to lietot
- Nofotografējiet grāmatas lapu — mēģiniet ietvert visu lapu kadrā, bet nemēģiniet turēt kameru ideāli taisni.
- Noklikšķiniet vai ievelciet foto augšupielādes zonā.
- Atstājiet "Automātiski koriģēt slīpumu" atzīmētu (tas ir ieslēgts pēc noklusējuma) un izvēlieties lapas valodu.
- Nospiediet "Izgūt tekstu" — rīks vispirms izlīdzina attēlu, tad atpazīst tekstu.
- Nokopējiet rezultātu vai lejupielādējiet to kā .txt failu.
Piemērs
Ievade
Telefona foto no atvērtas mīkstvāka grāmatas lapas, turētas aptuveni 10° leņķīIzvade
Konstatētais slīpums: -10,5° → teksts izgūts, saglabājot pilnu rindkopu struktūruBez izlīdzināšanas soļa foto šādā leņķī parasti zaudē trešdaļu vārdu nepareizas nolasīšanas dēļ; leņķa korekcija vispirms atgriež atpazīšanu tuvu skenera precizitātei.
Kas ir šis rīks?
Šis rīks izgūst tekstu no grāmatas, mācību grāmatas vai iespiestas lapas fotogrāfijas, izmantojot OCR (optisko rakstzīmju atpazīšanu), kas darbojas pilnībā jūsu pārlūkā. Atšķirībā no uz skenerus balstītiem OCR rīkiem, tas izveidots ap konkrētu problēmu — rokā fotografētām lapām: lapas, kas nofotografētas nelielā leņķī, kas ir gandrīz neizbēgami, turot telefonu virs atvērtas grāmatas, nevis piespiežot to pie skenera stikla.
Pirms atpazīšana pat sākas, rīks analizē attēlu, lai noteiktu, cik grādu tas ir pagriezts no horizontāles, tad automātiski to izlīdzina. Šis vienīgais solis ir svarīgāks gandrīz par visu citu foto OCR darbā: lapa, kas nofotografēta tikai 10-12 grādu novirzē no horizontāles, var pazemināt atpazīšanas precizitāti no vairāk nekā 95% līdz zem 70%, pārvēršot skaidri lasāmu tekstu par nesakarīgu jūklu — izlīdzināšana vispirms atjauno rezultātus, kas tuvi skenera kvalitātei.
Kāpēc foto leņķis ir svarīgāks, nekā jūs domātu
OCR dzinēji lasa tekstu, skenējot pikseļu rindas, meklējot konsekventas horizontālas tintes joslas — tā tie atdala vienu teksta rindu no nākamās. Kad lapa ir pat nedaudz sasvērta, tas, kam vajadzētu būt tīrai horizontālai teksta rindai, kļūst par diagonālu smērējumu pāri daudzām pikseļu rindām, un dzinēja rindu segmentēšanas loģika sāk apvienot rakstzīmes no blakus rindām vai sadalīt atsevišķas rakstzīmes.
Tāpēc foto, kas jūsu acīm izskatās pilnīgi lasāms, joprojām var radīt sagrozītu OCR izvadi: jūsu smadzenes bez piepūles kompensē nelielu slīpumu, bet naivs OCR process to nedara. Risinājums nav gudrāks atpazīšanas modelis — tā ir attēla izlīdzināšana vispirms, un tieši to dara šī rīka automātiskās korekcijas solis, pirms atpazīšana vispār sākas.
Biežākie lietošanas gadījumi
- Pierakstu vai fragmentu digitalizācija no fiziskas mācību grāmatas bez to pārrakstīšanas ar roku.
- Fragmenta izgūšana no vecas mīkstvāka vai bibliotēkas grāmatas, lai to citētu vai vēlāk meklētu.
- Nofotografētas rokraksta lapas, darblapas vai iespiesta raksta konvertēšana par meklējamu, rediģējamu tekstu.
- Grāmatas lapu arhivēšana, ja grāmata jūk pušu vai ir pārāk trausla, lai to plakani skenētu uz skenera.
Kā iegūt labākos rezultātus
- Labs, vienmērīgs apgaismojums ir svarīgāks nekā ideāli stabila roka — nedaudz sasvērts, bet labi apgaismots foto pārspēj taisnu foto ar smagām ēnām pār tekstu.
- Izvairieties no tiešas zibspuldzes uz spīdīgām lapām; radusies atspīdums var pilnībā nobalinatu tekstu zem tā neatkarīgi no leņķa korekcijas.
- Ietveriet visu lapu kadrā ar nelielu malu — pārāk cieša apgriešana var nogriezt pirmo vai pēdējo rindu.
- Ļoti gariem fragmentiem fotografējiet un apstrādājiet pa vienai lapai, nevis mēģiniet uztvert divu lapu izklājumu, kas ievieš savu izliekuma kropļojumu pie iesējuma.
Kāpēc to izmantot?
Automātiska slīpuma korekcija: atklāj un izlīdzina slīpus foto leņķus pirms atpazīšanas — lielākais precizitātes faktors rokā fotografētiem grāmatu foto.
Pilnībā bezsaistes apstrāde: foto un izgūtais teksts nekad neatstāj jūsu pārlūku — nekas netiek augšupielādēts uz serveri.
Darbojas gan ar vecām, dzeltenām vai nedaudz izbalējušām grāmatu lapām, gan skaidru mūsdienu druku.
Atbalsta vairākas atpazīšanas valodas (angļu, ķīniešu, spāņu, franču, vācu, japāņu), lai varētu skenēt grāmatas dažādās valodās.
Bez konta, bez augšupielādes limita, bez abonementa — bez maksas jebkuram lapu skaitam, cik nepieciešams.
Biežāk uzdotie jautājumi
Kāpēc manam grāmatas foto nepieciešama īpaša apstrāde, nevis parasts OCR?
Parastie OCR rīki parasti tiek testēti un noregulēti uz plakaniem, ideāli izlīdzinātiem skenējumiem. Grāmatas lapa, kas fotografēta ar roku, gandrīz nekad nav taisna — pat neliela 8-12 grādu slīpuma, kas ir normāla rokā turētam kadram, var sagraut atpazīšanas precizitāti krietni zem 70%. Šis rīks izmēra šo slīpumu un automātiski to koriģē pirms atpazīšanas palaišanas, kas ir atšķirība starp lietojamu tekstu un nesakarīgu izvadi.
Vai tas strādā ar vecām vai nodzeltējušām grāmatu lapām?
Jā — lapas krāsas maiņai un vieglai kontrasta zudumam no novecojuša papīra pašam par sevi ir ļoti maza ietekme uz atpazīšanas precizitāti. Foto leņķis ir dominējošais faktors, nevis papīra krāsa, tāpēc vecas mīkstvāka grāmatas un lietotas mācību grāmatas darbojas gandrīz tikpat labi kā jaunas, kad attēls ir izlīdzināts.
Vai mans foto tiek kaut kur augšupielādēts?
Nē. Gan slīpuma noteikšana, gan teksta atpazīšana notiek pilnībā jūsu pārlūkā, izmantojot WebAssembly — nekas par jūsu foto vai tā saturu netiek sūtīts uz jebkuru serveri. Jūs pat varat atvienoties no interneta pēc lapas pirmās ielādes, un tas turpinās darboties (izņemot vienreizējo atpazīšanas dzinēja lejupielādi).
Vai varu izslēgt automātisko korekciju, ja mans foto jau ir taisns?
Jā, noņemiet atzīmi no "Automātiski koriģēt slīpumu", ja strādājat ar plakanu skenējumu vai foto, ko jau esat izlīdzinājis — tas izlaiž noteikšanas soli un atpazīšana notiek nedaudz ātrāk.
Kāpēc pirmā izgūšana ir lēna?
Pirmoreiz nospiežot "Izgūt tekstu", rīks lejupielādē OCR atpazīšanas dzinēju (dažas megabaitus, vienreiz, pēc tam jūsu pārlūks to saglabā kešatmiņā). Katra nākamā izgūšana ir daudz ātrāka, jo dzinējs jau ir ielādēts.
Kādas valodas tas var atpazīt?
Valodas izvēlnē pieejamas angļu, vienkāršotā ķīniešu, spāņu, franču, vācu un japāņu valodas. Izvēlieties valodu, kādā lapa faktiski ir iespiesta, labākai precizitātei — atpazīšanas kvalitāte strauji krītas, ja izvēlēta nepareiza valoda.