Kako ga koristiti
- Fotografirajte stranicu knjige — pokušajte uklopiti cijelu stranicu u kadar, ali ne brinite se hoćete li kameru držati savršeno vodoravno.
- Kliknite ili povucite fotografiju u područje za učitavanje.
- Ostavite "Automatska ispravka iskošenja" označenu (uključena je po zadanome) i odaberite jezik stranice.
- Kliknite "Izdvoji tekst" — alat prvo poravna sliku, a zatim prepoznaje tekst.
- Kopirajte rezultat ili ga preuzmite kao .txt datoteku.
Primjer
Ulaz
Fotografija otvorene stranice džepne knjige snimljena mobitelom, pod kutom od otprilike 10°Izlaz
Otkriveno iskošenje: -10,5° → tekst izdvojen s očuvanom cjelokupnom strukturom odlomakaBez koraka poravnavanja, fotografija pod ovim kutom obično izgubi trećinu riječi zbog pogrešnog čitanja; ispravljanje kuta prije toga vraća prepoznavanje na gotovo skenersku točnost.
Što je ovaj alat?
Ovaj alat izdvaja tekst iz fotografije knjige, udžbenika ili tiskane stranice pomoću OCR-a (optičkog prepoznavanja znakova) koji se odvija u cijelosti unutar vašeg preglednika. Za razliku od OCR alata temeljenih na skeneru, izgrađen je oko specifičnog problema fotografija snimljenih rukom: stranica fotografiranih pod blagim kutom, što je gotovo neizbježno kad telefon držite iznad otvorene knjige umjesto da je pritisnete ravno na staklo skenera.
Prije nego što prepoznavanje uopće počne, alat analizira sliku kako bi otkrio koliko je stupnjeva zarotirana od vodoravnog položaja, a zatim je automatski poravnava. Ovaj jedan korak važniji je od gotovo svega drugog za OCR na temelju fotografija: stranica fotografirana pod samo 10-12 stupnjeva izvan razine može smanjiti točnost prepoznavanja s preko 95% na ispod 70%, pretvarajući jasno čitljiv tekst u besmislicu — poravnavanje prije toga vraća gotovo skenersku kvalitetu rezultata.
Zašto je kut fotografije važniji nego što biste mislili
OCR pogoni čitaju tekst skenirajući redove piksela tražeći dosljedne vodoravne trake tinte — tako razdvajaju jedan redak teksta od sljedećeg. Kad je stranica čak i blago nagnuta, ono što bi trebao biti čist vodoravan redak teksta postaje dijagonalna mrlja preko mnogo redova piksela, a logika segmentacije redaka pogona počinje spajati znakove iz susjednih redaka ili razdvajati pojedinačne znakove.
Zato fotografija koja vašim očima izgleda savršeno čitljivo i dalje može proizvesti besmislen OCR izlaz: vaš mozak bez napora nadoknađuje blagi nagib, ali naivan OCR proces to ne radi. Rješenje nije pametniji model prepoznavanja — nego prvo poravnavanje slike, što upravo radi korak automatske ispravke u ovom alatu prije pokretanja prepoznavanja.
Uobičajeni slučajevi uporabe
- Digitalizacija bilješki ili odlomaka iz fizičkog udžbenika bez ponovnog ručnog tipkanja.
- Izdvajanje odlomka iz stare džepne knjige ili knjižnične knjige radi citiranja ili kasnijeg pretraživanja.
- Pretvaranje fotografiranog materijala, radnog lista ili tiskanog članka u tekst koji se može pretraživati i uređivati.
- Arhiviranje stranica knjige koja se raspada ili je previše krhka za ravno skeniranje na stakleni sken.
Kako dobiti najbolje rezultate
- Dobra, ravnomjerna rasvjeta važnija je od savršeno mirne ruke — blago iskošena, ali dobro osvijetljena fotografija nadmašuje ravnu fotografiju s jakom sjenom preko teksta.
- Izbjegavajte izravan blic na sjajnim stranicama; nastali odsjaj/žariste može zatrti tekst ispod njega bez obzira na ispravku kuta.
- Uklopite cijelu stranicu u kadar s malo margine — presuvo obrezivanje može odsjeći prvi ili posljednji redak.
- Za vrlo dugačke odlomke, fotografirajte i obradite jednu stranicu po jednu umjesto pokušaja snimanja dvostrukog razvijenog prikaza, što uvodi vlastito iskrivljenje krivulje blizu hrpta.
Zašto ga koristiti?
Automatska ispravka iskošenja: otkriva i poravnava iskošene kutove fotografija prije prepoznavanja, najvažniji faktor točnosti za fotografije knjiga snimljene rukom.
Potpuna obrada bez povezivanja: fotografija i izdvojeni tekst nikada ne napuštaju vaš preglednik — ništa se ne šalje na poslužitelj.
Radi za stare, požutjele ili blago izblijedjele stranice knjiga, kao i za oštar moderan tisak.
Podržava više jezika prepoznavanja (engleski, kineski, španjolski, francuski, njemački, japanski) tako da možete skenirati knjige na različitim jezicima.
Bez računa, bez ograničenja učitavanja, bez pretplate — besplatno za onoliko stranica koliko vam treba.
Često postavljana pitanja
Zašto moja fotografija stranice knjige treba posebnu obradu umjesto običnog OCR-a?
Obični OCR alati obično su testirani i podešeni na ravnim, savršeno poravnatim skenovima. Stranica knjige fotografirana rukom gotovo nikada nije poravnata — čak i mali nagib od 8-12 stupnjeva, što je normalno za snimku iz ruke, može srušiti točnost prepoznavanja daleko ispod 70%. Ovaj alat mjeri taj nagib i automatski ga ispravlja prije pokretanja prepoznavanja, što je razlika između uporabljivog teksta i besmislenog izlaza.
Radi li ovo na starim ili požutjelim stranicama knjiga?
Da — diskoloracija stranice i blagi gubitak kontrasta zbog starenja papira sami po sebi imaju vrlo mali utjecaj na točnost prepoznavanja. Kut fotografije dominantan je faktor, a ne boja papira, pa stare džepne knjige i rabljeni udžbenici rade otprilike jednako dobro kao i novi nakon što se slika poravna.
Šalje li se moja fotografija negdje?
Ne. I otkrivanje iskošenja i prepoznavanje teksta odvijaju se u cijelosti u vašem pregledniku pomoću WebAssemblyja — ništa o vašoj fotografiji ili njezinom sadržaju ne šalje se na bilo koji poslužitelj. Možete se čak i isključiti s interneta nakon prvog učitavanja stranice i alat će nastaviti raditi (osim jednokratnog preuzimanja pogona za prepoznavanje).
Mogu li isključiti automatsku ispravku ako je moja fotografija već ravna?
Da, odznačite "Automatska ispravka iskošenja" ako radite s ravnim skenom ili fotografijom koju ste već sami poravnali — to preskače korak otkrivanja i pokreće prepoznavanje nešto brže.
Zašto je prvo izdvajanje sporo?
Kad prvi put kliknete "Izdvoji tekst", alat preuzima pogon za OCR prepoznavanje (nekoliko megabajta, jednokratno, potom pohranjeno u predmemoriju vašeg preglednika). Svako sljedeće izdvajanje puno je brže jer je pogon već učitan.
Koje jezike može prepoznati?
Engleski, pojednostavljeni kineski, španjolski, francuski, njemački i japanski dostupni su u izborniku jezika. Odaberite jezik na kojem je stranica zapravo tiskana radi najbolje točnosti — kvaliteta prepoznavanja naglo pada ako je odabran pogrešan jezik.