Cum se folosește
- Fă o fotografie a paginii de carte — încearcă să încadrezi toată pagina, dar nu-ți face griji dacă nu ții camera perfect dreaptă.
- Apasă sau trage fotografia în zona de încărcare.
- Lasă bifat „Corectează automat înclinarea” (activat implicit) și alege limba paginii.
- Apasă „Extrage text” — instrumentul îndreaptă mai întâi imaginea, apoi recunoaște textul.
- Copiază rezultatul sau descarcă-l ca fișier .txt.
Exemplu
Intrare
O poză din telefon a unei pagini deschise de carte de buzunar, ținută la un unghi de aproximativ 10°Rezultat
Înclinare detectată: -10,5° → text extras cu structura paragrafelor păstrată integralFără pasul de îndreptare, o fotografie la acest unghi pierde de obicei o treime din cuvinte din cauza citirilor greșite; corectarea unghiului mai întâi readuce recunoașterea aproape de acuratețea unui scaner.
Ce este acest instrument?
Acest instrument extrage text dintr-o fotografie a unei cărți, manual sau pagini tipărite, folosind OCR (recunoaștere optică a caracterelor) care rulează complet în browserul tău. Spre deosebire de instrumentele OCR bazate pe scanare, este construit în jurul problemei specifice a fotografiilor făcute din mână: pagini fotografiate ușor înclinat, ceva aproape inevitabil când ții telefonul deasupra unei cărți deschise în loc s-o apeși pe geamul unui scaner.
Înainte ca recunoașterea să înceapă, instrumentul analizează imaginea pentru a detecta exact câte grade este rotită față de orizontală, apoi o îndreaptă automat. Acest singur pas contează mai mult decât aproape orice altceva pentru OCR-ul bazat pe fotografii: o pagină fotografiată la doar 10-12 grade înclinare poate scădea acuratețea recunoașterii de la peste 95% la sub 70%, transformând un text clar lizibil în text de neînțeles — îndreptarea prealabilă restabilește rezultate aproape de calitatea unui scaner.
De ce unghiul fotografiei contează mai mult decât ai crede
Motoarele OCR citesc textul scanând rânduri de pixeli, căutând benzi orizontale consistente de cerneală — așa separă o linie de text de următoarea. Când o pagină este înclinată chiar și ușor, ceea ce ar trebui să fie o linie orizontală clară de text devine o pată diagonală întinsă pe multe rânduri de pixeli, iar logica de segmentare a liniilor a motorului începe să combine caractere din linii adiacente sau să despartă caractere unice.
De aceea o fotografie care pare perfect lizibilă ochilor tăi poate totuși produce un rezultat OCR neinteligibil: creierul tău compensează fără efort o înclinare ușoară, dar o procesare OCR naivă nu o face. Soluția nu este un model de recunoaștere mai inteligent — este îndreptarea imaginii mai întâi, exact ce face pasul de corecție automată din acest instrument înainte ca recunoașterea să înceapă vreodată.
Cazuri de utilizare frecvente
- Digitizarea notițelor sau a fragmentelor dintr-un manual fizic fără a le retasta manual.
- Extragerea unui pasaj dintr-o carte de buzunar veche sau de bibliotecă pentru a-l cita sau căuta ulterior.
- Convertirea unei fișe fotografiate, a unei fișe de lucru sau a unui articol tipărit în text căutabil și editabil.
- Arhivarea paginilor dintr-o carte care se destramă sau este prea fragilă pentru a fi scanată plat pe un scaner.
Cum obții cele mai bune rezultate
- O lumină bună și uniformă contează mai mult decât o mână perfect stabilă — o fotografie ușor strâmbă, dar bine luminată, întrece o fotografie dreaptă cu umbre grele peste text.
- Evită blițul direct pe pagini lucioase; reflexia/petele luminoase rezultate pot ascunde textul de dedesubt, indiferent de corecția unghiului.
- Încadrează toată pagina cu puțină margine — decuparea prea strânsă poate tăia prima sau ultima linie.
- Pentru pasaje foarte lungi, fotografiază și procesează câte o pagină odată, în loc să încerci să captezi o pagină dublă, ceea ce introduce propria distorsiune de curbură lângă cotor.
De ce să-l folosești?
Corecție automată a înclinării: detectează și îndreaptă unghiurile strâmbe ale fotografiei înainte de recunoaștere, cel mai important factor de acuratețe pentru pozele de cărți făcute din mână.
Procesare complet offline: fotografia și textul extras nu părăsesc niciodată browserul tău — nimic nu este încărcat pe un server.
Funcționează atât pentru pagini de carte vechi, îngălbenite sau ușor decolorate, cât și pentru tipar modern clar.
Suportă mai multe limbi de recunoaștere (engleză, chineză, spaniolă, franceză, germană, japoneză), astfel poți scana cărți în diferite limbi.
Fără cont, fără limită de încărcare, fără abonament — gratuit pentru câte pagini ai nevoie.
Întrebări frecvente
De ce fotografia mea de carte are nevoie de o procesare specială în loc de OCR obișnuit?
Instrumentele OCR obișnuite sunt de obicei testate și calibrate pe scanări plate, perfect aliniate. O pagină de carte fotografiată din mână aproape că nu este niciodată dreaptă — chiar și o înclinare mică de 8-12 grade, normală pentru o poză din mână, poate prăbuși acuratețea recunoașterii sub 70%. Acest instrument măsoară acea înclinare și o corectează automat înainte de a rula recunoașterea, ceea ce face diferența dintre text utilizabil și rezultat neinteligibil.
Funcționează pe pagini de carte vechi sau îngălbenite?
Da — decolorarea paginii și pierderea ușoară de contrast din îmbătrânirea hârtiei au foarte puțin efect asupra acurateții recunoașterii prin ele însele. Unghiul fotografiei este factorul dominant, nu culoarea hârtiei, deci cărțile vechi de buzunar și manualele folosite funcționează aproape la fel de bine ca cele noi, odată ce imaginea este îndreptată.
Este fotografia mea încărcată undeva?
Nu. Atât detectarea înclinării, cât și recunoașterea textului rulează complet în browserul tău folosind WebAssembly — nimic despre fotografia ta sau conținutul ei nu este trimis către niciun server. Poți chiar să te deconectezi de la internet după ce pagina se încarcă prima dată, iar instrumentul va continua să funcționeze (cu excepția descărcării unice a motorului de recunoaștere).
Pot dezactiva corecția automată dacă fotografia mea este deja dreaptă?
Da, debifează „Corectează automat înclinarea” dacă lucrezi cu o scanare plată sau o fotografie deja îndreptată — asta sare pasul de detectare și rulează recunoașterea puțin mai rapid.
De ce prima extragere este lentă?
Prima dată când apeși „Extrage text”, instrumentul descarcă motorul de recunoaștere OCR (câțiva megabytes, o singură dată, apoi stocat de browserul tău). Fiecare extragere ulterioară este mult mai rapidă, deoarece motorul este deja încărcat.
Ce limbi poate recunoaște?
Engleză, chineză simplificată, spaniolă, franceză, germană și japoneză sunt disponibile în selectorul de limbă. Alege limba în care este tipărită efectiv pagina pentru cea mai bună acuratețe — calitatea recunoașterii scade brusc dacă este selectată limba greșită.