CodeKitHub
Nástroje pre obrázky

Prevod strany knihy na text

Naposledy aktualizované:

Zmeňte fotografiu strany knihy na upraviteľný, prehľadávateľný text — vytvorené špeciálne pre skutočné fotografie skutočných kníh, nie pre ploché skeny dokumentov. Väčšina OCR nástrojov predpokladá dokonale zarovnaný sken; tento automaticky rozpozná a opraví šikmý uhol, ktorý vzniká pri fotografovaní strany voľnou rukou, a potom rozpozná text. Všetko beží vo vašom prehliadači: fotografia ani extrahovaný text nikdy neopustia vaše zariadenie.

Ako sa používa

  1. Odfoťte stranu knihy — snažte sa zachytiť celú stranu do záberu, ale nemusíte držať fotoaparát dokonale rovno.
  2. Kliknite alebo potiahnite fotografiu do oblasti na nahranie.
  3. Nechajte zaškrtnuté „Automatická oprava šikmosti“ (predvolene zapnuté) a vyberte jazyk strany.
  4. Kliknite na „Extrahovať text“ — nástroj obrázok najprv narovná a potom rozpozná text.
  5. Skopírujte výsledok alebo si ho stiahnite ako súbor .txt.

Príklad

Vstup

Fotka z telefónu otvorenej strany brožovanej knihy, odfotená pod uhlom približne 10°

Výstup

Zistená šikmosť: -10,5° → text extrahovaný so zachovanou celou štruktúrou odsekov

Bez kroku narovnania fotka pod týmto uhlom zvyčajne stratí tretinu slov kvôli chybnému čítaniu; oprava uhla ako prvá vráti rozpoznávanie na presnosť blízku skeneru.

Čo je tento nástroj?

Tento nástroj extrahuje text z fotografie knihy, učebnice alebo tlačenej strany pomocou OCR (optického rozpoznávania znakov), ktoré beží celé vo vašom prehliadači. Na rozdiel od OCR nástrojov založených na skeneri je postavený okolo konkrétneho problému fotiek z ruky: strany fotografované pod miernym uhlom, čo je takmer nevyhnutné, keď držíte telefón nad otvorenou knihou namiesto pritlačenia na sklo skenera.

Ešte pred začiatkom rozpoznávania nástroj analyzuje obrázok, aby zistil, o koľko stupňov je otočený od vodorovnej roviny, a potom ho automaticky narovná. Tento jediný krok je dôležitejší než takmer čokoľvek iné pri OCR z fotografie: strana odfotená pod uhlom len 10-12 stupňov dokáže znížiť presnosť rozpoznávania z viac než 95 % na menej než 70 %, čím sa jasne čitateľný text zmení na nezmyselný zhluk znakov — narovnanie ako prvý krok vráti výsledky takmer na úroveň kvality skenera.

Prečo uhol fotografie záleží viac, než by ste čakali

OCR enginy čítajú text skenovaním pixelových riadkov a hľadaním konzistentných vodorovných pásov atramentu — takto oddeľujú jeden riadok textu od ďalšieho. Keď je strana čo i len mierne naklonená, to, čo by malo byť čistou vodorovnou líniou textu, sa zmení na diagonálny šmuh naprieč mnohými pixelovými riadkami, a logika segmentácie riadkov v enginu začne zlučovať znaky zo susedných riadkov alebo rozdeľovať jednotlivé znaky.

Preto môže fotka, ktorá vášmu oku pripadá dokonale čitateľná, aj tak spôsobiť pokazený výstup OCR: váš mozog bez námahy kompenzuje mierny náklon, no naivný OCR pipeline nie. Riešením nie je inteligentnejší rozpoznávací model — je ním narovnanie obrázka ako prvý krok, presne to, čo robí funkcia automatickej opravy v tomto nástroji ešte pred spustením rozpoznávania.

Bežné prípady použitia

  • Digitalizácia poznámok alebo úryvkov z fyzickej učebnice bez ručného prepisovania.
  • Extrahovanie pasáže zo starej brožovanej alebo knižničnej knihy na neskoršie citovanie alebo vyhľadávanie.
  • Konverzia odfoteného pracovného listu, podkladu alebo tlačeného článku na prehľadávateľný, upraviteľný text.
  • Archivovanie strán z knihy, ktorá sa rozpadáva alebo je príliš krehká na ploché skenovanie na skeneri.

Konvertor obrázka na ASCII art · Počítadlo slov

Ako dosiahnuť najlepšie výsledky

  • Dobré, rovnomerné osvetlenie je dôležitejšie než dokonale pevná ruka — mierne šikmá, ale dobre osvetlená fotka prekoná rovnú fotku s ťažkým tieňom cez text.
  • Vyhnite sa priamemu blesku na lesklých stranách; výsledný odlesk/hotspot môže vyprázdniť text pod ním bez ohľadu na opravu uhla.
  • Zachyťte celú stranu do záberu s trochou okraja — príliš tesné orezanie môže odrezať prvý alebo posledný riadok.
  • Pri veľmi dlhých pasážach fotografujte a spracúvajte jednu stranu naraz, namiesto zachytávania dvojstrany, ktorá spôsobuje vlastné skreslenie krivosťou pri chrbte knihy.

Prečo ho používať?

Automatická oprava šikmosti: rozpozná a narovná šikmé uhly fotografie pred rozpoznávaním, čo je jednoznačne najväčší faktor presnosti pri fotkách kníh z ruky.

Kompletné offline spracovanie: fotografia ani extrahovaný text nikdy neopustia váš prehliadač — nič sa nenahráva na server.

Funguje pre staré, zožltnuté alebo mierne vyblednuté strany kníh rovnako ako pre ostrú modernú tlač.

Podporuje viacero jazykov rozpoznávania (angličtina, čínština, španielčina, francúzština, nemčina, japončina), takže môžete skenovať knihy v rôznych jazykoch.

Bez účtu, bez limitu nahrávania, bez predplatného — zadarmo pre toľko strán, koľko potrebujete.

Časté otázky

Prečo moja fotka knihy potrebuje špeciálne spracovanie namiesto bežného OCR?

Bežné OCR nástroje sú zvyčajne testované a ladené na plochých, dokonale zarovnaných skenoch. Strana knihy odfotená z ruky takmer nikdy nie je rovná — aj malý náklon 8-12 stupňov, čo je pri fotení z ruky bežné, dokáže zrútiť presnosť rozpoznávania hlboko pod 70 %. Tento nástroj tento náklon zmeria a automaticky opraví pred spustením rozpoznávania, čo je rozdiel medzi použiteľným textom a nezmyselným výstupom.

Funguje to aj na starých alebo zožltnutých stranách kníh?

Áno — sfarbenie strany a mierna strata kontrastu zo starnutia papiera majú samy osebe len minimálny vplyv na presnosť rozpoznávania. Uhol fotografie je dominantným faktorom, nie farba papiera, takže staré brožúry a použité učebnice fungujú približne rovnako dobre ako nové, keď je obrázok narovnaný.

Nahráva sa moja fotografia niekam?

Nie. Detekcia šikmosti aj rozpoznávanie textu bežia úplne vo vašom prehliadači pomocou WebAssembly — nič o vašej fotografii ani jej obsahu sa neodosiela na žiadny server. Po prvom načítaní stránky sa dokonca môžete odpojiť od internetu a nástroj bude naďalej fungovať (okrem jednorazového stiahnutia rozpoznávacieho enginu).

Môžem vypnúť automatickú opravu, ak je moja fotka už rovná?

Áno, odškrtnite „Automatická oprava šikmosti“, ak pracujete s plochým skenom alebo fotkou, ktorú ste už narovnali — vynechá to krok detekcie a rozpoznávanie prebehne o niečo rýchlejšie.

Prečo je prvá extrakcia pomalá?

Pri prvom kliknutí na „Extrahovať text“ si nástroj stiahne rozpoznávací OCR engine (niekoľko megabajtov, len raz, potom uložené v cache prehliadača). Každá ďalšia extrakcia je oveľa rýchlejšia, pretože engine je už načítaný.

Aké jazyky dokáže rozpoznať?

Vo výbere jazyka sú dostupné angličtina, zjednodušená čínština, španielčina, francúzština, nemčina a japončina. Pre najlepšiu presnosť vyberte jazyk, v ktorom je strana skutočne vytlačená — kvalita rozpoznávania prudko klesá, ak je vybraný nesprávny jazyk.

Súvisiace nástroje