Sådan bruger du det
- Tag et foto af bogsiden — prøv at få hele siden med i billedet, men bekymr dig ikke om at holde kameraet perfekt vandret.
- Klik eller træk fotoet ind i uploadområdet.
- Lad "Automatisk skævhedskorrektion" forblive markeret (den er som standard slået til), og vælg sidens sprog.
- Klik på "Udtræk tekst" — værktøjet retter først billedet op og genkender derefter teksten.
- Kopiér resultatet, eller download det som en .txt-fil.
Eksempel
Input
Et telefonfoto af en åben paperback-side, holdt i cirka en 10°-vinkelOutput
Registreret skævhed: -10,5° → tekst udtrukket med fuld afsnitsstruktur bevaretUden skævhedskorrektionstrinnet mister et foto i denne vinkel typisk en tredjedel af sine ord til fejllæsninger; ved først at rette vinklen bringes genkendelsen tilbage til næsten scannernøjagtighed.
Hvad er dette værktøj?
Dette værktøj udtrækker tekst fra et fotografi af en bog, lærebog eller trykt side ved hjælp af OCR (optisk tegngenkendelse), der kører udelukkende i din browser. I modsætning til scannerbaserede OCR-værktøjer er det bygget omkring det specifikke problem med håndholdte fotos: sider fotograferet i en let vinkel, hvilket er næsten uundgåeligt, når du holder en telefon over en åben bog i stedet for at trykke den fladt mod en scannerglasplade.
Før genkendelsen overhovedet starter, analyserer værktøjet billedet for at fastslå præcis hvor mange grader det er drejet fra vandret, og retter det derefter automatisk op. Dette ene trin betyder mere end næsten alt andet for foto-baseret OCR: en side fotograferet blot 10-12 grader skævt kan sænke genkendelsesnøjagtigheden fra over 95% til under 70%, og forvandle tydeligt læsbar tekst til volapyk — at rette skævheden først genskaber resultater tæt på scannerkvalitet.
Hvorfor fotovinkel betyder mere, end man skulle tro
OCR-motorer læser tekst ved at skanne pixelrækker og lede efter konsistente vandrette bånd af blæk — det er sådan de adskiller en tekstlinje fra den næste. Når en side hælder blot en smule, bliver det, der burde være en ren vandret tekstlinje, til en diagonal udtværing over mange pixelrækker, og motorens linjesegmenteringslogik begynder at sammenblande tegn fra tilstødende linjer eller splitte enkelte tegn ad.
Det er derfor, et foto der ser perfekt læsbart ud for dine øjne, stadig kan give volapyk-OCR-output: din hjerne kompenserer ubesværet for en let hældning, men en naiv OCR-pipeline gør ikke. Løsningen er ikke en klogere genkendelsesmodel — det er at rette billedet op først, hvilket er præcis, hvad den automatiske korrektion i dette værktøj gør, før genkendelsen overhovedet køres.
Almindelige anvendelser
- Digitalisering af noter eller uddrag fra en fysisk lærebog uden at skrive dem igen med hånden.
- Udtrækning af et afsnit fra en gammel paperback eller lånt bog for at citere eller søge i det senere.
- Konvertering af et fotograferet handout, arbejdsark eller trykt artikel til søgbar, redigerbar tekst.
- Arkivering af sider fra en bog, der er ved at falde fra hinanden eller er for skrøbelig til at scanne fladt på en scannerplade.
Sådan opnår du de bedste resultater
- God, jævn belysning betyder mere end en perfekt stabil hånd — et lidt skævt, men velbelyst foto klarer sig bedre end et vandret foto med kraftig skygge hen over teksten.
- Undgå direkte blitz på blanke sider; det resulterende genskin/lyspunkt kan slette teksten under det, uanset vinkelkorrektion.
- Få hele siden med i billedet med lidt margin — for stram beskæring kan skære den første eller sidste linje af.
- Ved meget lange afsnit, fotografér og behandl én side ad gangen frem for at forsøge at fange et opslag med to sider, hvilket introducerer sin egen krumningsforvrængning nær ryggen.
Hvorfor bruge det?
Automatisk skævhedskorrektion: registrerer og retter skæve fotovinkler op før genkendelse, den enkeltvis vigtigste faktor for nøjagtighed ved håndholdte bogfotos.
Fuldstændig offline-behandling: fotoet og den udtrukne tekst forlader aldrig din browser — intet uploades til en server.
Fungerer til gamle, gulnede eller let falmede bogsider samt skarpt moderne tryk.
Understøtter flere genkendelsessprog (engelsk, kinesisk, spansk, fransk, tysk, japansk), så du kan skanne bøger på forskellige sprog.
Ingen konto, ingen uploadgrænse, intet abonnement — gratis for lige så mange sider, du har brug for.
Ofte stillede spørgsmål
Hvorfor kræver mit bogfoto særlig behandling frem for almindelig OCR?
Almindelige OCR-værktøjer er som regel testet og indstillet til flade, perfekt justerede scanninger. En bogside fotograferet med hånden er næsten aldrig vandret — selv en lille hældning på 8-12 grader, som er normalt for et håndholdt billede, kan sænke genkendelsesnøjagtigheden til langt under 70%. Dette værktøj måler den hældning og retter den automatisk op, før genkendelsen køres, hvilket er forskellen mellem brugbar tekst og volapyk-output.
Fungerer dette på gamle eller gulnede bogsider?
Ja — misfarvning af siden og mildt kontrasttab fra ældet papir har meget lille effekt på genkendelsesnøjagtigheden i sig selv. Fotoets vinkel er den dominerende faktor, ikke papirets farve, så gamle paperbacks og brugte lærebøger fungerer omtrent lige så godt som nye, når billedet først er rettet op.
Bliver mit foto uploadet nogen steder?
Nej. Både skævhedsregistreringen og tekstgenkendelsen kører udelukkende i din browser ved hjælp af WebAssembly — intet om dit foto eller dets indhold sendes til nogen server. Du kan endda afbryde internetforbindelsen, efter siden er indlæst første gang, og det vil fortsætte med at fungere (bortset fra den ene-gangs download af genkendelsesmotoren).
Kan jeg slå automatisk korrektion fra, hvis mit foto allerede er lige?
Ja, fjern markeringen ved "Automatisk skævhedskorrektion", hvis du arbejder ud fra en flad scanning eller et foto, du allerede har rettet op — det springer registreringstrinnet over og kører genkendelse en smule hurtigere.
Hvorfor er den første udtrækning langsom?
Første gang du klikker på "Udtræk tekst", downloader værktøjet OCR-genkendelsesmotoren (nogle få megabyte, kun én gang, derefter cachelagret af din browser). Hver udtrækning derefter er meget hurtigere, da motoren allerede er indlæst.
Hvilke sprog kan den genkende?
Engelsk, forenklet kinesisk, spansk, fransk, tysk og japansk er tilgængelige i sprogvælgeren. Vælg det sprog, siden faktisk er trykt på, for den bedste nøjagtighed — genkendelseskvaliteten falder kraftigt, hvis det forkerte sprog er valgt.