CodeKitHub
Bildeverktøy

Bokside til Tekst

Sist oppdatert:

Gjør et bilde av en bokside om til redigerbar, søkbar tekst — laget spesielt for ekte foto av ekte bøker, ikke flate dokumentskanninger. De fleste OCR-verktøy forutsetter en perfekt oppretta skanning; dette oppdager og retter automatisk den skjeve vinkelen du får når du fotograferer en side for hånd, og gjenkjenner deretter teksten. Alt skjer i nettleseren din: bildet og tekstuttrekket forlater aldri enheten din.

Slik bruker du det

  1. Ta et bilde av booksiden — prøv å få hele siden med i bildet, men ikke bry deg om å holde kameraet helt vannrett.
  2. Klikk eller dra bildet inn i opplastingsområdet.
  3. La «Auto-correct skew» stå avkrysset (den er på som standard) og velg språket på siden.
  4. Klikk «Extract text» — verktøyet retter opp bildet først, og gjenkjenner deretter teksten.
  5. Kopier resultatet eller last det ned som en .txt-fil.

Eksempel

Inndata

Et mobilfoto av en åpen pocketbok-side, holdt i omtrent 10° vinkel

Resultat

Registrert skjevhet: -10,5° → tekst hentet ut med hele avsnittsstrukturen bevart

Uten opprettingstrinnet mister et foto i denne vinkelen typisk en tredjedel av ordene til feillesninger; å rette opp vinkelen først bringer gjenkjenningen nesten tilbake til skannerkvalitet.

Hva er dette verktøyet?

Dette verktøyet trekker ut tekst fra et fotografi av en bok, lærebok eller trykt side ved hjelp av OCR (optisk tegngjenkjenning) som kjører utelukkende i nettleseren din. I motsetning til skannerbaserte OCR-verktøy, er det bygget rundt det spesifikke problemet med håndholdte foto: sider fotografert i en liten vinkel, noe som er nesten uunngåelig når du holder en mobil over en åpen bok i stedet for å presse den flatt mot skannerglasset.

Før selve gjenkjenningen starter, analyserer verktøyet bildet for å finne nøyaktig hvor mange grader det er rotert fra vannrett, og retter det deretter opp automatisk. Dette ene trinnet betyr mer enn nesten alt annet for foto-basert OCR: en side fotografert bare 10–12 grader skjevt kan senke gjenkjenningsnøyaktigheten fra over 95 % til under 70 %, og gjøre tydelig lesbar tekst om til usammenhengende rot — å rette opp skjevheten først gjenoppretter resultater nesten på skannerkvalitet.

Hvorfor fotovinkelen betyr mer enn du skulle tro

OCR-motorer leser tekst ved å skanne pikselrader og lete etter jevne, vannrette bånd av trykksverte — det er slik de skiller én tekstlinje fra den neste. Når en side er skjev, selv bare litt, blir det som skulle vært en ren vannrett tekstlinje til en diagonal utsmøring over mange pikselrader, og motorens logikk for linjeoppdeling begynner å slå sammen tegn fra tilstøtende linjer eller dele opp enkelttegn.

Det er derfor et foto som ser helt lesbart ut for øyet, likevel kan gi uleselig OCR-resultat: hjernen din kompenserer uanstrengt for en liten helning, men en naiv OCR-pipeline gjør ikke det. Løsningen er ikke en smartere gjenkjenningsmodell — det er å rette opp bildet først, som er nøyaktig det autokorreksjonstrinnet i dette verktøyet gjør før gjenkjenningen i det hele tatt kjøres.

Vanlige bruksområder

  • Digitalisere notater eller utdrag fra en fysisk lærebok uten å skrive dem inn på nytt for hånd.
  • Hente ut et avsnitt fra en gammel pocketbok eller bibliotekbok for å sitere eller søke i det senere.
  • Konvertere et fotografert handout, arbeidsark eller trykt artikkel til søkbar, redigerbar tekst.
  • Arkivere sider fra en bok som er i ferd med å falle fra hverandre eller er for skjør til å legges flatt på en skanner.

Bilde til ASCII-kunst-konverterer · Ordteller

Slik får du best resultat

  • God, jevn belysning betyr mer enn en helt stø hånd — et litt skjevt, men godt opplyst bilde slår et rett bilde med tunge skygger over teksten.
  • Unngå direkte blits på blanke sider; det resulterende gjenskinnet kan viske ut teksten under det uansett vinkelkorreksjon.
  • Få med hele siden i bildet med litt margin — beskjærer du for tett, kan du kutte av første eller siste linje.
  • For lange tekster, fotografer og behandle én side om gangen i stedet for å prøve å fange et oppslag over to sider, som gir sin egen krumningsforvrengning nær ryggen.

Hvorfor bruke det?

Automatisk skjevhetskorreksjon: oppdager og retter opp skjeve fotovinkler før gjenkjenning, den enkeltfaktoren som betyr mest for nøyaktigheten på håndholdte bokfoto.

Fullstendig frakoblet behandling: bildet og den uttrukne teksten forlater aldri nettleseren din — ingenting lastes opp til en server.

Fungerer for gamle, gulnede eller lett falmede boksider like godt som for sprekt moderne trykk.

Støtter flere gjenkjenningsspråk (engelsk, kinesisk, spansk, fransk, tysk, japansk) slik at du kan skanne bøker på ulike språk.

Ingen konto, ingen opplastingsgrense, ingen abonnement — gratis for så mange sider du trenger.

Ofte stilte spørsmål

Hvorfor trenger bokfotoet mitt spesialbehandling i stedet for vanlig OCR?

Vanlige OCR-verktøy er som regel testet og tilpasset flate, perfekt oppretta skanninger. En bokside fotografert for hånd er nesten aldri vannrett — selv en liten helning på 8–12 grader, som er normalt for et håndholdt bilde, kan få gjenkjenningsnøyaktigheten til å stupe godt under 70 %. Dette verktøyet måler den helningen og retter den opp automatisk før gjenkjenningen kjøres, noe som er forskjellen mellom brukbar tekst og uleselig rot.

Fungerer dette på gamle eller gulnede boksider?

Ja — misfarging på siden og lett tap av kontrast fra gammelt papir har svært liten effekt på gjenkjenningsnøyaktigheten i seg selv. Fotovinkelen er den avgjørende faktoren, ikke papirets farge, så gamle pocketbøker og brukte lærebøker fungerer omtrent like godt som nye når bildet først er rettet opp.

Blir bildet mitt lastet opp noe sted?

Nei. Både skjevhetsdeteksjonen og tekstgjenkjenningen kjører utelukkende i nettleseren din ved hjelp av WebAssembly — ingenting om bildet ditt eller innholdet sendes til noen server. Du kan til og med koble fra internett etter at siden er lastet inn første gang, og den vil fortsette å fungere (bortsett fra den engangs nedlastingen av gjenkjenningsmotoren).

Kan jeg skru av autokorreksjonen hvis bildet mitt allerede er rett?

Ja, fjern haken ved «Auto-correct skew» hvis du jobber med en flat skanning eller et bilde du allerede har rettet opp selv — dette hopper over deteksjonstrinnet og gjør gjenkjenningen litt raskere.

Hvorfor er den første uthentingen treg?

Første gang du klikker «Extract text», laster verktøyet ned OCR-gjenkjenningsmotoren (noen få megabyte, kun én gang, deretter mellomlagret av nettleseren din). Hver uthenting etter det er mye raskere siden motoren allerede er lastet inn.

Hvilke språk kan den gjenkjenne?

Engelsk, forenklet kinesisk, spansk, fransk, tysk og japansk er tilgjengelige i språkvelgeren. Velg språket siden faktisk er trykt på for best nøyaktighet — gjenkjenningskvaliteten synker kraftig hvis feil språk er valgt.

Relaterte verktøy