CodeKitHub
Afbeeldingstools

Boekpagina naar Tekst

Laatst bijgewerkt:

Zet een foto van een boekpagina om in bewerkbare, doorzoekbare tekst — specifiek gebouwd voor echte foto's van echte boeken, geen platte documentscans. De meeste OCR-tools gaan uit van een perfect uitgelijnde scan; deze detecteert en corrigeert automatisch de scheve hoek die ontstaat als je een pagina met de hand fotografeert, en herkent daarna de tekst. Alles draait in je browser: de foto en de tekstextractie verlaten nooit je apparaat.

Hoe te gebruiken

  1. Maak een foto van de boekpagina — probeer de hele pagina in beeld te krijgen, maar hoef de camera niet perfect waterpas te houden.
  2. Klik op of sleep de foto naar het uploadvak.
  3. Laat "Scheefstand automatisch corrigeren" aangevinkt (standaard aan) en kies de taal van de pagina.
  4. Klik op "Tekst extraheren" — de tool richt de afbeelding eerst recht en herkent daarna de tekst.
  5. Kopieer het resultaat of download het als .txt-bestand.

Voorbeeld

Invoer

Een telefoonfoto van een opengeslagen paperbackpagina, onder ongeveer een hoek van 10° vastgehouden

Uitvoer

Gedetecteerde scheefstand: -10,5° → tekst geëxtraheerd met volledig behouden alineastructuur

Zonder de scheefstandcorrectie verliest een foto onder deze hoek doorgaans een derde van de woorden door verkeerd gelezen tekens; het rechttrekken van de hoek vooraf brengt de herkenning terug tot bijna scannerniveau.

Wat is deze tool?

Deze tool haalt tekst uit een foto van een boek, studieboek of gedrukte pagina met OCR (optische tekenherkenning) die volledig in je browser draait. In tegenstelling tot op scanners gebaseerde OCR-tools is deze gebouwd rond het specifieke probleem van met de hand gemaakte foto's: pagina's die onder een lichte hoek zijn gefotografeerd, wat bijna onvermijdelijk is wanneer je een telefoon boven een open boek houdt in plaats van het plat op scannerglas te drukken.

Voordat de herkenning zelfs maar begint, analyseert de tool de afbeelding om precies te bepalen hoeveel graden deze ten opzichte van horizontaal is gedraaid, en richt hem dan automatisch recht. Deze ene stap doet er meer toe dan bijna al het andere bij foto-gebaseerde OCR: een pagina die maar 10-12 graden scheef is gefotografeerd, kan de herkenningsnauwkeurigheid laten dalen van boven de 95% naar onder de 70%, waardoor duidelijk leesbare tekst in onzinnige brabbeltaal verandert — het rechttrekken vooraf herstelt bijna scannerkwaliteit-resultaten.

Waarom fotohoek meer doet dan je zou denken

OCR-engines lezen tekst door pixelrijen te scannen op zoek naar consistente horizontale inktbanden — zo scheiden ze de ene tekstregel van de volgende. Als een pagina zelfs maar licht scheef staat, wordt wat een nette horizontale tekstregel zou moeten zijn een diagonale veeg over veel pixelrijen, en begint de regelsegmentatielogica van de engine tekens van naburige regels samen te voegen of losse tekens uiteen te trekken.

Daarom kan een foto die er voor jouw ogen perfect leesbaar uitziet toch een brabbelige OCR-uitvoer opleveren: je hersenen compenseren moeiteloos voor een lichte kanteling, maar een naïeve OCR-pijplijn niet. De oplossing is geen slimmer herkenningsmodel — het is de afbeelding eerst rechttrekken, precies wat de automatische correctiestap in deze tool doet vóórdat herkenning ooit draait.

Veelvoorkomende toepassingen

  • Aantekeningen of fragmenten uit een fysiek studieboek digitaliseren zonder ze met de hand over te typen.
  • Een passage uit een oude paperback of bibliotheekboek extraheren om later te citeren of doorzoeken.
  • Een gefotografeerde handout, werkblad of gedrukt artikel omzetten naar doorzoekbare, bewerkbare tekst.
  • Pagina's archiveren uit een boek dat uit elkaar valt of te breekbaar is om plat op een scanner te scannen.

Afbeelding naar ASCII-Art Converter · Woordenteller

Zo krijg je het beste resultaat

  • Goede, gelijkmatige verlichting doet er meer toe dan een perfect stille hand — een licht scheve maar goed belichte foto presteert beter dan een waterpas foto met zware schaduw over de tekst.
  • Vermijd directe flits op glanzende pagina's; de resulterende glans/hotspot kan de tekst eronder onleesbaar maken, ongeacht de hoekcorrectie.
  • Laat de hele pagina met wat marge in beeld — te strak bijsnijden kan de eerste of laatste regel afsnijden.
  • Fotografeer en verwerk voor lange passages liever één pagina per keer dan te proberen een spread van twee pagina's te vangen, wat eigen kromming-vervorming bij de rug veroorzaakt.

Waarom gebruiken?

Automatische scheefstandcorrectie: detecteert en richt scheve fotohoeken recht vóór de herkenning, de grootste nauwkeurigheidsfactor voor met de hand gefotografeerde boekpagina's.

Volledig offline verwerking: de foto en de geëxtraheerde tekst verlaten nooit je browser — er wordt niets naar een server geüpload.

Werkt zowel voor oude, vergeelde of licht vervaagde boekpagina's als voor scherpe moderne druk.

Ondersteunt meerdere herkenningstalen (Engels, Chinees, Spaans, Frans, Duits, Japans), zodat je boeken in verschillende talen kunt scannen.

Geen account, geen uploadlimiet, geen abonnement — gratis voor zoveel pagina's als je nodig hebt.

Veelgestelde vragen

Waarom heeft mijn boekfoto speciale verwerking nodig in plaats van gewone OCR?

Gewone OCR-tools worden meestal getest en afgesteld op platte, perfect uitgelijnde scans. Een met de hand gefotografeerde boekpagina staat vrijwel nooit waterpas — zelfs een kleine kanteling van 8-12 graden, normaal voor een uit-de-hand-genomen foto, kan de herkenningsnauwkeurigheid ver onder de 70% doen kelderen. Deze tool meet die kanteling en corrigeert hem automatisch vóór de herkenning draait, wat het verschil maakt tussen bruikbare tekst en brabbeltaal.

Werkt dit op oude of vergeelde boekpagina's?

Ja — verkleuring van de pagina en licht contrastverlies door verouderd papier hebben op zichzelf zeer weinig invloed op de herkenningsnauwkeurigheid. De hoek van de foto is de dominante factor, niet de kleur van het papier, dus oude paperbacks en gebruikte studieboeken werken ongeveer even goed als nieuwe zodra de afbeelding rechtgetrokken is.

Wordt mijn foto ergens geüpload?

Nee. Zowel de scheefstanddetectie als de tekstherkenning draaien volledig in je browser met WebAssembly — niets over je foto of de inhoud ervan wordt naar een server verzonden. Je kunt zelfs de internetverbinding verbreken nadat de pagina eenmaal is geladen en het blijft werken (afgezien van de eenmalige download van de herkenningsengine).

Kan ik de automatische correctie uitschakelen als mijn foto al recht is?

Ja, vink "Scheefstand automatisch corrigeren" uit als je met een platte scan werkt of een foto die je al hebt rechtgetrokken — dit slaat de detectiestap over en laat de herkenning iets sneller verlopen.

Waarom is de eerste extractie traag?

De eerste keer dat je op "Tekst extraheren" klikt, downloadt de tool de OCR-herkenningsengine (enkele megabytes, eenmalig, daarna door je browser gecached). Elke extractie daarna gaat veel sneller omdat de engine al geladen is.

Welke talen kan het herkennen?

Engels, vereenvoudigd Chinees, Spaans, Frans, Duits en Japans zijn beschikbaar in de taalkiezer. Kies de taal waarin de pagina daadwerkelijk gedrukt is voor de beste nauwkeurigheid — de herkenningskwaliteit daalt sterk als de verkeerde taal geselecteerd is.

Gerelateerde tools