CodeKitHub
Français
Outils image

Photo de page de livre en texte

Transformez la photo d'une page de livre en texte modifiable et consultable — conçu spécifiquement pour de vraies photos de vrais livres, pas pour des numérisations de documents bien à plat. La plupart des outils OCR supposent une numérisation parfaitement alignée ; celui-ci détecte et corrige automatiquement l'angle de travers obtenu en photographiant une page à la main, puis reconnaît le texte. Tout s'exécute dans votre navigateur : la photo et le texte extrait ne quittent jamais votre appareil.

Mode d'emploi

  1. Prenez une photo de la page du livre — essayez de cadrer toute la page, mais ne vous souciez pas de tenir l'appareil parfaitement à l'horizontale.
  2. Cliquez ou glissez-déposez la photo dans la zone de téléversement.
  3. Laissez « Corriger automatiquement l'inclinaison » coché (activé par défaut) et choisissez la langue de la page.
  4. Cliquez sur « Extraire le texte » — l'outil redresse d'abord l'image, puis reconnaît le texte.
  5. Copiez le résultat ou téléchargez-le sous forme de fichier .txt.

Exemple

Entrée

Une photo prise au téléphone d'une page de livre de poche ouvert, tenue avec un angle d'environ 10°

Résultat

Inclinaison détectée : -10,5° → texte extrait en conservant toute la structure des paragraphes

Sans l'étape de correction de l'inclinaison, une photo à cet angle perd généralement un tiers de ses mots à cause d'erreurs de lecture ; corriger l'angle en premier ramène la reconnaissance à une précision proche de celle d'un scanner.

En quoi consiste cet outil ?

Cet outil extrait le texte d'une photographie d'un livre, d'un manuel ou d'une page imprimée grâce à l'OCR (reconnaissance optique de caractères) qui s'exécute entièrement dans votre navigateur. Contrairement aux outils OCR basés sur un scanner, il est conçu autour du problème spécifique des photos prises à la main : des pages photographiées avec un léger angle, ce qui est presque inévitable lorsque vous tenez un téléphone au-dessus d'un livre ouvert au lieu de le presser à plat sur la vitre d'un scanner.

Avant même que la reconnaissance ne commence, l'outil analyse l'image pour détecter précisément de combien de degrés elle est inclinée par rapport à l'horizontale, puis la redresse automatiquement. Cette seule étape compte plus que presque tout le reste pour l'OCR basé sur des photos : une page photographiée avec seulement 10 à 12 degrés d'inclinaison peut faire chuter la précision de reconnaissance de plus de 95 % à moins de 70 %, transformant un texte clairement lisible en charabia — corriger l'inclinaison en premier restaure des résultats proches de la qualité d'un scanner.

Pourquoi l'angle de la photo compte plus qu'on ne le pense

Les moteurs OCR lisent le texte en balayant des rangées de pixels à la recherche de bandes horizontales d'encre cohérentes — c'est ainsi qu'ils distinguent une ligne de texte de la suivante. Quand une page est inclinée, même légèrement, ce qui devrait être une ligne de texte horizontale et nette devient une traînée diagonale sur de nombreuses rangées de pixels, et la logique de segmentation des lignes du moteur commence à fusionner des caractères de lignes adjacentes ou à scinder un seul caractère en plusieurs morceaux.

C'est pourquoi une photo qui vous paraît parfaitement lisible peut quand même produire un résultat OCR illisible : votre cerveau compense sans effort une légère inclinaison, mais un pipeline OCR naïf ne le fait pas. La solution n'est pas un modèle de reconnaissance plus intelligent — c'est de redresser l'image en premier, exactement ce que fait l'étape de correction automatique de cet outil avant que la reconnaissance ne s'exécute.

Cas d'usage courants

  • Numériser des notes ou des extraits d'un manuel physique sans avoir à les retaper à la main.
  • Extraire un passage d'un vieux livre de poche ou d'un livre de bibliothèque pour le citer ou le rechercher plus tard.
  • Convertir une fiche, un exercice ou un article imprimé photographié en texte consultable et modifiable.
  • Archiver les pages d'un livre en train de se déliter ou trop fragile pour être numérisé bien à plat sur un scanner.

Convertisseur d'images en art ASCII · Compteur de mots

Comment obtenir les meilleurs résultats

  • Un éclairage bon et uniforme compte plus qu'une main parfaitement stable — une photo un peu de travers mais bien éclairée surpasse une photo droite avec une ombre marquée sur le texte.
  • Évitez le flash direct sur des pages brillantes ; le reflet ou point lumineux qui en résulte peut effacer le texte en dessous, quelle que soit la correction d'angle.
  • Cadrez toute la page avec un peu de marge — recadrer trop serré peut couper la première ou la dernière ligne.
  • Pour les passages très longs, photographiez et traitez une page à la fois plutôt que d'essayer de capturer une double page, ce qui introduit sa propre distorsion de courbure près de la reliure.

Pourquoi l'utiliser ?

Correction automatique de l'inclinaison : détecte et redresse les angles de photo de travers avant la reconnaissance, le facteur individuel le plus important pour la précision des photos de livres prises à la main.

Traitement entièrement hors ligne : la photo et le texte extrait ne quittent jamais votre navigateur — rien n'est envoyé à un serveur.

Fonctionne aussi bien sur des pages de livres anciennes, jaunies ou légèrement fanées que sur des impressions modernes nettes.

Prend en charge plusieurs langues de reconnaissance (anglais, chinois, espagnol, français, allemand, japonais) pour scanner des livres dans différentes langues.

Sans compte, sans limite de téléversement, sans abonnement — gratuit pour autant de pages que nécessaire.

Foire aux questions

Pourquoi ma photo de livre nécessite-t-elle un traitement spécial plutôt qu'un OCR classique ?

Les outils OCR classiques sont généralement testés et réglés sur des numérisations plates et parfaitement alignées. Une page de livre photographiée à la main n'est presque jamais à l'horizontale — même une légère inclinaison de 8 à 12 degrés, normale pour une prise de vue à main levée, peut faire chuter la précision de reconnaissance bien en dessous de 70 %. Cet outil mesure cette inclinaison et la corrige automatiquement avant d'exécuter la reconnaissance, ce qui fait toute la différence entre un texte exploitable et un résultat illisible.

Est-ce que ça fonctionne sur des pages de livres anciennes ou jaunies ?

Oui — la décoloration de la page et la légère perte de contraste due au vieillissement du papier ont, à elles seules, très peu d'effet sur la précision de la reconnaissance. L'angle de la photo est le facteur dominant, pas la couleur du papier, donc les vieux livres de poche et les manuels d'occasion fonctionnent presque aussi bien que les neufs une fois l'image redressée.

Ma photo est-elle envoyée quelque part ?

Non. La détection de l'inclinaison comme la reconnaissance du texte s'exécutent entièrement dans votre navigateur grâce à WebAssembly — rien de votre photo ni de son contenu n'est envoyé à un serveur. Vous pouvez même vous déconnecter d'internet après le premier chargement de la page et ça continuera de fonctionner (à l'exception du téléchargement unique du moteur de reconnaissance).

Puis-je désactiver la correction automatique si ma photo est déjà droite ?

Oui, décochez « Corriger automatiquement l'inclinaison » si vous travaillez à partir d'une numérisation plate ou d'une photo que vous avez déjà redressée vous-même — cela saute l'étape de détection et la reconnaissance s'exécute un peu plus vite.

Pourquoi la première extraction est-elle lente ?

La première fois que vous cliquez sur « Extraire le texte », l'outil télécharge le moteur de reconnaissance OCR (quelques mégaoctets, une seule fois, mis en cache par votre navigateur ensuite). Chaque extraction suivante est bien plus rapide puisque le moteur est déjà chargé.

Quelles langues peut-il reconnaître ?

L'anglais, le chinois simplifié, l'espagnol, le français, l'allemand et le japonais sont disponibles dans le sélecteur de langue. Choisissez la langue réellement imprimée sur la page pour obtenir la meilleure précision — la qualité de reconnaissance chute fortement si la mauvaise langue est sélectionnée.

Outils associés