CodeKitHub
Español
Herramientas de imagen

Foto de página de libro a texto

Convierte una foto de una página de un libro en texto editable y buscable — diseñado específicamente para fotos reales de libros reales, no para escaneos planos de documentos. La mayoría de las herramientas OCR asumen un escaneo perfectamente alineado; esta detecta y corrige automáticamente el ángulo torcido típico de fotografiar una página a mano, y luego reconoce el texto. Todo se ejecuta en tu navegador: la foto y el texto extraído nunca salen de tu dispositivo.

Cómo utilizarlo

  1. Haz una foto de la página del libro — intenta encuadrar toda la página, pero no te preocupes por sostener la cámara perfectamente nivelada.
  2. Haz clic o arrastra la foto al área de subida.
  3. Deja marcada la opción «Corregir inclinación automáticamente» (activada por defecto) y elige el idioma de la página.
  4. Haz clic en «Extraer texto» — la herramienta endereza la imagen primero y luego reconoce el texto.
  5. Copia el resultado o descárgalo como archivo .txt.

Ejemplo

Entrada

Una foto de móvil de una página de un libro de bolsillo abierto, sostenida con un ángulo de unos 10°

Resultado

Inclinación detectada: -10,5° → texto extraído conservando toda la estructura de párrafos

Sin el paso de corrección de inclinación, una foto con este ángulo suele perder un tercio de sus palabras por errores de lectura; corregir el ángulo primero devuelve el reconocimiento a una precisión casi de escáner.

¿Qué es esta herramienta?

Esta herramienta extrae texto de una fotografía de un libro, libro de texto o página impresa usando OCR (reconocimiento óptico de caracteres) que se ejecuta enteramente dentro de tu navegador. A diferencia de las herramientas OCR basadas en escáner, está construida en torno al problema específico de las fotos hechas a mano: páginas fotografiadas en un ligero ángulo, algo casi inevitable cuando sostienes un teléfono sobre un libro abierto en lugar de presionarlo plano contra el cristal de un escáner.

Antes de que empiece siquiera el reconocimiento, la herramienta analiza la imagen para detectar exactamente cuántos grados está rotada respecto a la horizontal, y luego la endereza automáticamente. Este único paso importa más que casi cualquier otra cosa en el OCR basado en fotos: una página fotografiada con solo 10-12 grados de inclinación puede hacer que la precisión de reconocimiento caiga de más del 95% a menos del 70%, convirtiendo texto claramente legible en un galimatías — corregir la inclinación primero restaura resultados casi a la calidad de un escáner.

Por qué el ángulo de la foto importa más de lo que crees

Los motores OCR leen el texto escaneando filas de píxeles en busca de bandas horizontales consistentes de tinta — así es como separan una línea de texto de la siguiente. Cuando una página está inclinada aunque sea ligeramente, lo que debería ser una línea de texto limpia y horizontal se convierte en un trazo diagonal que atraviesa muchas filas de píxeles, y la lógica de segmentación de líneas del motor empieza a mezclar caracteres de líneas adyacentes o a partir un solo carácter en varios.

Por eso una foto que a tus ojos parece perfectamente legible puede seguir produciendo un resultado de OCR ilegible: tu cerebro compensa sin esfuerzo una ligera inclinación, pero un proceso de OCR simple no lo hace. La solución no es un modelo de reconocimiento más inteligente — es enderezar la imagen primero, que es exactamente lo que hace el paso de corrección automática de esta herramienta antes de que se ejecute el reconocimiento.

Casos de uso habituales

  • Digitalizar apuntes o fragmentos de un libro de texto físico sin tener que volver a escribirlos a mano.
  • Extraer un pasaje de un libro de bolsillo antiguo o de una biblioteca para citarlo o buscarlo más tarde.
  • Convertir una hoja de ejercicios, ficha o artículo impreso fotografiado en texto buscable y editable.
  • Archivar páginas de un libro que se está deshaciendo o es demasiado frágil para escanearlo plano en un escáner.

Convertidor de imágenes a arte ASCII · Contador de palabras

Cómo conseguir los mejores resultados

  • Una iluminación buena y uniforme importa más que una mano perfectamente firme — una foto algo torcida pero bien iluminada supera a una foto nivelada con sombras marcadas sobre el texto.
  • Evita el flash directo sobre páginas satinadas; el reflejo o punto de luz resultante puede borrar el texto que hay debajo, sin importar la corrección de ángulo.
  • Encuadra toda la página con un poco de margen — recortar demasiado ajustado puede cortar la primera o la última línea.
  • Para pasajes muy largos, fotografía y procesa una página a la vez en lugar de intentar capturar una doble página, que introduce su propia distorsión de curvatura cerca del lomo.

¿Por qué utilizarlo?

Corrección automática de inclinación: detecta y endereza ángulos torcidos de la foto antes del reconocimiento, el factor individual más importante para la precisión en fotos de libros hechas a mano.

Procesamiento totalmente sin conexión: la foto y el texto extraído nunca salen de tu navegador — no se sube nada a un servidor.

Funciona tanto con páginas de libros antiguas, amarillentas o algo desvaídas como con impresiones modernas nítidas.

Admite varios idiomas de reconocimiento (inglés, chino, español, francés, alemán, japonés) para que puedas escanear libros en distintos idiomas.

Sin cuenta, sin límite de subidas, sin suscripción — gratis para tantas páginas como necesites.

Preguntas frecuentes

¿Por qué mi foto de un libro necesita un tratamiento especial en vez de un OCR normal?

Las herramientas OCR normales suelen estar probadas y ajustadas sobre escaneos planos y perfectamente alineados. Una página de libro fotografiada a mano casi nunca está nivelada — incluso una inclinación pequeña de 8-12 grados, normal en una foto sostenida a mano, puede hundir la precisión de reconocimiento muy por debajo del 70%. Esta herramienta mide esa inclinación y la corrige automáticamente antes de reconocer, lo que marca la diferencia entre un texto utilizable y un resultado ilegible.

¿Funciona con páginas de libros antiguas o amarillentas?

Sí — la decoloración de la página y la ligera pérdida de contraste por el envejecimiento del papel tienen muy poco efecto en la precisión del reconocimiento por sí solas. El ángulo de la foto es el factor dominante, no el color del papel, así que los libros de bolsillo antiguos y los libros de texto usados funcionan casi tan bien como los nuevos una vez enderezada la imagen.

¿Se sube mi foto a algún sitio?

No. Tanto la detección de inclinación como el reconocimiento de texto se ejecutan enteramente en tu navegador usando WebAssembly — nada de tu foto ni de su contenido se envía a ningún servidor. Incluso puedes desconectarte de internet después de que la página cargue por primera vez y seguirá funcionando (salvo por la descarga única del motor de reconocimiento).

¿Puedo desactivar la corrección automática si mi foto ya está recta?

Sí, desmarca «Corregir inclinación automáticamente» si trabajas con un escaneo plano o una foto que ya has enderezado tú mismo — esto salta el paso de detección y el reconocimiento se ejecuta un poco más rápido.

¿Por qué la primera extracción es lenta?

La primera vez que haces clic en «Extraer texto», la herramienta descarga el motor de reconocimiento OCR (unos pocos megabytes, solo una vez, guardados en caché por tu navegador después). Cada extracción posterior es mucho más rápida porque el motor ya está cargado.

¿Qué idiomas puede reconocer?

Inglés, chino simplificado, español, francés, alemán y japonés están disponibles en el selector de idioma. Elige el idioma en el que está realmente impresa la página para obtener la mejor precisión — la calidad del reconocimiento cae en picado si se selecciona el idioma incorrecto.

Herramientas relacionadas