Como usar
- Tira uma fotografia da página do livro — tenta enquadrar a página toda, mas não se preocupe em manter a câmera perfeitamente nivelada.
- Clique ou arraste a fotografia para a área de carregamento.
- Deixe a opção «Correção automática de distorção» marcada (está ativada por predefinição) e selecione o idioma da página.
- Clique em «Extrair texto» — a ferramenta endireita primeiro a imagem e, em seguida, reconhece o texto.
- Copie o resultado ou faça o download como um arquivo .txt.
Exemplo
Entrada
A phone photo of an open paperback page, held at roughly a 10° angleResultado
Detected skew: -10.5° → text extracted with full paragraph structure preservedSem a etapa de correção da inclinação, uma fotografia tirada neste ângulo perde normalmente um terço das palavras devido a erros de leitura; corrigir primeiro o ângulo permite que o reconhecimento volte a atingir uma precisão próxima da do scanner.
O que é esta ferramenta?
Esta ferramenta extrai texto de uma fotografia de um livro, manual escolar ou página impressa, utilizando OCR (reconhecimento ótico de caracteres) que funciona inteiramente no seu navegador. Ao contrário das ferramentas de OCR baseadas em scanner, esta foi concebida a pensar no problema específico das fotografias tiradas com o celular na mão: páginas fotografadas com um ligeiro ângulo, o que é praticamente inevitável quando se segura o celular sobre um livro aberto, em vez de o colocar na horizontal sobre o vidro de um scanner.
Antes mesmo de o reconhecimento começar, a ferramenta analisa a imagem para detetar exatamente quantos graus está rodada em relação à horizontal e, em seguida, endireita-a automaticamente. Este único passo é mais importante do que quase qualquer outra coisa no OCR baseado em fotografias: uma página fotografada com um desvio de apenas 10 a 12 graus em relação à horizontal pode fazer com que a precisão do reconhecimento caia de mais de 95% para menos de 70%, transformando texto claramente legível em um disparate incompreensível — a correção do desvio restaura-o, proporcionando resultados com qualidade quase idêntica à de um scanner.
Por que é que o ângulo da fotografia é mais importante do que se possa pensar
Os motores de OCR lêem o texto analisando linhas de píxeis à procura de faixas horizontais consistentes de tinta — é assim que separam uma linha de texto da seguinte. Quando uma página está inclinada, mesmo que ligeiramente, o que deveria ser uma linha horizontal nítida de texto transforma-se numa mancha diagonal que atravessa várias linhas de píxeis, e a lógica de segmentação de linhas do motor começa a fundir caracteres de linhas adjacentes ou a separar caracteres individuais.
É por isso que uma fotografia que parece perfeitamente legível aos seus olhos pode, mesmo assim, produzir resultados de OCR distorcidos: o seu cérebro compensa sem esforço uma ligeira inclinação, mas um processo de OCR simples não o faz. A solução não é um modelo de reconhecimento mais inteligente — é endireitar a imagem primeiro, que é exatamente o que a etapa de correção automática desta ferramenta faz antes mesmo de o reconhecimento ser executado.
Casos de utilização comuns
- Digitalizar notas ou excertos de um livro didático físico sem ter de os voltar a escrever à mão.
- Extrair uma passagem de um livro de bolso antigo ou de um livro da biblioteca para citar ou pesquisar mais tarde.
- Converter um folheto, uma ficha de trabalho ou um artigo impresso, fotografado, em texto pesquisável e editável.
- Arquivar páginas de um livro que está desmoronando-se ou que é demasiado frágil para ser digitalizado na superfície plana de um scanner.
→ Conversor de imagens para arte ASCII · Contador de palavras
Obter os melhores resultados
- Uma iluminação boa e uniforme é mais importante do que uma mão perfeitamente firme — uma fotografia ligeiramente torta, mas bem iluminada, fica melhor do que uma fotografia direita com uma sombra intensa sobre o texto.
- Evite utilizar o flash diretamente sobre páginas brilhantes; o reflexo ou ponto de luz resultante pode ocultar o texto que se encontra por baixo, independentemente da correção do ângulo.
- Ajuste a página inteira no quadro, deixando uma pequena margem — se recortar demasiado rente, pode cortar a primeira ou a última linha.
- No caso de passagens muito longas, fotografe e processe uma página de cada vez, em vez de tentar capturar uma página dupla, o que provoca uma distorção devido à curvatura junto à lombada.
Por que usar?
Correção automática da inclinação: deteta e corrige ângulos de fotografia inclinados antes do reconhecimento, sendo este o principal fator de precisão nas fotografias de livros tiradas à mão.
Processamento totalmente offline: a fotografia e o texto extraído nunca saem do seu navegador — nada é enviado para um servidor.
Funciona tanto em páginas de livros antigas, amareladas ou ligeiramente desbotadas, como em impressões modernas e nítidas.
Suporta vários idiomas de reconhecimento (inglês, chinês, espanhol, francês, alemão, japonês), para que possa digitalizar livros em diferentes idiomas.
Sem conta, sem limite de uploads, sem subscrição — gratuito para quantas páginas precisar.
Perguntas frequentes
Por que é que a foto do meu livro requer um tratamento especial em vez do OCR normal?
As ferramentas de OCR convencionais são normalmente testadas e ajustadas com digitalizações planas e perfeitamente alinhadas. Uma página de livro fotografada manualmente quase nunca está nivelada — mesmo uma ligeira inclinação de 8 a 12 graus, o que é normal numa fotografia tirada à mão, pode fazer com que a precisão do reconhecimento desça para bem abaixo dos 70%. Esta ferramenta mede essa inclinação e corrige-a automaticamente antes de executar o reconhecimento, o que faz toda a diferença entre texto utilizável e resultados distorcidos.
Isto funciona em páginas de livros antigas ou amareladas?
Sim — a descoloração das páginas e a ligeira perda de contraste devidas ao envelhecimento do papel têm, por si só, um efeito muito reduzido na precisão do reconhecimento. O ângulo da fotografia é o fator determinante, e não a cor do papel; por isso, os livros de bolso antigos e os manuais escolares usados funcionam tão bem quanto os novos, desde que a imagem seja endireitada.
A minha fotografia está publicada em algum sítio?
Não. Tanto a deteção de inclinação como o reconhecimento de texto são executados inteiramente no seu navegador, utilizando WebAssembly — nada relativo à sua fotografia ou ao seu conteúdo é enviado para qualquer servidor. Pode até desligar-se da Internet após o carregamento inicial da página e o serviço continuará a funcionar (à exceção do download único do motor de reconhecimento).
Posso desativar a correção automática se a minha fotografia já estiver direita?
Sim, desmarque a opção «Correção automática da inclinação» se estiver trabalhando a partir de uma digitalização plana ou de uma fotografia que já tenha endireitado — isto ignora a etapa de deteção e torna o reconhecimento ligeiramente mais rápido.
Por que é que a primeira extração é lenta?
Na primeira vez que clicar em «Extrair texto», a ferramenta descarrega o motor de reconhecimento OCR (alguns megabytes, apenas uma vez; posteriormente, fica armazenado na cache do seu navegador). Todas as extrações seguintes são muito mais rápidas, uma vez que o motor já se encontra carregado.
Que línguas consegue reconhecer?
O seletor de idiomas disponibiliza inglês, chinês simplificado, espanhol, francês, alemão e japonês. Escolha o idioma em que a página está efetivamente impressa para obter a melhor precisão — a qualidade do reconhecimento diminui drasticamente se for selecionado o idioma errado.