CodeKitHub
이미지 도구

책 페이지 텍스트 변환

마지막 업데이트:

책 페이지 사진을 편집하고 검색할 수 있는 텍스트로 바꿔 드립니다. 평평한 문서 스캔이 아니라 실제 책을 찍은 사진에 맞춰 특별히 만들어졌습니다. 대부분의 OCR 도구는 완벽하게 정렬된 스캔을 전제로 하지만, 이 도구는 손으로 책을 찍을 때 생기는 기울어진 각도를 자동으로 감지하고 보정한 뒤 텍스트를 인식합니다. 모든 과정이 브라우저 안에서 이루어지므로 사진과 추출된 텍스트가 기기 밖으로 나가지 않습니다.

사용 방법

  1. 책 페이지 사진을 찍으세요. 페이지 전체가 프레임 안에 들어오도록 하되, 카메라를 완벽하게 수평으로 들 필요는 없습니다.
  2. 사진을 클릭하거나 업로드 영역으로 끌어다 놓으세요.
  3. "기울기 자동 보정"을 체크된 상태로 두고(기본값으로 켜져 있습니다) 페이지의 언어를 선택하세요.
  4. "텍스트 추출"을 클릭하세요. 도구가 먼저 이미지를 똑바로 세운 뒤 텍스트를 인식합니다.
  5. 결과를 복사하거나 .txt 파일로 다운로드하세요.

예시

입력

펼쳐진 페이퍼백 페이지를 약 10도 각도로 기울여 찍은 스마트폰 사진

결과

감지된 기울기: -10.5° → 문단 구조가 그대로 보존된 상태로 텍스트 추출됨

기울기 보정 단계 없이는 이 정도 각도의 사진에서 보통 단어의 3분의 1가량이 잘못 인식됩니다. 각도를 먼저 보정하면 스캐너 수준에 가까운 인식률을 되찾을 수 있습니다.

이 도구는 무엇인가요?

이 도구는 책, 교재, 인쇄물 페이지 사진에서 텍스트를 추출하며, OCR(광학 문자 인식)이 브라우저 안에서 전부 실행됩니다. 스캐너 기반 OCR 도구와 달리 손으로 찍은 사진 특유의 문제, 즉 스캐너 유리판에 평평하게 눌러 놓는 대신 스마트폰을 펼친 책 위에 들고 찍을 때 거의 피할 수 없는 미세한 기울어짐을 해결하도록 설계되었습니다.

인식이 시작되기 전에 이 도구는 이미지를 분석해 수평 기준으로 몇 도나 회전되어 있는지 정확히 감지한 뒤 자동으로 똑바로 세웁니다. 사진 기반 OCR에서는 이 한 단계가 거의 다른 무엇보다 중요합니다. 수평에서 겨우 10~12도만 벗어나도 인식 정확도가 95% 이상에서 70% 이하로 떨어져 분명히 읽을 수 있는 텍스트가 알아볼 수 없는 문자로 뒤바뀔 수 있습니다. 기울기를 먼저 바로잡으면 스캐너로 찍은 것에 가까운 품질을 되찾을 수 있습니다.

사진 각도가 생각보다 중요한 이유

OCR 엔진은 일관된 수평 잉크 띠를 찾아 픽셀 행을 스캔하는 방식으로 텍스트를 읽습니다. 이렇게 해서 한 줄의 텍스트를 다음 줄과 구분합니다. 페이지가 조금이라도 기울어지면, 원래 깔끔한 수평선이어야 할 텍스트가 여러 픽셀 행에 걸친 대각선 얼룩이 되어버리고, 엔진의 줄 분리 로직이 인접한 줄의 문자를 서로 합치거나 한 문자를 여러 개로 쪼개기 시작합니다.

이것이 바로 사람 눈에는 완벽하게 읽히는 사진이 뒤죽박죽인 OCR 결과를 낳을 수 있는 이유입니다. 사람의 뇌는 약간의 기울기를 무리 없이 보정하지만, 단순한 OCR 파이프라인은 그렇지 못합니다. 해결책은 더 똑똑한 인식 모델이 아니라 이미지를 먼저 똑바로 세우는 것이며, 이것이 바로 이 도구의 자동 보정 단계가 인식이 실행되기 전에 하는 일입니다.

흔한 활용 사례

  • 실물 교재의 필기나 발췌 내용을 직접 다시 타이핑하지 않고 디지털화하기.
  • 오래된 페이퍼백이나 도서관 책에서 나중에 인용하거나 검색할 구절 추출하기.
  • 사진으로 찍은 유인물, 워크시트, 인쇄된 기사를 검색 및 편집 가능한 텍스트로 변환하기.
  • 낡아서 스캐너 위에 평평하게 놓기 어려운 책의 페이지를 보존하기.

이미지 to ASCII 아트 변환기 · 글자 수 세기

더 좋은 결과를 얻으려면

  • 완벽하게 흔들리지 않는 손보다 고르고 충분한 조명이 더 중요합니다. 살짝 기울었지만 조명이 좋은 사진이 수평은 맞지만 텍스트에 짙은 그림자가 진 사진보다 결과가 좋습니다.
  • 광택이 있는 페이지에는 플래시를 직접 비추지 마세요. 각도 보정과 상관없이 눈부심이나 빛 번짐이 텍스트를 지워버릴 수 있습니다.
  • 여백을 조금 남기고 페이지 전체가 프레임에 들어오도록 하세요. 너무 바짝 자르면 첫 줄이나 마지막 줄이 잘릴 수 있습니다.
  • 긴 분량은 두 페이지가 펼쳐진 상태로 한 번에 찍기보다 한 페이지씩 촬영하고 처리하세요. 펼침면을 통째로 찍으면 책등 부근에 자체적인 곡률 왜곡이 생깁니다.

왜 사용해야 할까요?

자동 기울기 보정: 인식 전에 기울어진 사진 각도를 감지하고 바로잡습니다. 손으로 찍은 책 사진의 정확도를 좌우하는 가장 큰 요인입니다.

완전한 오프라인 처리: 사진과 추출된 텍스트는 브라우저 밖으로 나가지 않습니다. 서버에 아무것도 업로드되지 않습니다.

오래되어 누렇게 변했거나 살짝 흐릿해진 책 페이지는 물론, 선명한 최신 인쇄물에도 잘 작동합니다.

여러 인식 언어(영어, 중국어, 스페인어, 프랑스어, 독일어, 일본어)를 지원해 다양한 언어의 책을 스캔할 수 있습니다.

회원가입도, 업로드 제한도, 구독료도 없이 원하는 만큼 무료로 사용할 수 있습니다.

자주 묻는 질문

왜 책 사진은 일반 OCR과 다른 특별한 처리가 필요한가요?

일반 OCR 도구는 보통 평평하고 완벽하게 정렬된 스캔본을 기준으로 테스트되고 조정됩니다. 손으로 찍은 책 페이지는 거의 수평이 맞지 않습니다. 손으로 찍을 때 흔히 발생하는 8~12도 정도의 작은 기울기만으로도 인식 정확도가 70% 아래로 크게 떨어질 수 있습니다. 이 도구는 인식을 실행하기 전에 그 기울기를 측정하고 자동으로 바로잡는데, 이 과정이 쓸 수 있는 텍스트와 알아볼 수 없는 결과물의 차이를 만듭니다.

오래되었거나 누렇게 변한 책 페이지에서도 작동하나요?

네. 오래된 종이의 변색이나 약간의 대비 저하는 그 자체로는 인식 정확도에 거의 영향을 주지 않습니다. 사진의 각도가 가장 지배적인 요인이지 종이의 색이 아니므로, 이미지가 똑바로 펴지면 오래된 페이퍼백이나 중고 교재도 새 책과 거의 비슷하게 잘 작동합니다.

사진이 어딘가에 업로드되나요?

아니요. 기울기 감지와 텍스트 인식 모두 WebAssembly를 이용해 브라우저 안에서 전부 실행되며, 사진이나 그 내용에 대한 어떤 것도 서버로 전송되지 않습니다. 페이지가 처음 로드된 이후에는 인터넷 연결을 끊어도 계속 작동합니다(단, 인식 엔진의 최초 1회 다운로드는 제외).

사진이 이미 똑바르다면 자동 보정을 꺼도 되나요?

네, 평평한 스캔본이거나 이미 직접 똑바로 편 사진으로 작업 중이라면 "기울기 자동 보정"의 체크를 해제하세요. 감지 단계를 건너뛰어 인식 속도가 조금 더 빨라집니다.

왜 첫 번째 추출이 느린가요?

"텍스트 추출"을 처음 클릭할 때 도구가 OCR 인식 엔진을 다운로드합니다(용량은 수 메가바이트로, 한 번만 다운로드되며 이후에는 브라우저에 캐시됩니다). 그 이후의 모든 추출은 엔진이 이미 로드되어 있어 훨씬 빠릅니다.

어떤 언어를 인식할 수 있나요?

언어 선택 메뉴에서 영어, 간체 중국어, 스페인어, 프랑스어, 독일어, 일본어를 선택할 수 있습니다. 최상의 정확도를 얻으려면 페이지에 실제로 인쇄된 언어를 선택하세요. 언어를 잘못 선택하면 인식 품질이 크게 떨어집니다.

관련 도구