이 도구는 무엇인가요?
이 도구는 PDF의 텍스트 레이어(이미지가 아니라 파일에 실제로 포함된, 선택하고 복사할 수 있는 텍스트)를 읽어 새로운 Word 문서로 재구성합니다. 감지된 각 줄이 단락이 되고, 원본 PDF의 각 페이지 사이에는 페이지 나누기가 삽입됩니다. 보고서, 기사, 내보내기한 문서 등 텍스트 기반 PDF가 있고 전체를 다시 입력하지 않고 텍스트를 복사, 편집 또는 재사용해야 할 때 유용합니다.
솔직히 말하면 이것은 텍스트 추출 도구이지, 레이아웃을 보존하는 변환기가 아닙니다. 다단 레이아웃, 표, 머리글/바닥글, 특정 글꼴, 삽입된 이미지를 PDF에 나타난 그대로 재현하지는 않습니다. PDF가 스캔된 이미지(텍스트 레이어가 없는 사진이나 스캔본)인 경우 이 도구는 추출할 텍스트를 찾지 못합니다. 이 경우 먼저 OCR 도구로 이미지에서 텍스트를 인식해야 합니다.
왜 사용해야 할까요?
- 정적인 PDF의 텍스트를 다시 입력할 필요 없이 몇 초 만에 편집 가능한 Word 문서로 바꿔줍니다.
- 브라우저에서 완전히 오프라인으로 작동합니다 — PDF 파일은 어떤 서버에도 업로드되지 않습니다.
- 무료이며 가입이 필요 없고, 브라우저가 처리할 수 있는 범위 외에는 페이지 수 제한이 없습니다.
- 한계에 대해 솔직합니다: 원본 레이아웃을 완벽히 재현하는 척하지 않고 텍스트를 추출합니다.
사용 방법
- 상자를 클릭하거나 PDF 파일을 끌어다 놓으세요.
- 텍스트가 추출되고 Word 문서가 생성되는 동안 기다리세요.
- 다운로드 버튼을 클릭하여 .docx 파일을 저장하세요.
예시
입력
report.pdf — 3페이지짜리 텍스트 문서결과
report.docx — 추출된 텍스트가 담긴 편집 가능한 Word 파일로, 원본 3페이지 사이의 페이지 나누기가 유지됨각 텍스트 줄은 Word 문서의 단락이 됩니다. 원본 시각적 레이아웃, 글꼴, 삽입된 이미지는 재현되지 않습니다.
자주 묻는 질문
이 도구가 제 PDF의 정확한 서식을 유지해 주나요?
아니요, 정확히는 아닙니다. 이 도구는 텍스트 내용을 추출하여 새로운 Word 문서에서 원본 페이지 사이에 페이지 나누기를 넣은 단순 단락으로 재구성합니다. 다단 레이아웃, 표, 특정 글꼴, 머리글/바닥글, 삽입된 이미지는 재현하지 않습니다. 픽셀 단위로 정확한 레이아웃 보존이 필요하다면 이 도구는 적합하지 않습니다 — 텍스트 콘텐츠를 추출하고 편집하기 위해 만들어졌습니다.
왜 PDF에서 텍스트를 찾을 수 없다고 나오나요?
이는 PDF가 스캔된 이미지인 경우 발생합니다. 즉, 선택 가능한 텍스트 레이어 없이 픽셀로만 이루어진, 사실상 페이지의 사진인 경우입니다. 이 도구는 PDF에 이미 내장된 텍스트 데이터를 읽는 것이며, 이미지에서 텍스트를 읽어내는 OCR(광학 문자 인식)은 수행하지 않습니다. 먼저 OCR 도구로 스캔된 이미지를 텍스트로 변환해야 합니다.
제 PDF가 서버에 업로드되나요?
아니요. PDF를 읽고 Word 파일을 생성하는 전체 변환 과정은 JavaScript를 사용하여 브라우저에서 로컬로 이루어집니다. 파일이 사용자의 기기를 벗어나지 않으므로 개인적이거나 민감한 문서에도 안전하게 사용할 수 있습니다.
어떤 파일 형식으로 다운로드되나요?
Microsoft Word, Google Docs, LibreOffice Writer 등 Office Open XML 형식을 지원하는 다른 워드프로세서와 호환되는 표준 .docx 파일입니다.
암호로 보호된 PDF도 변환할 수 있나요?
아니요, 현재는 지원하지 않습니다 — 이 도구는 암호화되었거나 암호로 보호된 PDF를 처리하지 않습니다. 변환하기 전에 PDF 편집기를 사용하여 먼저 암호 보호를 해제해야 합니다.