이 도구는 무엇인가요?
이 도구는 PDF의 각 페이지에 있는 텍스트 내용을 읽어 Excel 통합 문서 안에 페이지별로 하나의 시트로, 행과 열 형태로 재구성합니다. 수직 위치를 기준으로 텍스트를 줄 단위로 묶은 다음, 단어 사이에 넓은 수평 간격이 있는 지점을 기준으로 각 줄을 셀로 나눕니다 — 이는 단순한 공백이 아니라 '여기서 새로운 열이 시작된다'는 합리적인 판단 근거입니다.
이러한 방식은 청구서, 가격표, 내보낸 보고서처럼 간격이 규칙적이고 단순한 표나 목록이 있는 PDF에서 잘 작동합니다. 병합된 셀, 셀 내 여러 줄 내용, 또는 열 사이 간격이 명확하지 않은 표와 같은 복잡한 레이아웃은 안정적으로 재구성하지 못합니다. 이런 경우 다운로드 후 결과를 수동으로 조정해야 할 가능성이 높습니다.
왜 사용해야 할까요?
- 데이터를 손으로 다시 입력할 필요 없이 PDF의 표와 목록을 편집 가능하고 정렬 가능한 Excel 파일로 바꿔줍니다.
- 가입 불필요, 워터마크 없음, 완전 무료입니다.
- 로컬 처리로 개인정보 보호 — PDF 파일이 어떤 서버에도 업로드되지 않습니다.
- PDF 페이지마다 시트가 하나씩 생성되어 여러 페이지 문서도 정리된 상태를 유지합니다.
사용 방법
- 박스를 클릭하거나 PDF 파일을 끌어다 놓으세요.
- 도구가 텍스트를 추출하고 행과 열로 배치하는 동안 기다립니다.
- .xlsx 파일을 다운로드하여 Excel, Google 스프레드시트 또는 다른 스프레드시트 앱에서 엽니다.
- 열 구분 결과를 확인하세요 — 복잡한 표의 경우 일부 셀을 수동으로 조정해야 할 수 있습니다.
예시
입력
invoice.pdf — 항목 표가 있는 한 페이지짜리 청구서결과
invoice.xlsx — 각 청구 항목이 한 행으로, 품목, 수량, 가격 열이 있는 시트 하나정확도는 원본 PDF의 레이아웃에 크게 좌우됩니다 — 열 간격이 명확한 단순한 표는 깔끔하게 변환되지만, 밀도가 높거나 간격이 불규칙한 표는 수동으로 정리해야 할 수 있습니다.
자주 묻는 질문
일부 열이 합쳐지거나 잘못 나뉘는 이유는 무엇인가요?
이 도구는 PDF의 기본 텍스트 레이어에 있는 단어 사이의 수평 간격을 바탕으로 열 경계를 추정합니다 — PDF의 원본 표 구조에는 접근할 수 없습니다(대부분의 PDF는 애초에 그런 구조를 보존하지 않습니다). 열 사이 간격이 좁거나 표가 특이한 간격을 사용하는 경우 추정이 잘못될 수 있습니다. 결과를 확인하고 필요하면 수동으로 조정하세요.
스캔한 PDF에서도 작동하나요?
아니요. 이 도구는 PDF에 내장된 텍스트 레이어를 읽습니다. 스캔한 문서는 단순히 이미지일 뿐이며 추출 가능한 텍스트가 없습니다. 먼저 PDF OCR 도구를 사용해 텍스트 레이어를 추가한 다음 이 변환기를 사용하세요.
제 PDF가 서버에 업로드되나요?
아니요. 텍스트 추출과 Excel 파일 생성 모두 JavaScript를 사용해 브라우저에서 로컬로 처리됩니다. 파일이 기기를 벗어나는 일은 없습니다.
원본 표의 셀 서식, 색상, 병합된 셀이 유지되나요?
아니요. 결과물은 격자 형태로 배치된 일반 텍스트입니다 — 원본 PDF의 글꼴, 색상, 테두리, 병합된 셀은 그대로 전달되지 않습니다.