이 도구는 무엇인가요?
PDF 비교 도구는 한 문서의 두 가지 버전 — 예를 들어 수정 전후의 계약서나 보고서의 두 가지 초안 — 을 받아서, 일일이 두 문서를 나란히 놓고 한 줄씩 비교하지 않아도 무엇이 다른지 보여줍니다.
이 도구는 텍스트 콘텐츠 비교 방식으로 동작합니다. pdf.js를 사용해 각 PDF의 모든 페이지에서 텍스트를 추출하고(ISO 32000 PDF 규격에 따르면 각 페이지의 텍스트는 위치 정보가 있는 텍스트 런으로 저장되며, pdf.js는 이를 읽기 순서대로 추출합니다), 대응하는 페이지의 텍스트 간에 단어 단위 비교를 수행합니다. 어떤 단어가 추가되거나 삭제되었는지 정확하게 알려줍니다.
이 도구가 무엇을 감지하고 무엇을 감지하지 못하는지 미리 아는 것이 중요합니다. 이것은 텍스트 콘텐츠 비교이지, 픽셀 단위의 시각적 비교가 아닙니다. 문구 변경, 문장 추가·삭제, 단락의 재배치는 확실하게 감지합니다. 하지만 폰트 교체, 색상 변경, 이미지 위치 이동, 단어는 그대로인 채 페이지 배치만 바뀐 경우처럼 순전히 시각적이거나 레이아웃만 바뀐 변경은 감지하지 못합니다. 두 문서가 픽셀 단위로 완전히 동일한지 확인해야 한다면 이 도구는 적합하지 않으며, 문구가 바뀌었는지 확인하고 싶다면 이 도구가 적합합니다.
왜 사용해야 할까요?
- 한눈에 보이는 변경 사항 — 추가되거나 삭제된 텍스트가 페이지별로 색으로 표시되어 두 문서를 직접 눈으로 대조할 필요가 없습니다.
- 먼저 페이지 수 요약 제공 — 파일 A와 파일 B의 페이지 수, 그리고 실제로 다른 페이지 수를 바로 확인할 수 있습니다.
- 페이지 수가 다른 PDF도 처리 — 한쪽 파일에만 있는 페이지도 조용히 건너뛰지 않고 별도로 표시됩니다.
- 개인정보 보호를 고려한 설계 — 텍스트 추출과 비교 작업이 모두 브라우저 탭 안에서 이루어지므로 계약서, 초안 등 민감한 문서가 기기 밖으로 나가지 않습니다.
- 무료이며, 브라우저가 처리할 수 있는 범위 내에서 페이지 수 제한이 없고 계정 등록도 필요 없습니다.
사용 방법
- 파일 A(원본 PDF)를 첫 번째 드롭 영역에 클릭하거나 드래그하여 놓습니다.
- 파일 B(수정된 PDF)를 두 번째 드롭 영역에 클릭하거나 드래그하여 놓습니다.
- "PDF 비교"를 클릭하고 각 페이지의 텍스트가 추출 및 비교되는 동안 기다립니다.
- 요약 줄에서 페이지 수와 몇 페이지가 다른지 확인합니다.
- 페이지별 결과를 스크롤하며 확인합니다 — 녹색 하이라이트는 파일 B에서 추가된 텍스트, 빨간 취소선은 파일 A에서 삭제된 텍스트이며, 하이라이트가 없는 페이지는 변경되지 않은 페이지입니다.
예시
입력
contract-v1.pdf(3페이지)와 contract-v2.pdf(3페이지), 세 번째 페이지의 한 조항이 수정된 경우결과
요약: "파일 A: 3페이지, 파일 B: 3페이지 — 1페이지가 다름", 3페이지에는 기존 조항이 빨간색 취소선으로, 새 문구가 녹색으로 표시됨1페이지와 2페이지는 동일하다고 표시되므로 실제로 변경된 한 페이지로 바로 이동해서 확인할 수 있습니다.
PDF 비교와 Text Diff, 언제 무엇을 사용할까
두 도구 모두 결국 동일한 방식의 단어 단위 비교를 수행하지만 입력 방식이 다릅니다. 계약서, 청구서, 보고서 같은 실제 PDF 파일 두 개가 있고 도구가 두 파일을 열어 각 페이지의 텍스트를 추출한 뒤 페이지를 자동으로 매칭해 주기를 원할 때는 PDF 비교를 사용하세요.
이미 텍스트 형태로 콘텐츠를 가지고 있을 때는 — 예를 들어 PDF에서 조항을 복사해서 붙여넣었거나, 설정 파일, 스크립트, 이메일 초안의 두 버전을 비교할 때는 — 대신 일반 Text Diff 도구를 사용하세요. PDF 파싱 과정이 없어 이 경우 더 빠르며, 추출한 PDF 페이지뿐 아니라 붙여넣은 모든 텍스트에 사용할 수 있습니다.
자주 있는 사용 사례
- 서명 전에 계약서나 법적 합의서의 두 개정판 사이에 실제로 무엇이 바뀌었는지 확인.
- 보고서, 제안서, 학술 논문의 초안과 최종본 사이의 수정 내용 검토.
- 거래처가 수정본을 보내왔을 때 청구서나 발주서가 이전 버전과 일치하는지 확인.
- 원본 문서와 다른 사람이 편집해 온 사본 사이에서 승인되지 않은 예상치 못한 수정을 찾아내기.
자주 묻는 질문
PDF의 정확한 시각적 레이아웃을 비교하나요, 아니면 텍스트만 비교하나요?
각 페이지의 텍스트 콘텐츠만 비교합니다. pdf.js가 각 페이지에서 읽어낼 수 있는 텍스트를 추출하여 단어 단위로 비교합니다. 폰트 변경, 제목 색상 변경, 이미지 위치 이동처럼 순전히 시각적인 변경은 기본 단어가 동일하다면 감지하지 않습니다. 픽셀 단위의 시각적 비교가 필요하다면 두 PDF를 이미지로 렌더링하여 픽셀을 비교해야 하는데, 이 가벼운 브라우저 기반 도구는 그런 작업까지는 하지 않습니다.
두 PDF의 페이지 수가 다르면 어떻게 되나요?
페이지는 위치를 기준으로 비교됩니다(A의 1페이지와 B의 1페이지, 이런 식으로). 한쪽 파일의 페이지 수가 더 많으면 추가된 페이지는 건너뛰거나 오류를 발생시키지 않고 "파일 A에만 있음" 또는 "파일 B에만 있음"으로 표시됩니다.
스캔한 PDF나 이미지로만 된 페이지도 비교할 수 있나요?
PDF에 실제 텍스트가 포함되어 있는 경우에만 가능합니다. 텍스트 레이어 없이 이미지로만 된 스캔 페이지는 pdf.js가 추출할 내용이 없으므로 빈 페이지로 표시됩니다. 이런 방식으로 비교하려면 먼저 OCR을 실행해 텍스트 레이어를 추가하세요.
제 PDF가 비교를 위해 어딘가에 업로드되나요?
아니요. 두 파일 모두 읽기, 텍스트 추출, 비교 계산이 모두 JavaScript를 사용해 브라우저 내에서 처리됩니다. 어느 파일도 서버로 전송되지 않으며, 업로드되는 것은 전혀 없습니다.
이미 두 문서의 텍스트를 가지고 있는데, 이 도구가 필요한가요?
아니요 — 이미 텍스트를 추출했거나 일반 텍스트로 복사해두었다면 Text Diff 도구를 바로 사용하세요. PDF 파싱 단계를 건너뛰고 바로 텍스트를 비교합니다. PDF 비교는 PDF 파일 두 개를 그대로 가지고 있고 페이지 추출 작업을 도구에 맡기고 싶을 때 사용하세요.