비교에는 두 종류가 있다
텍스트 비교는 두 파일에서 낱말을 뽑아 나란히 맞추고 추가·삭제·수정된 표현을 보여 줍니다. 화면 비교는 페이지를 그림으로 겹쳐 화소가 다른 자리를 강조합니다. 계약서, 견적서, 보고서에는 앞의 것이 필요합니다. 도면, 로고, 레이아웃 교정에는 뒤의 것이 필요합니다.
텍스트 비교가 잡아내는 것
- 추가되거나 삭제된 조항.
- 바뀐 숫자: 날짜, 금액, 통지 기간.
- 낱말 하나가 뒤집힌 것. "할 수 있다"가 "해야 한다"로 바뀌는, 빠르게 읽어서는 절대 찾지 못하는 종류의 변경입니다.
글꼴이 바뀌거나 그림이 움직이거나 서명란이 다음 쪽으로 밀린 것은 보이지 않습니다. 그 어느 것도 텍스트를 바꾸지 않기 때문입니다.
잡아내지 못하는 것
PDF가 스캔이면 비교할 텍스트가 없습니다. 그 쪽은 낱말을 찍은 사진입니다. 먼저 문자 인식을 돌리고, 인식된 텍스트를 비교하십시오. 인식은 완벽하지 않으니 한 글자짜리 이상한 차이가 몇 개 보이면 실제 수정이 아니라 오인식으로 보십시오.
결과 읽기
비교는 줄 단위로 움직이므로 문장 하나를 끼워 넣으면 뒤의 모든 줄이 밀려 그 쪽 전체가 켜질 수 있습니다. 얼마나 많이 표시되었는지가 아니라 차이가 어디서 시작하는지를 보십시오. 여백이 바뀌어 문단이 다시 흐를 때도 똑같습니다. 낱말은 같은데 줄바꿈 위치만 전부 달라진 것입니다.
비교하기 전에
- 쪽수를 보십시오. 다르다면 구조가 바뀐 것이고, 그것을 먼저 찾는 편이 낫습니다.
- 낱말 수를 견주십시오. 크게 벌어지면 내용이 옮겨진 것이고, 같은 수에 차이가 있으면 표현이 바뀐 것입니다.
- 같은 범위를 쓰십시오. 전체 문서와 발췌를 비교하면 정보가 아니라 잡음이 나옵니다.
비밀을 지키기
계약서, 급여 서류, 진료 기록은 바로 사람들이 차이를 확인하려고 낯선 서버에 올려 버리는 종류의 문서입니다. 브라우저 안에서 도는 비교는 파일을 어디에도 보내지 않으며, 기밀한 일에 쓸 수 있는 방식은 이것뿐입니다.
도구
PDF 파일 비교는 두 PDF의 텍스트를 나란히 맞추고 바뀐 곳을 브라우저 안에서 표시합니다. 텍스트 비교는 붙여 넣은 글에 같은 일을 하고, PDF 단어 수 세기는 빠른 확인용 숫자를 주며, 이미지에서 텍스트 추출은 스캔한 쪽의 낱말을 인식해 비교할 거리를 만들어 줍니다.