← 모두의 툴

PDF 페이지 수, 왜 Word 문서랑 다르게 나올까 — 고정 레이아웃의 구조

가이드 · 2026-08-19 최종 확인

같은 보고서를 .docx로 저장했을 때와 PDF로 저장했을 때 페이지 수가 다르게 나오는 경험, 흔합니다. 심지어 같은 .docx 파일을 다른 컴퓨터에서 열었더니 페이지 수가 바뀌어 있는 경우도 있습니다. 이건 버그가 아니라 두 포맷이 애초에 "페이지"라는 개념을 완전히 다른 방식으로 다루기 때문에 생기는 구조적 차이입니다. 이 가이드는 PDF가 왜 항상 같은 페이지 수를 보여주는지, 반대로 Word는 왜 그렇지 못한지를 파일 구조 수준에서 설명합니다.

1. PDF는 "고정 레이아웃" 포맷이다

PDF(Portable Document Format)는 이름 그대로 "어디서 열어도 똑같이 보이는" 것을 목표로 설계됐습니다. 이를 위해 PDF는 각 페이지의 내용과 위치를 좌표 단위로 확정해서 파일 안에 그대로 박아 넣습니다. 문서 전체 구조는 파일 내부의 Pages 객체가 트리 형태로 관리하며, 이 트리의 최상위 노드(루트 Pages 객체)는 하위 페이지 객체들을 가리키는 Kids 배열과, 그 배열에 담긴 페이지 개수를 뜻하는 Count 값을 갖고 있습니다. 즉 "이 PDF가 몇 페이지인가"는 렌더링해서 알아내는 값이 아니라, 파일을 열자마자 이 Count 값 하나만 읽으면 바로 확정되는 구조적 사실입니다. 그래서 어떤 PDF 뷰어로 열든, 어떤 운영체제·프린터·화면 크기에서 열든 페이지 수는 절대 달라지지 않습니다.

2. Word는 "리플로우" 포맷이다

.docx는 반대로 접근합니다. 파일 안에는 텍스트·문단·서식 정보만 저장되어 있을 뿐, "몇 페이지짜리 문서"라는 값은 애초에 고정된 형태로 저장되지 않습니다. 화면에 몇 페이지로 나뉘어 보일지는 문서를 여는 그 순간, 워드 프로세서(또는 뷰어)가 실시간으로 계산합니다. 계산에 들어가는 변수는 용지 크기, 여백, 글꼴 종류와 크기, 줄 간격뿐 아니라 실제 설치된 프린터 드라이버의 미세한 폰트 메트릭 차이까지 포함됩니다. 그래서 같은 .docx 파일이라도 회사 컴퓨터에서는 12페이지였다가 집 컴퓨터에서는 13페이지가 되는 일이 실제로 벌어집니다. 이건 Word의 결함이 아니라, "내용을 화면·용지 크기에 맞춰 다시 흘려보낸다(reflow)"는 설계 자체의 결과입니다.

핵심 차이: PDF의 페이지 수는 파일 안에 "저장된 값"이고, Word의 페이지 수는 열 때마다 "계산되는 값"입니다. 전자는 불변, 후자는 환경에 따라 변동합니다.

3. Word→PDF 변환이 하는 일: 리플로우를 "얼려버린다"

워드 문서를 PDF로 내보내는 순간, 그 시점의 용지 설정·글꼴·여백 조합으로 한 번 계산된 레이아웃이 좌표값으로 고정되어 PDF 안에 박제됩니다. 이후로는 그 PDF를 지구 반대편의 다른 기기, 다른 폰트 환경에서 열어도 페이지 수와 각 줄의 위치까지 완전히 동일하게 재현됩니다. "변환"이라는 단어보다 "박제" 또는 "동결"이라는 표현이 더 정확한 이유입니다. 반대로 말하면, PDF로 내보내기 전 원본 .docx에서 페이지 수를 조정하고 싶다면 여백이나 글꼴 크기를 바꿔서 원하는 페이지 수에 맞춘 뒤 그 상태로 내보내야 합니다. PDF로 저장된 이후에는 페이지 수 자체를 바꾸려면 페이지를 병합·재배열하거나 콘텐츠 자체를 다시 편집해야 합니다.

4. 실무에서 왜 중요한가: "5페이지 이내" 같은 제약

이력서, 논문, 계약서, 각종 제출 서류에 흔히 붙는 "○○페이지 이내"라는 규정은 파일 포맷에 따라 전혀 다른 의미를 갖습니다. 살아있는 .docx 파일로 제출하면, 접수자가 다른 프린터·다른 Word 버전으로 열었을 때 페이지 수가 늘어나 규정을 넘길 위험이 있습니다. 반면 PDF로 제출하면 만든 사람의 화면에서 본 페이지 수가 곧 상대방이 받는 페이지 수와 100% 일치합니다. 페이지 수 제한이 걸린 서류는 원칙적으로 PDF로 변환한 뒤 PDF 페이지 수 계산기로 최종 확인하는 것이 안전합니다.

5. 이 계산기가 페이지 수를 알아내는 방식

MODOO HUB의 PDF 페이지 수 계산기는 pdf-lib 라이브러리로 파일을 불러온 뒤 getPageCount()를 호출해 값을 가져옵니다. 이 함수는 PDF를 한 페이지씩 그려보며 세는 것이 아니라, 위에서 설명한 Pages 트리 구조를 파싱해서 Count 값을 바로 읽어옵니다. 그래서 수백 페이지짜리 대용량 PDF라도 렌더링 과정 없이 즉시 결과가 나오며, 서버로 파일을 전송하지 않고 브라우저 안에서만 처리되므로 기밀 문서도 안전하게 확인할 수 있습니다. 비밀번호로 보호된 PDF도 ignoreEncryption 옵션 덕분에 대부분 비밀번호 없이 페이지 수만 조회할 수 있습니다.

6. 스캔 PDF와 텍스트 PDF, 페이지 수는 같아도 무게는 다르다

페이지 수 자체는 스캔본이든 텍스트 기반이든 동일하게 계산됩니다. 다만 스캔한 PDF는 각 페이지가 통째로 이미지(래스터)로 저장되어 페이지당 파일 크기가 훨씬 크고, 텍스트 기반 PDF는 벡터 데이터라 훨씬 가볍습니다. 대용량 PDF를 다룰 때는 페이지 수와 함께 페이지당 용량(KB/페이지)도 함께 확인하면 어느 파일이 압축이 필요한지 빠르게 판단할 수 있습니다. 용량이 큰 PDF는 PDF 압축 도구로, 페이지 수 대비 실제 텍스트 분량은 PDF 단어 수 세기로 함께 확인하는 것을 권장합니다.

자주 묻는 질문

Q. 같은 .docx 파일인데 회사와 집 컴퓨터에서 페이지 수가 다르게 나옵니다. 파일이 손상된 건가요?

아닙니다. Word는 리플로우 포맷이라 열 때마다 설치된 폰트, 프린터 드라이버, 여백 설정에 맞춰 페이지 수를 다시 계산합니다. 파일 손상이 아니라 정상적인 동작입니다. 페이지 수를 고정하고 싶다면 PDF로 저장하세요.

Q. PDF 페이지 수는 어떻게 이렇게 빨리, 렌더링 없이 알 수 있나요?

PDF 파일 내부의 Pages 트리 객체에 이미 전체 페이지 수(Count 값)가 구조적으로 저장되어 있기 때문입니다. 페이지를 하나하나 그려서 세는 게 아니라 이 값을 바로 읽어오는 것이라 수백 페이지 파일도 즉시 처리됩니다.

Q. 페이지 수 제한이 있는 제출 서류는 어떤 포맷으로 내야 안전한가요?

PDF를 권장합니다. .docx로 제출하면 열람 환경에 따라 페이지 수가 달라질 수 있지만, PDF는 만든 사람이 확인한 페이지 수가 그대로 고정되어 전달되므로 규정 위반 위험이 없습니다.

Q. 비밀번호가 걸린 PDF도 페이지 수를 확인할 수 있나요?

대부분 가능합니다. pdf-lib의 ignoreEncryption 옵션을 사용하면 비밀번호 입력 없이도 페이지 수 정보만 읽어올 수 있습니다. 다만 AES-256 등 매우 강한 암호화가 적용된 일부 파일은 제한될 수 있습니다.