
PDF 파일을 받으면 내용을 수정하기가 왜 이렇게 어려울까요? 워드 파일처럼 쉽게 편집이 되지 않는 이유가 있습니다. PDF가 처음부터 그렇게 설계됐기 때문입니다.
PDF는 문서를 "출력된 것처럼" 고정하려고 만들었습니다
1990년대 초, 어도비 공동창업자 존 워녹(John Warnock)에게는 고민이 있었습니다. 회사에서 만든 문서를 다른 사람에게 보내면 폰트가 달라지거나 레이아웃이 틀어지는 일이 잦았습니다. 윈도우 PC에서 만든 문서가 맥에서 다르게 보이고, 프린터마다 출력 결과가 달랐습니다.
해결책은 하나였습니다. 문서를 "종이에 출력된 것처럼" 고정시키는 것입니다. 어떤 기기에서 열어도, 어떤 프린터로 출력해도 동일하게 보이도록 말입니다.
이것이 PDF(Portable Document Format)의 탄생 배경입니다. 1993년 어도비가 발표했습니다.
PDF 내부는 좌표계로 되어 있습니다
PDF 파일 내부는 우리가 생각하는 것과 전혀 다른 구조입니다. "안녕하세요"라는 글자가 있다면, PDF는 이것을 이렇게 저장합니다.
BT
/Helvetica 12 Tf
100 700 Td
(안녕하세요) Tj
ET
번역하면 이렇습니다. "Helvetica 폰트 12pt 크기로, 페이지 왼쪽에서 100, 아래에서 700 위치에 '안녕하세요'를 배치하라."
단어나 문장의 개념이 없습니다. 그냥 특정 좌표에 특정 글자를 그려넣는 방식입니다. 마치 그림판에 글씨를 쓴 것과 비슷합니다.
이렇게 좌표 기반으로 고정되어 있기 때문에 텍스트를 수정하면 뒤의 레이아웃 전체가 틀어집니다. 워드처럼 "글자를 지우면 뒤 글자가 앞으로 당겨오는" 구조가 아닌 것입니다.
폰트도 포함되거나 그림으로 변환됩니다
PDF에서 텍스트가 깨지지 않는 또 다른 이유는 폰트 처리 방식 때문입니다.
PDF는 두 가지 방법으로 폰트 문제를 해결합니다.
폰트 내장: 문서에서 사용한 폰트 파일 자체를 PDF 안에 포함시킵니다. 받는 사람이 그 폰트를 가지고 있지 않아도 동일하게 보입니다. 대신 파일 크기가 커집니다.
윤곽선 변환: 글자를 텍스트가 아닌 벡터 도형으로 변환합니다. 더 이상 "글자"가 아니라 "글자 모양의 그림"이 됩니다. 이 경우 텍스트 선택조차 안 됩니다.
스캔한 PDF는 더 어렵습니다
스캐너로 종이를 스캔해서 만든 PDF는 텍스트가 아예 없습니다. 그냥 이미지 파일을 PDF로 포장한 것입니다. 글자처럼 보이지만 실제로는 픽셀의 집합입니다.
이런 PDF에서 텍스트를 인식하려면 OCR(광학 문자 인식) 기술이 필요합니다. 이미지를 분석해서 "이 픽셀 패턴은 'ㄱ'이다"라고 판단하는 과정입니다. 그래서 추가 작업이 필요하고 오류가 생길 수 있습니다.
그래도 PDF인 이유
편집하기 어렵다는 단점에도 불구하고 PDF가 계속 사용되는 이유는 명확합니다.
보낸 그대로 받을 수 있습니다. 워드 파일을 보내면 받는 사람의 컴퓨터 환경에 따라 다르게 보일 수 있습니다. PDF는 어떤 기기에서든 동일합니다.
수정이 어렵다는 게 장점이기도 합니다. 계약서, 증명서, 공문서처럼 원본을 보존해야 하는 문서에는 오히려 편집 어려움이 필요한 특성입니다.
인쇄 결과가 예측 가능합니다. PDF는 인쇄소에서 사용하는 표준 포맷입니다. 화면에서 보이는 것과 출력물이 정확히 일치합니다.
정리
PDF가 편집하기 어려운 것은 버그가 아니라 설계 의도입니다. "어떤 환경에서도 동일하게 보이도록" 만들다 보니, 내부 구조가 편집보다는 표시에 최적화됐습니다. 편집이 필요하다면 원본 워드 파일을 요청하거나 전문 PDF 편집 도구를 사용하는 것이 현실적인 해결책입니다.
'Dev' 카테고리의 다른 글
| 브라우저가 생각보다 강력한 이유 — Canvas API FFmpeg PDF 모두 브라우저에서 (0) | 2026.10.02 |
|---|---|
| 무료로 웹서비스를 운영하는 방법 — Vercel Next.js 조합 (0) | 2026.09.29 |
| 동영상 압축을 브라우저에서 구현한 이야기 — FFmpeg.wasm 적용기 (0) | 2026.09.25 |
| 웹서비스 처음 만들면서 놀란 것 5가지 (0) | 2026.09.21 |