PDF/A란 무엇이고 필요한가
PDF는 쪽을 그리기 위한 명령의 모음인데, 그 명령 가운데 일부는 파일 바깥에 있는 것에 기대고 있습니다. 내 컴퓨터에 깔린 글꼴, 모니터가 주는 색 정보, 동영상, 스크립트, 10년 뒤에는 없을 서버로 가는 링크 같은 것들입니다. 그런 파일을 오늘 다른 기기에서 열면 대개는 제대로 보입니다. 빠진 부분이 다른 것으로 대신 채워지기 때문입니다. 그러나 2050년에 열면 대신 채울 것이 남아 있지 않을 수도 있습니다. PDF/A는 그 문제에 대한 답입니다. 쪽을 그대로 재현하는 데 필요한 모든 것이 파일 안에 있고, 바깥 세계에 기대는 모든 것은 금지된 제한된 PDF입니다. 다른 형식이 아닙니다. PDF/A 파일은 PDF이고 어떤 뷰어에서도 열립니다. 이것은 그 파일이 무엇을 담고 있지 않은지에 대한 약속입니다.
표준이 금지하는 것
규칙은 목적에서 나옵니다. 글꼴은 전부 심어 넣어야 합니다. 예전에는 뷰어에 당연히 있으리라 여겼던 기본 묶음도 예외가 아닙니다. 글꼴을 이름으로만 가리키고 사본 찾기를 뷰어에 맡기는 문서는 보관에 맞지 않습니다. 50년 뒤 대체 글꼴은 글자 너비가 달라 줄이 밀릴 수 있기 때문입니다. 암호화는 금지됩니다. 아무도 풀 수 없는 문서는 보존된 것이 아니기 때문입니다. 스크립트와 심어 넣은 소리와 영상, 외부 파일을 실행하거나 네트워크 주소를 여는 동작도 금지됩니다. 투명은 표준의 옛 부분에서는 제한되고 새 부분에서는 허용됩니다. 색은 모호함 없이 정의되어야 하며, 색 정보를 심어 넣거나 기기에 기대지 않는 공간에서 지정해야 합니다. 어떤 빨강이 프린터가 정하는 빨강이 아니라 바로 그 빨강이 되도록 하기 위해서입니다. 그리고 모든 파일은 자신이 어떤 판의 PDF/A라고 주장하는지 밝히는 메타데이터를 지녀야 합니다.
수준: A와 B와 U
적합에는 수준이 있고, 그 글자는 판 번호와 다른 것을 뜻합니다. 기본을 뜻하는 B 수준은 눈에 보이는 재현을 보장합니다. 쪽은 언제까지나 올바르게 보일 것입니다. 접근성을 뜻하는 A 수준은 거기에 더해 구조 표시를 요구합니다. 어떤 글자가 제목이고 어떤 것이 문단이고 어떤 것이 표의 칸인지, 그리고 어떤 순서로 읽는지를 기계가 읽을 수 있게 적어 둔 것입니다. 또한 모든 본문에 대해 문자 부호와의 대응이 필요합니다. U 수준은 그 중간으로, 완전한 구조 없이 문자 부호 대응만 요구합니다. 문서 전체에 구조 표시가 없어도 본문을 확실히 검색하고 뽑아낼 수 있다는 뜻입니다. 임의의 문서에서 A 수준을 만들어 내는 일은 실제로 상당히 어렵습니다. 구조 표시는 진짜 편집 작업이기 때문입니다. 그래서 현장의 보관 기관은 대개 B 수준을 요구하며, PDF/A-1a를 요구하는 조직은 PDF/A-1b를 요구하는 조직보다 훨씬 많은 것을 요구하고 있는 셈입니다.
어느 판을 쓸 것인가
PDF/A-1이 먼저 나왔고 가장 엄격합니다. 투명도 층도 심어 넣은 파일도 허용하지 않습니다. PDF/A-2는 그것을 풀어 투명과 층과 새로운 이미지 형식, 그리고 그릇 안에 다른 PDF/A를 담는 것을 허용했습니다. PDF/A-3은 중요한 변화를 더해 어떤 종류의 첨부든 허용했습니다. 전자 세금계산서 형식이 이 방식으로 돌아갑니다. 사람이 읽는 청구서 쪽 안에 기계가 읽는 데이터 파일이 첨부되어 있는 것입니다. 더 새로운 PDF 세대에 기반한 PDF/A-4는 수준 정리를 크게 진전시켰습니다. 받는 쪽이 달리 지정하지 않았다면 합리적인 기본값은 PDF/A-2b입니다. 손에 든 문서의 투명과 다투지 않을 만큼 새롭고, 진짜 보관 형식이라 할 만큼 엄격하며, 검증 도구가 예외 없이 지원합니다.
만드는 법과 스캔 문서의 함정
대부분의 사무용 프로그램은 PDF/A로 곧장 내보낼 수 있습니다. 보통 내보내기 창의 체크 상자 하나입니다. 이것이 가장 깔끔한 길인데, 원본 문서가 아직 자기 제목과 글꼴이 무엇인지 알고 있기 때문입니다. 기존 PDF를 변환하는 것도 전용 도구로 가능하며, 빠진 글꼴을 심고 색을 바꾸고 금지된 기능을 걷어 냅니다. 함정은 스캔입니다. 스캔한 쪽을 PDF/A로 바꾼 것은 B 수준에서 완전히 유효합니다. 이미지이고 언제까지나 같아 보이며 표준은 충족됩니다. 그러나 본문이 없으니 검색되지 않고, 문자 인식 없이는 A 수준에 이를 수 없습니다. 서류함 하나를 통째로 이미지뿐인 PDF/A로 보관하면 아무도 아무것도 찾지 못하는 더미가 생깁니다. 보존만이 아니라 쓸 수 있는 보관을 원한다면 변환 앞에 문자 인식을 넣고, 그 결과물은 반드시 교정하십시오.
단정하지 말고 검증하십시오
PDF/A 항목에 체크하고 내보냈다는 것만으로는 적합의 증거가 되지 않습니다. 학술지와 법원과 공공 기록원 제출이 가장 자주 되돌아오는 지점이 바로 여기입니다. 검증 도구가 있고 널리 쓰이는 무료 도구도 있습니다. 그것들은 파일이 어느 조항을 어겼는지 정확히 짚어 줍니다. 흔한 실패는 지루하고 되풀이됩니다. 사용 허가가 심어 넣기를 금지해 심을 수 없었던 글꼴, 로고에 섞여 든 투명 묶음, 색 정보가 없는 색 공간, 빠졌거나 망가진 메타데이터, 표준이 인정하지 않는 주석 종류. 각각에 구체적인 고침이 있습니다. 제출 전에 검증 도구를 돌리는 일은 몇 주 뒤의 반려를 지금의 5분으로 바꾸는 작업입니다.
PDF/A가 맞지 않는 경우
이것은 보관을 위한 형식이지 작업을 위한 형식이 아니며, 기본값으로 쓰면 대가가 따릅니다. 암호화할 수 없으므로 기밀 문서를 비밀번호가 걸린 PDF/A로 만들 수는 없습니다. 두 요구는 서로를 배제하며, 문서 안쪽이 아니라 보관 장소의 권한으로 파일을 지켜야 합니다. 모든 글꼴을 심으면 파일이 커지고 때로는 꽤 커집니다. 대화형 서식과 소리와 영상은 표준이 걷어 내는 바로 그것들입니다. 그래서 정직한 지침은 이렇습니다. 만든 프로그램이 사라진 뒤에도 오래 읽혀야 하는 문서, 또는 기관이 요구하는 문서에는 PDF/A를 쓰고, 아직 작업 중인 모든 것에는 보통 PDF를 쓰십시오. 마지막에 한 번 변환하는 편이 내내 제약 안에서 사는 것보다 훨씬 수월합니다.
압축은 어디에 놓이는가
보관에 알맞다는 것과 가볍다는 것은 서로 긴장 관계에 있고, 무엇을 원하는지 의식해서 정할 값어치가 있습니다. 강한 이미지 압축은 정보를 영영 버립니다. 그것이야말로 보관이 막아야 할 일이므로 보존용 사본은 아주 조심스럽게 압축하거나 아예 압축하지 마십시오. 실무적인 형태는 두 파일입니다. 보관소에는 충실한 PDF/A 사본을 두고, 메일과 일상적인 읽기에는 압축한 파생본을 두고 필요하면 다시 만듭니다. 잘못은 압축본만 남기고 그것을 보관이라 부르는 것입니다. 그 파일은 2050년에도 열리겠지만, 오늘 여러분이 버린 세부는 그때도 여전히 빠져 있을 것입니다.
자주 묻는 질문
PDF/A는 다른 파일 형식인가요?
아닙니다. PDF/A 파일은 추가 제약을 지키고 그것을 메타데이터로 밝히는 보통의 PDF입니다. 어떤 뷰어에서도 열리며 그 차이를 신경 쓰는 것은 검증 도구뿐입니다.
PDF/A 파일에 비밀번호를 걸 수 있나요?
걸 수 없습니다. 아무도 풀 수 없는 파일은 보존된 것이 아니므로 암호화가 금지됩니다. 대신 보관 장소를 지키거나 보관용이 아닌 암호화 사본을 따로 두십시오.
어떤 판의 PDF/A를 골라야 하나요?
지정이 없다면 PDF/A-2b입니다. PDF/A-1이 금지하는 투명과 층을 허용하고, B 수준은 완전한 접근성 구조를 요구하지 않으면서 겉모습을 보장합니다.
PDF/A로 바꾸면 문서 모습이 달라지나요?
달라지지 않아야 하고 그것이 목적입니다. 달라지는 것은 함께 다니는 쪽입니다. 글꼴이 심어지고 색에 정보가 붙고 금지된 기능이 걷어집니다. 모습이 어긋났다면 심을 수 없는 글꼴이 대체된 것입니다.
스캔한 PDF/A는 검색되나요?
그 자체로는 되지 않습니다. 텍스트 층이 없는 유효한 이미지 보관물입니다. 더미가 검색 가능해야 한다면 변환 전에 문자 인식을 더하고 결과를 교정하십시오.
파일이 정말 적합한지 어떻게 확인하나요?
검증 도구를 돌리십시오. 체크하고 내보낸 것은 증거가 아닙니다. 검증 도구는 실패한 조항을 정확히 짚어 주며 대개는 심을 수 없는 글꼴이거나 빠진 메타데이터입니다.
PDF 압축과 워드 변환과 비밀번호 처리를 브라우저 탭 안에서. 파일을 무겁게 만드는 이미지를 다시 부호화하고, 텍스트 층에서 워드 문서를 짜맞추고, 비밀번호를 걸거나 풉니다. 저희가 측정한 12쪽짜리 스캔 문서는 17.69메가바이트에서 1.49메가바이트가 되었습니다. 처리는 탭 안에서 끝나며 업로드가 없습니다.
PDF 도구 열기