이 도구에 대해
PDF는 이미지를 별도의 JPG나 PNG 파일로 저장하지 않습니다 — 각 이미지는 PDF를 만들 당시 적합했던 방식으로 인코딩된 내부 객체로 문서 안에 내장됩니다. 이 도구는 브라우저 안에서 그 내부 구조를 직접 파고듭니다. 모든 페이지를 훑어 내장된 래스터 이미지를 찾고, JPEG로 저장된 사진은 원본 파일과 바이트 단위로 완전히 동일하게 그대로 반환하며(재압축 없음, 화질 손실 없음), 발견한 압축되지 않은 원시 픽셀 데이터 주위에는 실제로 유효한 PNG 파일을 재구성하여 역시 다운로드할 수 있게 만듭니다. PDF를 놓고 "이미지 추출"을 클릭하면 복구 가능한 모든 이미지가 각각의 썸네일로 표시되며 한 번의 클릭으로 다운로드할 수 있습니다.
서버에는 아무것도 업로드되지 않습니다 — PDF는 pdf-lib를 사용해 로컬에서 분석되며, 각 페이지 내부의 `/Resources/XObject` 딕셔너리를 훑어 실제 래스터 이미지와 Form XObject(사진이 아닌 재사용 가능한 페이지 조각, 예를 들어 n-up이나 소책자 레이아웃으로 내장된 페이지)를 구분하므로 실제 이미지만 추출됩니다. 인덱스 컬러 팔레트, CMYK, 16비트 채널, 또는 흑백 스캔 페이지에 흔히 쓰이는 JBIG2/CCITT 팩스 압축과 같은 일부 특수한 내부 인코딩은 이 도구에서 다운로드 가능한 파일로 다시 패키징되지 않습니다. 올바르게 디코딩할 수 없는 픽셀을 추측하는 대신, 해당 이미지의 정확한 크기를 정직하게 보고하고 손상된 파일을 만드는 대신 지원되지 않는 인코딩으로 표시합니다.
자주 묻는 질문
왜 일부 이미지에 "지원되지 않는 인코딩"이라고 표시되나요?
PDF는 여러 다른 내부 인코딩을 사용하여 이미지를 저장할 수 있습니다. 이 도구는 가장 흔한 두 가지(있는 그대로 추출되는 JPEG 인코딩 이미지, 표준 PNG 파일로 재포장되는 원시/Flate 인코딩 RGB 비트맵)를 완전히 지원합니다. 덜 흔한 인코딩(색인 색상 팔레트, CMYK, JBIG2 팩스 방식 압축, JPEG2000)은 감지되어 크기를 확인하고 존재를 알 수 있지만, 신뢰성 있게 디코딩할 수 없는 픽셀 데이터를 추측하지 않기 위해 현재는 다운로드 가능한 파일로 재포장되지 않습니다.
페이지 배경이나 워터마크로 사용된 이미지도 찾을 수 있나요?
네 — 이 도구는 시각적으로 어떻게 사용되든 관계없이(전체 페이지 배경 이미지, 작은 로고, 사진, 스캔된 워터마크 비트맵 모두 동일한 방식으로 감지됨) 모든 페이지의 삽입된 래스터 이미지 리소스를 스캔합니다. 의도적으로 건너뛰는 유일한 것은 텍스트 기반 또는 벡터로 그려진 워터마크입니다(자체 PDF 워터마크 도구가 만드는 것처럼). 이는 글꼴 글리프나 벡터 경로로 그려지며 래스터 이미지가 아니기 때문에, 그 경우에는 이미지 파일로 "추출"할 것이 없습니다.