Về công cụ này
Tệp PDF không lưu ảnh dưới dạng các tệp JPG hoặc PNG riêng biệt — mỗi ảnh được nhúng bên trong tài liệu như một đối tượng nội bộ, được mã hóa theo cách phù hợp tại thời điểm tạo PDF. Công cụ này đi sâu vào cấu trúc đó ngay trong trình duyệt của bạn: nó quét từng trang để tìm ảnh raster được nhúng, trả về nguyên vẹn từng byte các ảnh được lưu dưới dạng JPEG giống hệt tệp gốc (không nén lại, không mất chất lượng), và tái tạo một tệp PNG thật, hợp lệ quanh bất kỳ dữ liệu pixel thô chưa nén nào tìm thấy để tệp đó cũng có thể tải xuống được. Thả một tệp PDF vào, nhấp "Trích xuất ảnh", và mọi ảnh mà công cụ khôi phục được sẽ hiện ra dưới dạng ảnh thu nhỏ riêng kèm nút tải xuống một cú nhấp.
Không có gì được tải lên máy chủ — tệp PDF được phân tích cục bộ bằng pdf-lib, quét từ điển nội bộ `/Resources/XObject` của từng trang và phân biệt ảnh raster thật với Form XObject (những đoạn trang có thể tái sử dụng, hoàn toàn không phải ảnh, ví dụ các trang được nhúng bởi bố cục n-up hoặc booklet), vì vậy chỉ những ảnh thật mới được trích xuất. Một số kiểu mã hóa nội bộ hiếm gặp — bảng màu chỉ mục, CMYK, kênh 16-bit, hoặc nén fax JBIG2/CCITT thường dùng cho các trang quét đen trắng — sẽ không được đóng gói lại thành tệp tải xuống bởi công cụ này. Thay vì đoán các pixel mà nó không thể giải mã chính xác, công cụ báo cáo trung thực kích thước chính xác của ảnh đó và đánh dấu là mã hóa không được hỗ trợ thay vì tạo ra một tệp bị hỏng.
Câu hỏi thường gặp
Tại sao nó báo "mã hóa không được hỗ trợ" cho một số ảnh?
PDF có thể lưu trữ hình ảnh bằng nhiều mã hóa nội bộ khác nhau. Công cụ này hỗ trợ đầy đủ hai loại phổ biến nhất (hình ảnh mã hóa JPEG, được trích xuất nguyên trạng, và bitmap RGB mã hóa thô/Flate, được đóng gói lại thành tệp PNG chuẩn). Các mã hóa ít phổ biến hơn (bảng màu chỉ số, CMYK, nén kiểu fax JBIG2, hoặc JPEG2000) được phát hiện — bạn vẫn sẽ thấy kích thước của chúng và biết chúng tồn tại — nhưng hiện tại không được đóng gói lại thành tệp có thể tải xuống, để tránh đoán mò dữ liệu pixel mà nó không thể giải mã đáng tin cậy.
Công cụ này có tìm được các hình ảnh được dùng làm nền trang hoặc hình mờ không?
Có — công cụ quét tài nguyên hình ảnh raster nhúng của mọi trang bất kể chúng được sử dụng trực quan như thế nào (hình nền toàn trang, logo nhỏ, ảnh chụp, hoặc bitmap hình mờ được quét đều được phát hiện theo cùng một cách). Điều duy nhất nó cố tình bỏ qua là hình mờ dựa trên VĂN BẢN hoặc vẽ bằng vector (như những gì công cụ Đóng Dấu PDF của chúng tôi tạo ra), vì chúng được vẽ dưới dạng glyph phông chữ hoặc đường dẫn vector, không phải hình ảnh raster — trong trường hợp đó không có gì để "trích xuất" dưới dạng tệp hình ảnh.