इस टूल के बारे में
PDF इमेज को अलग JPG या PNG फ़ाइलों के रूप में सहेजते नहीं हैं — हर इमेज दस्तावेज़ के भीतर एक आंतरिक ऑब्जेक्ट के रूप में एम्बेड होती है, जिसे उस तरीके से एन्कोड किया जाता है जो PDF बनाते समय उपयुक्त था। यह टूल सीधे आपके ब्राउज़र में उस संरचना में गहराई से जाता है: यह हर पेज में एम्बेडेड रैस्टर इमेज खोजता है, JPEG के रूप में सहेजी गई तस्वीरों को मूल फ़ाइल के बिल्कुल समान बाइट-दर-बाइट वापस देता है (कोई पुनः संपीड़न नहीं, कोई गुणवत्ता हानि नहीं), और मिलने वाले किसी भी कच्चे असंपीड़ित पिक्सेल डेटा के चारों ओर एक वास्तविक, मान्य PNG फ़ाइल पुनर्निर्मित करता है ताकि वह भी डाउनलोड करने योग्य बन जाए। एक PDF छोड़ें, "इमेज निकालें" पर क्लिक करें, और यह जो भी इमेज पुनर्प्राप्त कर सके वह अपनी थंबनेल के साथ एक-क्लिक डाउनलोड के साथ दिखाई देगी।
कुछ भी अपलोड नहीं होता — PDF को स्थानीय रूप से pdf-lib से पार्स किया जाता है, हर पेज की आंतरिक `/Resources/XObject` डिक्शनरी को खंगाला जाता है और वास्तविक रैस्टर इमेज को Form XObject (पुनः प्रयोज्य पेज खंड जो बिल्कुल भी तस्वीरें नहीं होते, जैसे n-up या बुकलेट लेआउट द्वारा एम्बेड किए गए पेज) से अलग पहचाना जाता है, ताकि केवल असली तस्वीरें ही निकाली जाएँ। कुछ असामान्य आंतरिक एन्कोडिंग — इंडेक्स्ड कलर पैलेट, CMYK, 16-बिट चैनल, या स्कैन की गई ब्लैक-एंड-व्हाइट पेजों के लिए आमतौर पर उपयोग होने वाला JBIG2/CCITT फैक्स संपीड़न — इस टूल द्वारा डाउनलोड करने योग्य फ़ाइल में दोबारा पैक नहीं की जातीं। जिन पिक्सेल को यह सही ढंग से डिकोड नहीं कर सकता, उनका अनुमान लगाने के बजाय, यह उस इमेज के सटीक आयाम ईमानदारी से बताता है और खराब फ़ाइल बनाने के बजाय इसे असमर्थित एन्कोडिंग के रूप में चिह्नित करता है।
अक्सर पूछे जाने वाले प्रश्न
कुछ इमेज के लिए यह "असमर्थित एन्कोडिंग" क्यों कहता है?
PDF कई अलग-अलग आंतरिक एन्कोडिंग का उपयोग करके इमेज संग्रहीत कर सकते हैं। यह टूल दो सबसे सामान्य को पूरी तरह से समर्थन करता है (JPEG-एन्कोडेड इमेज, जैसी हैं वैसी ही एक्सट्रैक्ट की जाती हैं, और रॉ/Flate-एन्कोडेड RGB बिटमैप्स, जो मानक PNG फ़ाइलों में पुनः पैकेज की जाती हैं)। कम सामान्य एन्कोडिंग (इंडेक्स्ड कलर पैलेट्स, CMYK, JBIG2 फ़ैक्स-शैली कंप्रेशन, या JPEG2000) का पता लगाया जाता है — आप अभी भी उनके आयाम देखेंगे और जानेंगे कि वे मौजूद हैं — लेकिन वर्तमान में उन पिक्सेल डेटा का अनुमान लगाने से बचने के लिए जिसे यह विश्वसनीय रूप से डिकोड नहीं कर सकता, उन्हें डाउनलोड करने योग्य फ़ाइल में पुनः पैकेज नहीं किया जाता।
क्या यह उन इमेज को खोजेगा जिन्हें पेज बैकग्राउंड या वॉटरमार्क के रूप में उपयोग किया गया था?
हाँ — यह टूल हर पेज के एम्बेडेड रास्टर इमेज संसाधनों को स्कैन करता है चाहे उनका दृश्य रूप से कैसे भी उपयोग किया गया हो (पूरे पेज की बैकग्राउंड इमेज, एक छोटा लोगो, एक फ़ोटो, या एक स्कैन किया गया वॉटरमार्क बिटमैप सभी को उसी तरह पहचाना जाता है)। जो एक चीज़ यह जानबूझकर छोड़ता है वह TEXT-आधारित या वेक्टर-ड्रॉन वॉटरमार्क हैं (जैसे हमारा अपना PDF वॉटरमार्क टूल बनाता है), क्योंकि वे फ़ॉन्ट ग्लिफ़ या वेक्टर पथ के रूप में बनाए जाते हैं, रास्टर इमेज के रूप में नहीं — उस स्थिति में इमेज फ़ाइल के रूप में "एक्सट्रैक्ट" करने के लिए कुछ भी नहीं है।