Извлечение изображений из PDF 🔒 Работает локально в браузере — ничего не загружается.

Найдите и скачайте каждое встроенное изображение в PDF как отдельные файлы.

📄 Перетащите PDF сюда или нажмите, чтобы выбрать
Файл не выбран

Выберите PDF выше, затем нажмите «Извлечь изображения», чтобы найти каждую картинку в нём.

Об этом инструменте

PDF не хранит изображения как отдельные файлы JPG или PNG — каждая картинка встроена внутрь документа как внутренний объект, закодированный тем способом, который был уместен при создании PDF. Этот инструмент напрямую погружается в эту внутреннюю структуру прямо в вашем браузере: он проходит по каждой странице в поиске встроенных растровых изображений, возвращает фотографии, сохранённые как JPEG, побайтово идентичными исходному файлу (без повторного сжатия, без потери качества), и восстанавливает настоящий, корректный PNG-файл вокруг любых найденных несжатых пиксельных данных, чтобы их тоже можно было скачать. Перетащите PDF, нажмите «Извлечь изображения», и каждая картинка, которую удалось восстановить, появится в виде отдельной миниатюры с кнопкой скачивания в один клик.

Ничего не загружается на сервер — PDF разбирается локально с помощью pdf-lib, инструмент проходит по внутреннему словарю `/Resources/XObject` каждой страницы и отличает настоящие растровые изображения от Form XObject (повторно используемых фрагментов страницы, которые вовсе не являются фотографиями — например, страниц, встроенных при раскладке n-up или буклета), поэтому извлекаются только настоящие картинки. Некоторые экзотические внутренние кодировки — индексированные палитры, CMYK, 16-битные каналы или сжатие факсов JBIG2/CCITT, обычно используемое для отсканированных чёрно-белых страниц — этим инструментом не переупаковываются в скачиваемый файл. Вместо того чтобы угадывать пиксели, которые он не может корректно декодировать, инструмент честно сообщает точные размеры этого изображения и помечает его как неподдерживаемую кодировку, вместо того чтобы создавать битый файл.

Частые вопросы

Почему для некоторых изображений указано «неподдерживаемое кодирование»?

PDF может хранить изображения, используя несколько различных внутренних кодировок. Этот инструмент полностью поддерживает два самых распространённых (изображения в кодировке JPEG извлекаются как есть, а необработанные/Flate-кодированные RGB-битмапы переупаковываются в стандартные файлы PNG). Менее распространённые кодировки (индексированные цветовые палитры, CMYK, факсовое сжатие JBIG2 или JPEG2000) обнаруживаются — вы всё равно увидите их размеры и узнаете об их существовании — но в настоящее время не переупаковываются в файл для скачивания, чтобы избежать угадывания пиксельных данных, которые он не может надёжно декодировать.

Найдёт ли это изображения, использованные в качестве фона страницы или водяного знака?

Да — инструмент сканирует встроенные растровые изображения на каждой странице независимо от того, как они визуально используются (полностраничное фоновое изображение, маленький логотип, фото или отсканированный водяной знак-битмап — все обнаруживаются одинаково). Единственное, что он намеренно пропускает, — это текстовые или векторные водяные знаки (например, те, что создаёт наш собственный инструмент водяных знаков PDF), поскольку они рисуются как глифы шрифта или векторные пути, а не растровые изображения — в этом случае нечего «извлекать» как файл изображения.