Извлечь изображения из PDF

Фотографии внутри отчёта обычно чётче, чем страница, на которой они лежат. Инструмент берёт встроенные оригиналы, а не делает скриншот страницы вокруг них.

Загружаем инструмент…

Как это работает

  1. Перетащите PDF.
  2. Каждое встроенное изображение появляется в своём настоящем размере в пикселях.
  3. Скачайте нужные изображения по отдельности или все сразу ZIP-архивом.

Почему ничего не отправляется на сервер

Всё, что делает эта страница, выполняет код внутри вкладки вашего браузера — тем же движком, который рисует веб-страницы. Файл читается с диска в память вкладки, преобразуется там и записывается обратно как загружаемый файл. Он никуда не отправляется — ни нам, ни третьей стороне.

Проверьте сами

  1. Откройте инструменты разработчика в браузере (F12) и перейдите на вкладку «Сеть» (Network).
  2. Загрузите свой файл и запустите инструмент.
  3. Единственные запросы, которые вы увидите, — это код самого инструмента, а у нескольких тяжёлых инструментов ещё и их открытый движок из публичного CDN, плюс один небольшой сигнал о просмотре страницы на loreatec.jp (адрес и заголовок страницы, больше ничего). Ни один из них не несёт ваш файл.

Проверьте, что файлы не уходят →

Частые вопросы

Чем это отличается от преобразования PDF в изображения?

Постраничное преобразование делает снимок всей страницы целиком в выбранном вами разрешении — с текстом, полями и всем остальным. Этот инструмент вместо этого достаёт изображения, хранящиеся внутри файла, в том разрешении, в котором их сохранили. Чтобы вернуть фотографию, нужен именно он.

Почему некоторые изображения оказываются крупнее, чем выглядят на странице?

Потому что авторы часто размещают фотографию высокого разрешения, уменьшив её на странице. Файл хранит исходные пиксели — страница просто показывает их маленькими. Вы получаете именно сохранённые пиксели, в этом и смысл.

Почему отсканированный PDF даёт одно изображение на страницу?

Потому что скан буквально так и устроен — каждая страница это одна фотография, обычно с невидимым текстовым слоем от OCR (распознавания текста) поверх неё. Извлечение возвращает вам необработанное изображение скана.

Что за крошечные изображения он пропускает?

Логотипы, маркеры списков, линейки и значки — деловой PDF ими переполнен. По умолчанию пропускаются изображения меньше 32 пикселей, чтобы был виден настоящий контент; отметьте галочку, чтобы включить и их.