Как работает извлечение изображений из PDF
Вместо того чтобы делать снимок каждой страницы, этот инструмент читает объекты изображений, хранящиеся внутри PDF, и сохраняет их по одному. Вы получаете картинки в том разрешении, в котором они хранились, а не в разрешении экрана, и без окружающего текста.
Фото, хранящиеся как JPEG, а именно так их хранит большинство PDF, сохраняются точно такими, какие они внутри файла, байт в байт, поэтому потерь нет вовсе. Другие изображения, хранящиеся как картинки RGB, в оттенках серого или с палитрой, воссоздаются и сохраняются как PNG, тоже без потерь.
Некоторые типы пропускаются: изображения CMYK из полиграфических процессов, сканы со сжатием для факса и JBIG2, а также JPEG 2000. Инструмент сообщает, сколько он пропустил. Маски прозрачности не применяются, поэтому логотип с прозрачным фоном получится на сплошном фоне. Изображение, используемое на многих страницах, хранится в PDF один раз, поэтому и сохраняется один раз.
Каждое изображение получает имя PDF с добавленным номером, например brochure-image-3.jpg, а рядом показывается его размер в пикселях.
Параметры извлечения изображений из PDF
| изображения JPEG | Сохраняются как .jpg, идентичные байт в байт копии в PDF. |
|---|---|
| Другие изображения RGB, в оттенках серого и с палитрой | Сохраняются как .png без потерь. |
| Пропускаются | Изображения CMYK, факс, JBIG2 и JPEG 2000. |
| Прозрачность | Не применяются; изображения получаются на сплошном фоне. |
Когда использовать
Извлекайте изображения, чтобы повторно использовать фото из своей брошюры или отчёта, восстановить картинки, когда от документа остался только PDF, сохранить фото товаров из каталога или собрать иллюстрации для презентации.
Если инструмент не находит изображений, картинки могут быть нарисованы векторной графикой, или PDF может быть сканом в неподдерживаемом формате; PDF в JPG или PDF в PNG сохраняют страницы целиком.
Об этих инструментах для PDF
Инструменты для страниц, от объединения и разделения до обрезки, изменения размера, водяного знака и нумерации страниц, используют pdf-lib, библиотеку JavaScript с открытым исходным кодом, которая читает структуру PDF и записывает новый файл. Поскольку она работает с самими объектами страниц, а не с их изображениями, текст остаётся текстом, шрифты остаются встроенными, векторные рисунки остаются чёткими, и на ваши страницы не добавляется ничего, о чём вы не просили. Ни один из этих инструментов не редактирует то, что уже есть на странице: чтобы изменить текст или заполнить форму, используйте редактор PDF. С PDF, защищённых паролем, сначала нужно снять защиту, поскольку без пароля страницы прочитать нельзя. Каждый инструмент работает с копией, поэтому файл на вашем устройстве никогда не изменяется.
Решение проблем с извлечением изображений из PDF
«нет встроенных изображений»
Картинки это векторные рисунки или текст. Используйте PDF в PNG, чтобы сохранить страницы целиком как изображения.
«пока не удаётся прочитать»
Каждое изображение использует формат, который этот инструмент пропускает, например CMYK или сжатие для факса. PDF в JPG вместо этого отрисовывает страницы.
Изображение выглядит нарезанным на полосы
Некоторые PDF хранят одну картинку как несколько плиток или полос. Каждая сохраняется отдельно, точно так, как хранится.
Как извлечь изображения из PDF, пошагово
- Нажмите «Выбрать PDF» или перетащите PDF в поле.
- При необходимости задайте параметры; настройки по умолчанию подходят для большинства задач.
- Нажмите «Извлечь изображения». Вся работа происходит на вашем устройстве.
- Сохраните результат кнопкой скачивания.
Безопасно ли делать это онлайн?
У большинства онлайн-инструментов «онлайн» означает, что ваш файл загружается на сервер компании, обрабатывается там и хранится какое-то время, прежде чем его удалят. Здесь это не так. Страница загружает код инструмента в ваш браузер, а ваш файл читается и обрабатывается внутри вкладки на вашем собственном устройстве. Он никогда не отправляется ни TapToConvert, ни кому-либо ещё.
Вы можете проверить это сами: когда страница и её движок загрузятся, отключите Wi-Fi, и инструмент продолжит работать. Это также означает, что нет ни очереди, ни дневного лимита, ни ограничения размера файла со стороны сервера; единственное ограничение это память, которую браузер выделяет одной вкладке.
Частые вопросы об извлечении изображений из PDF
Извлекаются ли изображения в полном качестве?
Да. JPEG сохраняются точно так, как хранятся, а другие изображения сохраняются как PNG без потерь.
Почему изображений меньше, чем я ожидал?
Изображение, повторно используемое на нескольких страницах, хранится один раз, а некоторые форматы пропускаются. Инструмент сообщает, сколько было пропущено.
Можно ли извлечь изображения из отсканированного PDF?
Да. Каждая отсканированная страница обычно это одно изображение, которое сохраняется в разрешении сканирования.
Загружаются ли файлы?
Нет. PDF читается в вашем браузере.
Это бесплатно?
Да. Без регистрации, без водяных знаков и без ограничений на использование. TapToConvert существует за счёт рекламы.
Мои файлы загружаются?
Нет. Всё происходит во вкладке вашего браузера, на вашем собственном устройстве.