Comment fonctionne l'extraction d'images d'un fichier PDF
Au lieu de photographier chaque page, cet outil lit les objets image stockés dans le fichier PDF et les enregistre un par un. Vous obtenez les images dans la résolution où elles ont été stockées, et non à la résolution de l'écran, sans le texte qui les entoure.
Les photos stockées en JPEG, comme c'est le cas dans la plupart des PDF, sont enregistrées exactement telles qu'elles figurent dans le fichier, octet pour octet : il n'y a donc aucune perte. Les autres images stockées en RVB, en niveaux de gris ou avec palette sont reconstruites et enregistrées en PNG, également sans perte.
Quelques types sont ignorés : les images CMJN issues de chaînes d'impression, les numérisations en compression fax et JBIG2, et le JPEG 2000. L'outil vous indique combien il en a ignoré. Les masques de transparence ne sont pas appliqués : un logo sur fond transparent ressort donc sur un fond uni. Une image utilisée sur plusieurs pages n'est stockée qu'une fois dans le fichier PDF : elle n'est donc enregistrée qu'une fois.
Chaque image porte le nom du fichier PDF suivi de son numéro, par exemple brochure-image-3.jpg, et sa taille en pixels s'affiche à côté.
Les options d'extraction d'images PDF expliquées
| Images JPEG | Enregistrées en .jpg, identiques octet pour octet à la copie contenue dans le fichier PDF. |
|---|---|
| Autres images RVB, en niveaux de gris et avec palette | Enregistrées en .png sans perte. |
| Ignorées | Images CMJN, fax, JBIG2 et JPEG 2000. |
| Transparence | Non appliqués ; les images ressortent sur un fond uni. |
Quand l'utiliser
Extrayez des images pour réutiliser les photos d'une brochure ou d'un rapport que vous avez créé, pour récupérer des images quand il ne reste que le fichier PDF d'un document, pour enregistrer les photos de produits d'un catalogue, ou pour rassembler des figures pour une présentation.
Si l'outil ne trouve aucune image, les illustrations sont peut-être dessinées en vectoriel, ou le fichier PDF est une numérisation dans un format non pris en charge ; les outils PDF en JPG ou PDF en PNG enregistrent alors des pages entières.
À propos de ces outils PDF
Les outils de pages, de la fusion et de la division au recadrage, au redimensionnement, au filigrane et à la numérotation des pages, utilisent pdf-lib, une bibliothèque JavaScript open source qui lit la structure d'un fichier PDF et en écrit un nouveau. Comme elle travaille sur les objets de la page eux-mêmes et non sur des images de celle-ci, le texte reste du texte, les polices restent intégrées et les dessins vectoriels restent nets, et rien n'est ajouté à vos pages sans que vous l'ayez demandé. Aucun de ces outils ne modifie ce qui est déjà imprimé sur une page : pour changer un texte ou remplir un formulaire, utilisez un éditeur PDF. Les PDF protégés par mot de passe doivent d'abord être déverrouillés, car les pages ne peuvent pas être lues sans le mot de passe. Chaque outil travaille sur une copie : le fichier présent sur votre appareil n'est jamais modifié.
Dépannage de l'extraction d'images PDF
« aucune image intégrée »
Les illustrations sont des dessins vectoriels ou du texte. Utilisez l'outil PDF en PNG pour enregistrer des pages entières en images.
« impossible à lire pour le moment »
Toutes les images utilisent un format que cet outil ignore, comme le CMJN ou la compression fax. L'outil PDF en JPG fait plutôt le rendu des pages.
Une image semble découpée en bandes
Certains PDF stockent une image sous forme de plusieurs tuiles ou bandes. Chacune est enregistrée séparément, exactement telle qu'elle est stockée.
Comment extraire les images d'un fichier PDF, étape par étape
- Appuyez sur « Choisir un fichier PDF » ou faites glisser des PDF sur le cadre.
- Réglez les options si nécessaire ; les valeurs par défaut conviennent à la plupart des usages.
- Appuyez sur « Extraire les images ». Le travail se fait sur votre appareil.
- Enregistrez le résultat avec son bouton de téléchargement.
Est-il sûr de faire cela en ligne ?
Avec la plupart des outils en ligne, « en ligne » signifie que votre fichier est envoyé sur le serveur d'une entreprise, traité là-bas et conservé un certain temps avant d'être supprimé. Ici, ce n'est pas le cas. La page télécharge le code de l'outil dans votre navigateur, et votre fichier est lu et traité dans l'onglet, sur votre propre appareil. Il n'est jamais envoyé à TapToConvert ni à qui que ce soit.
Vous pouvez le vérifier vous-même : une fois la page et son moteur chargés, coupez le Wi-Fi, et l'outil fonctionne toujours. Cela signifie aussi qu'il n'y a ni file d'attente, ni limite quotidienne, ni limite de taille imposée par un serveur ; la seule limite est la mémoire que votre navigateur accorde à un onglet.
FAQ : extraire les images d'un fichier PDF
Les images sont-elles extraites en pleine qualité ?
Oui. Les JPEG sont enregistrés exactement tels qu'ils sont stockés, et les autres images en PNG sans perte.
Pourquoi y a-t-il moins d'images que prévu ?
Une image réutilisée sur plusieurs pages n'est stockée qu'une fois, et certains formats sont ignorés. L'outil indique combien d'images ont été ignorées.
Puis-je extraire les images d'un fichier PDF numérisé ?
Oui. Chaque page numérisée correspond généralement à une image, enregistrée dans sa résolution de numérisation.
Les fichiers sont-ils envoyés sur un serveur ?
Non. Le fichier PDF est lu dans votre navigateur.
Est-ce gratuit ?
Oui. Pas d'inscription, pas de filigrane et aucune limite d'utilisation. TapToConvert est financé par la publicité.
Mes fichiers sont-ils envoyés sur un serveur ?
Non. Tout se passe dans l'onglet de votre navigateur, sur votre propre appareil.