Extraire les images d’un PDF

Récupérez les photos d’un document à leur résolution d’origine, sans réencodage.

Traité sur cet appareil · aucun envoi de fichier

PDFVous pouvez aussi coller (Ctrl+V)Confortable jusqu’à 200 Mo

460 ko à télécharger la première fois, puis conservé sur cet appareil.détails

Moteur : pdf-lib.

À quoi sert cette page

Une plaquette dont on veut récupérer les photos, un rapport dont les graphiques sont à réutiliser, un catalogue reçu en PDF : faire une capture d’écran donne une image floue à la résolution de l’écran, alors que le fichier contient la photo d’origine en pleine définition. Cette page va la chercher là où elle est et vous la rend sans y toucher. Le document reste dans votre navigateur, ce qui est la moindre des choses pour des visuels sous droits.

On dit aussi : extraire les images d'un pdf, récupérer les photos d'un pdf.

Comment faire

  1. Déposez le PDF.
  2. Réglez éventuellement la taille minimale, pour écarter les puces et les filets.
  3. Lancez, puis téléchargez les images une à une ou toutes dans une archive zip.

Questions fréquentes

Les images sont-elles à leur résolution d’origine ?

Oui. Une photo affichée petite dans la page peut très bien faire 4 000 pixels de large dans le fichier : c’est cette version-là que vous récupérez, pas celle qui s’affiche. Une capture d’écran vous aurait donné l’image à la taille du zoom, en bien pire.

Quelle est la différence avec « convertir un PDF en images » ?

Cet outil-ci sort les images contenues dans le document, chacune dans son coin. L’autre photographie chaque page entière, mise en page comprise, texte inclus. Si vous voulez la photo du catalogue, c’est ici ; si vous voulez la page du catalogue telle qu’elle s’affiche, c’est là-bas.

L’outil ne trouve aucune image alors que j’en vois plein : comment est-ce possible ?

Deux explications. Soit ce que vous voyez est dessiné par le PDF lui-même — graphiques, schémas, logos vectoriels — et ce ne sont pas des images mais des tracés : il n’y a aucun pixel à extraire. Soit le document est un scan comprimé en fax ou en JBIG2, un codage que cet outil ne relit pas ; il vous le dit alors explicitement, et « convertir un PDF en images » fera le travail.

Pourquoi certaines images sortent-elles en PNG et d’autres en JPG ?

Parce que c’est ainsi qu’elles sont rangées dans le fichier. Une photographie y est presque toujours un JPEG : on vous le rend tel quel, sans le recompresser. Un dessin, une capture ou un aplat y est comprimé autrement, et on le reconstruit en PNG — sans perte, là encore.

Un même logo revient sur toutes les pages : vais-je récupérer cent copies ?

Non. Un PDF ne range l’image qu’une fois et la rappelle à chaque page ; l’extraction suit la même logique et ne la sort qu’une fois, en indiquant sous le résultat les autres pages où elle apparaît.

Bon à savoir

  • Les photographies stockées en JPEG — l’immense majorité — sont rendues octet pour octet, telles qu’elles ont été placées dans le document : même résolution, même compression, aucune perte ajoutée.
  • Les autres images sont reconstruites en PNG sans perte : dessins, captures d’écran, aplats, logos.
  • Les images comprimées en fax (CCITT) ou en JBIG2 — le cas de certaines numérisations en noir et blanc — ne sont pas extraites. Elles sont comptées et signalées sous le résultat, et « convertir un PDF en images » sait, lui, les redessiner.
  • Une image en CMJN sort telle quelle si elle est en JPEG, ou convertie en RVB par une formule directe sinon : les teintes sont proches, pas identiques. C’est dit sous chaque image concernée.
  • La transparence n’est reprise que lorsque le masque a exactement les mêmes dimensions que l’image. Sinon l’image sort opaque plutôt que rééchantillonnée au jugé.
  • Une image utilisée sur plusieurs pages — un logo d’en-tête, une signature — n’est extraite qu’une fois ; les autres pages où elle apparaît sont indiquées.
  • Ce qui est dessiné par le PDF lui-même — texte, traits, dégradés, graphiques vectoriels — n’est pas une image et ne s’extrait pas ici. Pour en obtenir une, passez par « convertir un PDF en images ».
  • Un PDF protégé par mot de passe doit être déverrouillé avant que ses images soient lisibles.

Outils liés