Extraire des images d'un PDF

Importer un PDF

Téléversez un PDF et récupérez chaque image intégrée à sa résolution d’origine. L’extracteur parcourt l’arbre des objets PDF, trouve les entrées /XObject /Image et exporte chacune d’elles en PNG, pas de capture d’écran, pas de perte de qualité due à la rasterisation de la page entière. Fonctionne avec des scans, des rapports riches en photos, des catalogues de produits et des brochures.

Comment extraire des images d'un PDF

  1. 1

    Téléversez le PDF

    Déposez un seul fichier ; les PDF chiffrés doivent d'abord être déverrouillés.

  2. 2

    Analysez l'arbre des objets

    L'extracteur énumère chaque image XObject sur toutes les pages.

  3. 3

    Aperçu des résultats

    Vous voyez chaque image sous forme de miniature avec son numéro de page et ses dimensions.

  4. 4

    Téléchargez individuellement ou en ZIP

    Récupérez un seul élément ou exportez tout dans une archive, nommée `image-p1-1.png`.

Comment les images vivent à l'intérieur d'un PDF

Un PDF stocke les images comme des ressources séparées (flux /XObject) référencées depuis le contenu de la page. L’extracteur lit chaque flux dans son encodage natif et reconstruit le fichier que l’auteur a intégré.

Formats que vous verrez

Filtre PDF Ce que vous recevez Source typique
/DCTDecode PNG (d’un JPEG) Photos, photos de produits, scans
/FlateDecode + RGB PNG Logos, graphiques, captures d’écran UI
/JPXDecode PNG (de JPEG 2000) Scans d’archives haute résolution
/CCITTFaxDecode PNG (d’un scan) Texte scanné en noir et blanc
/JBIG2Decode PNG (converti) Documents scannés compressés

L’extracteur fournit toujours du PNG : il ré-encode les pixels bruts dans votre navigateur, donc les sources JPEG, JPEG 2000 et CCITT arrivent aussi en PNG.

Ce qu’il ne récupérera pas

  • Illustrations vectorielles. Les logos dessinés avec des opérateurs de chemin PDF ne sont pas des images, ils vivent dans le flux de contenu, pas en tant qu’XObjects. Utilisez un outil PDF vers SVG pour ceux-ci.
  • Couleurs de fond et dégradés. Ce sont des dessins au niveau de la page, pas des ressources intégrées.
  • Texte rendu sous forme de contours. Cela apparaît comme des “graphismes” mais n’est pas un objet image.

Conseils lors de l’utilisation de l’exportation

  • Vérifiez les dimensions. Une miniature 300x300 sur la page peut en réalité être une image originale de 3000x3000 réduite lors du rendu. Vous obtenez les pixels source, pas la taille d’affichage.
  • Respectez la licence. Pouvoir extraire une image ne donne pas le droit de la réutiliser. Les images de stock dans un PDF restent des images de stock lorsqu’elles sont extraites.
  • Documents scannés. Si chaque page produit une grande image avec du texte intégré, le PDF est un scan. Exécutez l’OCR sur les PNG exportés pour récupérer le texte.

Questions fréquentes

Les pages PDF peuvent appliquer une matrice de transformation à la manière dont une image est dessinée (retourner, faire pivoter, incliner). L’extracteur renvoie le bitmap stocké, pixels bruts. Si un éditeur a stocké l’image à l’envers et l’a retournée lors du rendu, l’exportation apparaîtra à l’envers. Faites-la pivoter dans n’importe quel éditeur d’images.

Seulement après que vous les ayez déverrouillés. Exécutez le fichier à travers un outil de déverrouillage PDF d’abord, en fournissant le mot de passe propriétaire, puis extrayez.

Oui. Les images sont ajoutées dans l’ordre des pages et chaque nom de fichier porte son numéro de page, par exemple image-p1-2.png, pour que vous sachiez de quelle page provient chaque image.

Non. Le PDF source est ouvert et lu entièrement dans votre navigateur et n’est jamais envoyé au serveur. Seule l’archive ZIP des images extraites est téléversée pour créer le résultat protégé par session ; elle est conservée jusqu’à 7 jours puis supprimée.

Outils similaires

Outil disponible dans d’autres langues