Extraire l'image

IronPDF for Python peut extraire toutes les images intégrées dans un document PDF — soit sous forme de fichiers image enregistrés, soit en tant qu'objets bitmap en mémoire — avec la possibilité de cibler des pages spécifiques.

Commencer

Chargez un PdfDocument avec PdfDocument.FromFile, puis appelez ExtractAllImages pour récupérer toutes les images du document, ou ExtractBitmapsFromPage pour extraire des images d'une page spécifique par son index.

Comprendre le code

  • PdfDocument.FromFile(path, password) : Ouvre le fichier PDF. Le deuxième argument est le mot de passe de déchiffrement ; omettez-le pour les fichiers non chiffrés.
  • ExtractAllImages() : Retourne une liste de toutes les images trouvées dans le document sur toutes les pages. Chaque image dans la liste est un objet avec une méthode SaveAs pour l'écrire sur le disque.
  • SaveAs(path) : Enregistre une image extraite dans le chemin de fichier spécifié. Le format du fichier est déterminé par l'extension (.png, .jpg, etc.).
  • ExtractBitmapsFromPage(pageIndex) : Retourne une liste d'objets AnyBitmap pour toutes les images sur l'index de page 0 basé sur zéro spécifié. Utilisez ceci lorsque vous devez travailler avec des données d'image en mémoire plutôt que de les écrire dans des fichiers.

Modèle d'itération

L'exemple parcourt ExtractAllImages() en utilisant enumerate pour attribuer un index séquentiel unique à chaque nom de fichier d'image, empêchant les écrasements lorsque plusieurs images sont extraites du même document.

Apprenez à travailler avec des images PDF en utilisant IronPDF for Python !

Prêt à commencer?
Version : 2026.6 vient de sortir
Still Scrolling Icon

Vous faites encore défiler ?

Vous voulez une preuve rapidement ?
exécuter un échantillon Regardez votre code HTML se transformer en PDF.