Extraire l'image
IronPDF for Python peut extraire toutes les images intégrées dans un document PDF — soit sous forme de fichiers image enregistrés, soit en tant qu'objets bitmap en mémoire — avec la possibilité de cibler des pages spécifiques.
Commencer
Chargez un PdfDocument avec PdfDocument.FromFile, puis appelez ExtractAllImages pour récupérer toutes les images du document, ou ExtractBitmapsFromPage pour extraire des images d'une page spécifique par son index.
Comprendre le code
PdfDocument.FromFile(path, password): Ouvre le fichier PDF. Le deuxième argument est le mot de passe de déchiffrement ; omettez-le pour les fichiers non chiffrés.ExtractAllImages(): Retourne une liste de toutes les images trouvées dans le document sur toutes les pages. Chaque image dans la liste est un objet avec une méthodeSaveAspour l'écrire sur le disque.SaveAs(path): Enregistre une image extraite dans le chemin de fichier spécifié. Le format du fichier est déterminé par l'extension (.png,.jpg, etc.).ExtractBitmapsFromPage(pageIndex): Retourne une liste d'objetsAnyBitmappour toutes les images sur l'index de page 0 basé sur zéro spécifié. Utilisez ceci lorsque vous devez travailler avec des données d'image en mémoire plutôt que de les écrire dans des fichiers.
Modèle d'itération
L'exemple parcourt ExtractAllImages() en utilisant enumerate pour attribuer un index séquentiel unique à chaque nom de fichier d'image, empêchant les écrasements lorsque plusieurs images sont extraites du même document.
Apprenez à travailler avec des images PDF en utilisant IronPDF for Python !

