Bild extrahieren
IronPDF for Python kann alle in einem PDF-Dokument eingebetteten Bilder extrahieren — entweder als gespeicherte Bilddateien oder als Bitmap-Objekte im Speicher — mit der Möglichkeit, gezielt bestimmte Seiten anzusteuern.
Einstieg
Laden Sie eine PdfDocument mit PdfDocument.FromFile, und rufen Sie dann ExtractAllImages auf, um jedes Bild im Dokument abzurufen oder ExtractBitmapsFromPage, um Bilder von einer bestimmten Seite anhand ihres Indexes zu extrahieren.
Den Code verstehen
PdfDocument.FromFile(path, password): Öffnet die PDF-Datei. Das zweite Argument ist das Entschlüsselungs-Passwort; lassen Sie es weg für unverschlüsselte Dateien.ExtractAllImages(): Gibt eine Liste aller im Dokument gefundenen Bilder über alle Seiten zurück. Jedes Bild in der Liste ist ein Objekt mit einerSaveAs-Methode, um es auf die Festplatte zu schreiben.SaveAs(path): Speichert ein extrahiertes Bild im angegebenen Dateipfad. Das Dateiformat wird durch die Erweiterung bestimmt (.png,.jpg, etc.).ExtractBitmapsFromPage(pageIndex): Gibt eine Liste vonAnyBitmap-Objekten für alle Bilder auf dem angegebenen nullbasierten Seitenindex zurück. Verwenden Sie dies, wenn Sie mit Bilddaten im Speicher arbeiten müssen, anstatt sie auf Dateien zu schreiben.
Iterationsmuster
Das Beispiel iteriert über ExtractAllImages() mit enumerate, um jedem Bilddateinamen einen eindeutigen fortlaufenden Index zuzuweisen, um Überschreibungen zu verhindern, wenn mehrere Bilder aus demselben Dokument extrahiert werden.
Erfahren Sie, wie Sie mit PDF-Bildern mit IronPDF for Python arbeiten!

