画像を抽出
IronPDF for Pythonでは、PDFドキュメント内に埋め込まれたすべての画像を、保存された画像ファイルとして、またはメモリ内ビットマップオブジェクトとして抽出でき、特定のページをターゲットにすることもできます。
開始方法
ExtractAllImagesを呼び出してドキュメント内のすべての画像を取得するか、インデックスで特定のページの画像を抽出します。
コードの理解
PdfDocument.FromFile(path, password):PDFファイルを開きます。第二の引数は暗号化解除のパスワードです; 暗号化されていないファイルの場合は省略します。ExtractAllImages():ドキュメント内のすべてのページにわたって見つかったすべての画像のリストを返します。 リスト内の各画像は、それをディスクに書き込むためのSaveAsメソッドを持つオブジェクトです。SaveAs(path):抽出された画像を指定されたファイルパスに保存します。 ファイル形式は拡張子(.png,.jpgなど)によって決定されます。AnyBitmapオブジェクトのリストを返します。 ファイルに書き込むのではなく、メモリ内で画像データを処理する必要がある場合に使用します。
繰り返しパターン
例では、enumerateを使用してそれぞれの画像ファイル名にユニークな連続するインデックスを割り当て、同じドキュメントから複数の画像が抽出される際の上書きを防ぎます。






