擷取圖片
IronPDF for Python 可以提取嵌入在 PDF 文件中的所有圖像——無論是作為已保存的圖像文件還是作為記憶體中的位圖物件——並具有針對特定頁面的能力。
入門指南
using PdfDocument 載入 PdfDocument.FromFile,然後調用 ExtractAllImages 以檢索文件中的每個圖像,或使用 ExtractBitmapsFromPage 按其索引提取特定頁面的圖像。
理解程式碼
PdfDocument.FromFile(path, password):打開 PDF 文件。第二個參數是解密密碼; 對於未加密的文件可省略。ExtractAllImages():返回跨所有頁面在文件中找到的所有圖像的列表。 列表中的每個圖像都是一個具有SaveAs方法的物件,用於將其寫入磁碟。SaveAs(path):將提取的圖像保存到指定的文件路徑。 文件格式由擴展名決定(.jpg,等)。ExtractBitmapsFromPage(pageIndex):返回指定零為基礎的頁面索引上的所有圖像的AnyBitmap物件列表。 當您需要在記憶體中處理圖像資料而不是寫入文件時使用此功能。
迭代模式
此範例迭代遍歷 ExtractAllImages(),使用 enumerate 為每個圖像文件名分配一個唯一的序列號,以防止從同一文件中提取多個圖像時被覆蓋。






