在 C# 中讀取 PDF 檔案
提取文字和圖片可以在從一種文件格式轉換到另一種時促進資料遷移。 提取的內容可以保存在更易於存取和編輯的格式中,從而減少資料丟失的風險。
嵌入的圖片和文字可以獨立於PDF文件進行提取。 提取的文字將是普通字串,而提取的圖片將是圖片緩衝區格式,然後可以導出或進一步處理。
使用extractRawImages方法從PDF文件中提取圖片。
這裡是一個修正過並附有註解的範例,說明您如何進行此操作:
在上述C#程式碼中:
- 我們使用IronPDF程式庫載入PDF文件。
- 調用了
ExtractText()方法從PDF中檢索文字。 這段文字被輸出到控制台。 - 使用
ExtractImages()方法提取圖片,這些圖片以位元組陣列形式儲存。 然後將每個圖片以指定的檔名保存到文件系統。
有關如何使用這些方法的詳細指導,請存取IronPDF文件。




